|
Goedemorgen! Vandaag lees je over dit, en meer: |
|
→ Onderzoekers lieten AI 6.080 patches schrijven, slechts een kwart loste het lek echt op
→ Gemini Flash wordt twee keer zo goedkoop en verslaat Claude en GPT-5.6 op code
→ Microsoft schrapt Copilot Labs en groepschats, je experimenten verdwijnen mee
|
|
ChatGPT-abonnees met Plus of Pro kunnen sinds 6 augustus per vraag instellen hoeveel denktijd het model neemt, via een schuifregelaar in het invoerveld. Gratis gebruikers krijgen in plaats daarvan een Think-knop en onbeperkte tekstchats.
Wat je moet weten:
- De regelaar werkt op web, mobiel en desktop en geldt per vraag, niet per gesprek.
- OpenAI voegde Instant en Thinking samen tot één model, zodat de toon niet meer verspringt als je opschaalt.
- Volgens een interne test van OpenAI bevatten antwoorden van de nieuwe GPT-5.6 Sol ongeveer 68 procent minder vaak een feitfout dan die van GPT-5.5 Instant.
Waarom dit relevant is Zet de regelaar hoog bij calculaties en contracten en laag bij mailwerk, dan betaal je alleen extra wachttijd op de taken waar een fout je echt geld kost. |
|
Drie weken na de vorige versie brengt Google Gemini 3.7 Flash uit, en dat model kost de helft van zijn voorganger. Voor wie AI in een eigen tool of automatisering heeft zitten betekent dat direct lagere rekeningen, zonder dat je iets inlevert op kwaliteit. Wat je moet weten: - De prijs gaat naar 0,75 dollar per miljoen ingevoerde tokens en 3,75 dollar per miljoen gegenereerde tokens, een introductietarief dat tot het einde van het jaar loopt.
- Op de programmeertest DeepSWE springt de score van 49,0 naar 65,3 procent, en volgens Google verslaat het model daarmee zowel Claude Sonnet 5 als GPT-5.6 Terra.
- Het model is meteen beschikbaar via de API, AI Studio en Antigravity.
Waarom dit relevant is Draait er bij jou iets op Gemini Flash via de API, check dan deze week of je kunt overstappen: dezelfde functionaliteit voor de helft van de kosten is zelden zo makkelijk binnen te halen. |
|
Het securityteam van 1Password liet ChatGPT-5.5 en Claude Opus 4.8 samen 6.080 patches schrijven voor zes bekende kwetsbaarheden. Slechts 26 procent dichtte het lek echt zonder iets anders kapot te maken.
Wat je moet weten:
- 53,9 procent van de patches loste de kwetsbaarheid niet op, introduceerde een nieuwe, of allebei tegelijk.
- Ook bij de geslaagde patches was ruim een derde fragiel: ze blokkeren alleen het exacte aanvalspad uit de melding en niets daarbuiten.
- Gaf de onderzoeker het model eerst de juiste diagnose van de fout, dan steeg het slagingspercentage van ongeveer 17 naar ongeveer 67 procent.
- Sinds 15 augustus geldt de Cyberbeveiligingswet, en die verlangt aantoonbare maatregelen: een testrapport telt, "de AI heeft het opgelost" niet.
Waarom dit relevant is Laat je beveiligingsfixes door AI schrijven, draai dan de exploit zelf opnieuw voor en na de patch, want kijken naar de code is aantoonbaar niet genoeg. |
|
OpenAI heeft Computer History uitgebracht, een functie in de ChatGPT-app voor macOS die bijhoudt in welke apps en websites je werkt en daar een doorzoekbare tijdlijn van maakt. ChatGPT en Codex kunnen die tijdlijn daarna gebruiken, zodat je niet meer hoeft uit te leggen waar je gisteren mee bezig was. Wat je moet weten: - De functie legt klikken, toetsaanslagen en het wisselen tussen apps vast via de toegankelijkheidsfuncties van macOS, maar maakt geen schermafbeeldingen, schermopnames of audio-opnames.
- Computer History staat standaard uit en is beschikbaar voor ChatGPT Pro, Business en Enterprise, waarbij een beheerder bij Business en Enterprise eerst toestemming moet geven per medewerker.
- Nederland en de rest van de Europese Economische Ruimte krijgen de functie pas over enkele weken, samen met Zwitserland en het Verenigd Koninkrijk.
Waarom dit relevant is Zet dit niet zomaar aan op een werklaptop met klantgegevens: bespreek eerst binnen je bedrijf wat er wel en niet vastgelegd mag worden voordat de functie in Nederland landt. |
|
Microsoft haalt vanaf deze maand drie onderdelen uit Copilot: het gele animatiefiguurtje Mico, de groepschats waarin meerdere collega's samen met Copilot konden werken, en Copilot Labs waar experimentele functies werden uitgeprobeerd. Het bedrijf noemt het een overgang naar een vernieuwde Copilot-ervaring. Wat je moet weten: - Bestaande groepschats worden omgezet naar losse gesprekken en de berichten van je collega's zijn daarna niet meer terug te lezen.
- Copilot Labs sluit helemaal en zelfgemaakt materiaal zoals 3D-objecten en audiofragmenten verhuist niet automatisch mee.
- Copilot Voice zelf blijft gewoon werken, alleen het pratende figuurtje verdwijnt eruit en duikt op in het leergedeelte Learn Live.
Waarom dit relevant is Gebruikt je team Copilot-groepschats of heb je iets in Copilot Labs gemaakt, exporteer of kopieer dat dan deze week zelf, want na de uitrol is het niet meer op te halen. |
|
Bij ongeveer 25 tot 30 procent van alle commerciële zoekopdrachten laat ChatGPT inmiddels advertenties zien, ongeveer even vaak als Google in AI Mode. Onderzoeksbureau SE Ranking analyseerde 50.000 prompts in 20 productcategorieën en zag dat de advertenties bezoekers opleveren, maar niet de kwaliteit die adverteerders verwachten. Wat je moet weten: - 14 procent van de getoonde advertenties had inhoudelijk niets te maken met het gesprek waarin ze verschenen.
- Adverteren in ChatGPT werkt niet met zoekwoorden zoals bij Google Ads, maar met een omschrijving in gewone taal van het soort gesprek waarin je wilt opduiken.
- Volgens de onderzoekers werkt het kanaal nu vooral voor klanten die al een concrete vraag hebben en opties vergelijken, en nog niet voor het opbouwen van naamsbekendheid.
Waarom dit relevant is Wil je hier iets mee, richt je campagne dan in op gesprekken en koopintentie in plaats van zoekwoorden, en zorg dat je landingspagina het antwoord geeft waar de klant in dat gesprek naar zoekt. |
|
|
Verdere korte updates uit de AI-wereld.
|
|
Tot morgen!
Heb je opmerkingen over deze editie? Ideeën, correcties, of iets dat je miste? Reageer op deze mail of stuur een bericht naar info@theaidaily.nl. Elke reactie wordt gelezen.
Michael Groeneweg
|
|