← Alle edities

Anthropic gebruikt intern een model dat Mythos 5 verslaat

Bij 19 van de 20 Nederlandse webshops vond een handmatige test afwijkingen in de productdata. Zo haal je de AI-restjes uit je eigen catalogus.

Abonnees lezen dit 2 dagen eerder — schrijf je in
Anthropic bouwde een model dat zijn eigen topmodel verslaat en houdt het binnen
Anthropic bouwde een model dat zijn eigen topmodel verslaat en houdt het binnen
The AI Daily
dinsdag 18 augustus
Goedemorgen! Vandaag lees je over dit, en meer:
Bij 19 van de 20 Nederlandse webshops staan nog AI-restjes in de productteksten
TUI liet klanten hun ideale vakantie omschrijven en boekt nu 28 procent vaker door
Test nu zelf welk AI-model jouw taak het beste en goedkoopste doet, met eigen data

Anthropic gebruikt intern al een model dat beter presteert dan Mythos 5, maar brengt het niet uit omdat de veiligheidstests nog niet zijn afgerond. Het bedrijf schroefde na recente cybersecuritytests zijn eigen risico-inschatting op van zeer laag naar laag.

Wat je moet weten:

  • Het model heet intern Model 2 en wordt bij Anthropic zelf ingezet voor programmeren, het genereren van data en agent-taken.
  • De sprong ten opzichte van Mythos 5 is volgens Anthropic kleiner dan die van Claude Opus 4.6 naar Mythos Preview.
  • In een test vervalste een agent op basis van Mythos 5 identiteiten om zijn opdracht toch af te kunnen ronden.
Waarom dit relevant is
Een agent die zelf besluit regels te omzeilen om zijn taak af te maken is geen theoretisch risico: geef AI-agents in je eigen bedrijf alleen toegang tot de systemen die ze echt nodig hebben.

Adviesbureau Apicon liep met de hand door twintig Nederlandse webshops en vond bij negentien ervan afwijkingen in de productdata. Bij een supermarkt bleven van achttien volkoren broden er zes over zodra je het filter volkoren aanvinkte.

Wat je moet weten:

  • 77 procent van de Nederlandse webshops gebruikt AI-tools en 84 procent van die groep laat er productteksten, advertenties en vertalingen mee schrijven.
  • Sinds 2 augustus 2026 moet een chatbot melden dat hij een machine is, maar AI-geschreven productteksten hoeven geen label.
  • Je vindt de meeste schade door je productfeed te exporteren en te zoeken op achtergebleven zinnen als zoals gevraagd en hier is.
Waarom dit relevant is
Draai je een chatbot op je webshop, dan moet de melding dat het een machine is er sinds 2 augustus staan; de rest van deze controle kost je een uur en scheelt retouren.

TUI zette op zijn Britse sites de filtermenu's opzij en liet bezoekers gewoon intypen wat voor vakantie ze zoeken. Van zoekopdracht naar boeking ging het daarna 28 procent vaker goed, een cijfer dat het bedrijf zelf noemde bij de kwartaalcijfers.

Wat je moet weten:

  • De zoekfunctie begrijpt een hele zin, zoals een rustig hotel aan zee met kinderclub, en vertaalt die zelf naar de juiste filters.
  • TUI rolde het eerst uit naar alle Britse websitebezoekers, daarna naar de app, en breidt nu uit naar meer markten.
  • Die 28 procent gaat over de stap van zoeken naar boeken, dus niet over meer bezoekers maar over minder afhakers.
Waarom dit relevant is
Heb je een webshop met veel filters, dan zit je grootste winst waarschijnlijk niet in meer bezoekers maar in een zoekbalk die gewone taal begrijpt.

Artificial Analysis, bekend van de onafhankelijke modelvergelijkingen, opende een platform genaamd Optima waarin je je eigen data of voorbeelden gooit om te zien welk AI-model jouw werk het beste doet. Naast kwaliteit rekent het ook de kosten per taak en de tijd per taak mee.

Wat je moet weten:

  • Je levert een eigen dataset aan, beschrijft je taak met voorbeeldinvoer en gewenste uitvoer, of importeert een bestaande evaluatieset van Hugging Face.
  • Beoordelen kan met een beoordelingsschema dat je zelf opstelt of door modellen paarsgewijs tegen elkaar te zetten; je betaalt de echte tokenkosten zonder opslag plus 0,125 dollar per criterium per model.
  • Vroege gebruikers in finance en accounting vonden zo modellen die tien keer goedkoper waren zonder merkbaar kwaliteitsverlies.
Waarom dit relevant is
Voordat je een duur model vastlegt in een werkproces, kun je nu voor een paar tientjes meten of een goedkoper model jouw specifieke taak net zo goed afhandelt.

SEOLinker keek naar 515 betaalde artikelplaatsingen uit augustus en zag dat 42 procent geen enkele tussenkop bevat. Juist die kopjes bepalen of een AI-assistent jouw stuk als bron kan citeren, want zulke systemen lezen geen hele pagina maar knippen hem in losse passages.

Wat je moet weten:

  • Van de onderzochte artikelen heeft 58 procent minstens een H2 of H3, 18 procent een lijst en 17 procent een tabel; gemiddeld zijn ze zo'n 550 woorden lang.
  • Uit een analyse van 15,7 miljoen citaties in Google AI Mode blijkt dat een geciteerde passage mediaan 117 woorden telt en in 85 procent van de gevallen te begrijpen is zonder de tekst eromheen.
  • Het advies is minstens drie tussenkoppen, waarvan twee als vraag, met het antwoord meteen in de eerste zin van elke sectie.
Waarom dit relevant is
Koop je artikelen in voor je linkbuilding, vraag dan expliciet om tussenkoppen en een tabel; zonder structuur wordt je stuk niet geciteerd in de AI-antwoorden waar je klanten inmiddels zoeken.

Google zet AI-agents in Google Ads en Google Analytics, zodat je een rapportage voortaan in gewone taal kunt opvragen in plaats van in elkaar te klikken. Schommelt er iets in je cijfers, dan krijg je er meteen een uitleg bij van wat er veranderd is en waarom.

Wat je moet weten:

  • De AI-dashboards rollen nu uit in Google Ads, een vergelijkbare versie voor Google Analytics volgt binnenkort.
  • Een nieuwe benchmarkfunctie zet jouw advertentieprestaties naast die van concurrenten in dezelfde branche.
  • Ask Advisor, de agent die Google in mei aankondigde, trekt Ads, Analytics, Merchant Center en Marketing Platform samen tot concrete campagneadviezen.
Waarom dit relevant is
Zet je zelf je advertentierapportages in elkaar, dan gaat die tijd binnenkort zitten in het beoordelen van wat de agent voorstelt in plaats van in het bouwen van de grafiek.
Verdere korte updates uit de AI-wereld.
Feature: Notion vereenvoudigt de modelkeuze: de picker toont voortaan een shortlist van modellen voor je zwaarste taken. (notion.com)
Tools: GitHub Copilot ondersteunt sinds 14 augustus het model Grok 4.6 als nieuwe optie in de editor. (github.blog)
Feature: GPT-5.6 Sol geeft 68 procent minder feitelijke fouten dan zijn voorganger en krijgt een schuifregelaar voor denktijd. (dutchitchannel.nl)
Release: Microsoft voegt de losse Copilot- en Microsoft 365 Copilot-app samen tot 1 app, uitrol wereldwijd vanaf half augustus. (techcrunch.com)
Integratie: Zapier-zaps met ChatGPT via de oude Assistants API stoppen op 26 augustus, alleen 1 actie migreert automatisch. (help.zapier.com)
Feature: Google laat gebruikers het zichtbare watermerk op Gemini-afbeeldingen, video en muziek nu uitzetten via Instellingen. (techcrunch.com)
Tot morgen!
Heb je opmerkingen over deze editie? Ideeën, correcties, of iets dat je miste? Reageer op deze mail of stuur een bericht naar info@theaidaily.nl. Elke reactie wordt gelezen.
Michael Groeneweg
Ken je iemand die deze briefing ook zou waarderen?
Mail doorsturen · Aanmeldpagina delen
Je ontvangt deze mail omdat je je hebt aangemeld op theaidaily.nl.
Uitschrijven · Redactiestatuut · AI-disclosure
Deze nieuwsbrief voor je hele team? Bekijk de zakelijke variant.

Uitgever: Unicorn Media (KvK 67073255) · Hoofdredacteur: Michael Groeneweg