|
Goedemorgen! Vandaag lees je over dit, en meer: |
|
→ AI Mode van Google toont producten die gemiddeld 22 procent duurder zijn dan gewoon zoeken
→ TomTom bouwt Orbis Maps, een live verkeerskaart voor ChatGPT, Claude en Gemini
→ Artificial Analysis herziet zijn ranglijst, Claude Fable 5.1 staat weer bovenaan
|
Drie wandelaars lieten Google Gemini hun beklimming van Mount Shasta in Californië plannen en kregen een lijst met eten en water die veel te krap bleek. Ze vertrokken om 3 uur in de nacht, stonden pas om 19.00 uur op de top en werden de volgende ochtend uit een ravijn gehaald. Wat je moet weten: - Volgens het sheriffkantoor van Siskiyou County adviseerde Gemini fors minder proviand dan de groep nodig had voor een tocht die uitliep van 8 uur naar meer dan een dag.
- De gebruikelijke omkeertijd van 12 uur in de middag zat niet in de planning, waardoor de afdaling in het donker begon.
- De sheriff adviseert wandelaars om eerst de plaatselijke rangerpost te bellen en nooit alleen op AI te vertrouwen bij het plannen van een tocht.
Waarom dit relevant is Een AI-planning ziet er compleet uit, maar mist de randvoorwaarden die een ervaren mens er ongevraagd bij zegt. Laat een kenner meekijken zodra een AI-plan echte gevolgen heeft, of dat nu een bergtocht of een offerte is. |
|
Het Nederlandse Productrise vergeleek 100.000 identieke zoekopdrachten in Google Search en in AI Mode. Wie via AI Mode zoekt krijgt gemiddeld 21,6 procent duurdere producten te zien, en veel minder vaak een productlijstje. Wat je moet weten: - Slechts 23 procent van de AI-antwoorden bevatte productvermeldingen, tegenover 88 procent bij een gewone zoekopdracht.
- In 38 procent van de vergelijkingen verschilde de prijs van hetzelfde product tussen beide kanalen.
- Onderzoeker Hugo Huijer ziet geen logica in de selectie en zegt dat er in de prijskeuzes geen spoor van intelligentie te ontdekken valt.
Waarom dit relevant is Zoek je eigen topproducten eens op in AI Mode. Sta je er niet tussen, dan mis je een kanaal waarin je concurrent met een duurder product wel wordt getoond. |
|
OpenAI zette in augustus advertenties in ChatGPT open voor adverteerders, met targeting op regio en optimalisatie op conversie. De eerste bureaus die het probeerden zien klikken binnenkomen, maar er komt vrijwel geen omzet uit. Wat je moet weten: - Peter Jaffray van bureau Choice OMG gaf 415 dollar uit aan drie campagnes in Ontario en Alberta en hield daar nul conversies aan over.
- Bureau Camino5 zag ongeveer 1.000 dollar aan klikken die in Google Analytics niet terug te vinden waren, en Nicholas Verity van Cleverly vermoedt dat klikken van dezelfde gebruiker dubbel worden geteld.
- De advertenties bereiken voorlopig alleen gratis ChatGPT-gebruikers, en Verity verwacht pas over een half jaar een serieus advertentiekanaal.
Waarom dit relevant is Wil je nu al testen in ChatGPT, boek het dan als leergeld en niet als performance-budget. De meetbaarheid is nog te wankel om er beslissingen over je advertentiemix op te baseren. |
|
Steeds meer restaurants laten ChatGPT hun menufoto's en promotiemateriaal maken, want dat scheelt een dure fotograaf. Het probleem is dat gasten het verschil zien en afhaken zodra ze doorhebben dat het beeld door AI is gemaakt. Wat je moet weten: - Een café in San Francisco kreeg graffiti over zijn AI-menuborden heen, was ongeveer 700 dollar aan herstel kwijt en heeft de borden inmiddels weggehaald.
- AI worstelt vooral met textuur: het gegenereerde brood werd vergeleken met schuursponsjes en reptielenhuid.
- Onderzoek van Oxford-hoogleraar Charles Spence laat zien dat AI-eten alleen smakelijk oogt zolang je niet weet dat het AI is.
Waarom dit relevant is Zet AI-beeld nooit in voor het product dat je verkoopt. Zodra klanten merken dat de foto niet echt is, betaal je dat terug in vertrouwen, en dat kost meer dan de fotograaf die je uitspaarde. |
|
Artificial Analysis, de ranglijst waar veel bedrijven hun modelkeuze op baseren, is grondig herzien na kritiek dat GPT-6 Astra er te laag scoorde. In de nieuwe versie 4.2 staat Claude Fable 5.1 bovenaan, met Astra vlak daarachter. Wat je moet weten: - Er kwamen twee tests bij, AA-Briefcase voor kenniswerk en GDP.pdf voor documentanalyse, terwijl de oude GPQA-Diamond eruit ging omdat de modellen die inmiddels gewoon oplossen.
- Het aandeel geheime testvragen ging omhoog naar 40 procent, zodat modelmakers zich moeilijker gericht op de benchmark kunnen voorbereiden.
- Astra verbruikt per taak minder tokens dan elk ander topmodel en gaat daardoor op prijs-prestatie gelijk op met Claude Fable.
Waarom dit relevant is Een ranglijst die binnen een week omvalt is geen inkoopadvies. Test kandidaat-modellen op je eigen taken en kijk daarbij ook naar tokenverbruik, want dat bepaalt uiteindelijk je maandrekening. |
|
Politie en Openbaar Ministerie publiceerden het Cybercrimebeeld Nederland 2026 en zien een nieuw type dader: jonge westerse criminelen die in losse, tijdelijke samenwerkingsverbanden data stelen, crypto buitmaken en bedrijven afpersen. AI maakt hun aanvallen sneller, groter en overtuigender. Wat je moet weten: - Criminelen zetten AI in voor phishingmails, het bouwen van malware en het opsporen van kwetsbaarheden, en proberen daarbij de ingebouwde beveiliging van ChatGPT en Gemini te omzeilen.
- Het tweejaarlijkse rapport roept bedrijven op nooit losgeld te betalen, omdat betalen geen enkele garantie geeft dat gestolen data daadwerkelijk wordt gewist.
- Volgens de onderzoekers werkt de aanpak alleen als politie, bedrijven en buitenlandse opsporingsdiensten samen optrekken.
Waarom dit relevant is De tijd dat je phishing herkende aan slecht Nederlands is voorbij. Spreek met je team af dat betaalverzoeken en gewijzigde rekeningnummers altijd via een tweede kanaal worden geverifieerd. |
|
Google DeepMind bracht WeatherNext 3 uit, een weermodel dat op de vergelijkingstest Operational WeatherBench nauwkeuriger voorspelt dan de Amerikaanse weerdienst en dan het Europese weercentrum ECMWF, waar ook Nederlandse voorspellingen op leunen. Regenvoorspellingen zijn 60 procent nauwkeuriger dan in de vorige versie. Wat je moet weten: - Het model rekent per uur en op 5 kilometer nauwkeurig, terwijl klassieke weermodellen met stappen van 6 uur werken.
- Onderzoekers en bedrijven kunnen er nu via Google Cloud bij, daarna verhuizen de voorspellingen naar Google Search, Maps en Gemini.
- WeatherNext 3 heeft 2,4 keer zoveel rekenparameters als zijn voorganger en levert volgens Google-engineer Samier Merchant voor het eerst de basisgegevens waar straks veel Google-producten direct op draaien.
Waarom dit relevant is Zit je in horeca, bouw, evenementen of bezorging, dan is een regenkans per uur op wijkniveau directe planningswinst. Via Google Cloud kun je die voorspellingen nu in je eigen roosters trekken. |
|
|
Verdere korte updates uit de AI-wereld.
|
|
Tot morgen!
Heb je opmerkingen over deze editie? Ideeën, correcties, of iets dat je miste? Reageer op deze mail of stuur een bericht naar info@theaidaily.nl. Elke reactie wordt gelezen.
Michael Groeneweg
|
|