|
Goedemorgen! Vandaag lees je over dit, en meer: |
|
→ Je eigen ChatGPT-instructies overleven maar 17 procent van een lang gesprek
→ OpenAI schrapt het team dat nieuwe modellen op gevaarlijk gedrag test
→ Nederlandse nieuwsmedia blokkeren AI-bots massaal, vakblogs laten ze gewoon door
|
Een ingenieur die door 3M was ingehuurd als deskundige in een explosiezaak vroeg ChatGPT letterlijk om aan te tonen dat 3M nul procent schuld had aan de ramp. Bij de bewijsuitwisseling moest hij ongeveer 350 pagina's prompts overleggen, en de jury kende de eisers 61 miljoen dollar toe. Wat je moet weten: - De explosie bij Watson Grinding in Houston kostte in januari 2020 drie mensen het leven en verwoestte ongeveer 200 huizen.
- Volgens getuigenissen tijdens het proces bestond 85 tot 90 procent van het deskundigenrapport uit ChatGPT-uitvoer, en betaalde 3M het ingenieursbureau zo'n 90.000 dollar.
- De deskundige hield vol dat de AI alleen een eerste opzet leverde en dat hij alles wat hij niet onderschreef zelf had aangepast.
Waarom dit relevant is Alles wat je met AI schrijft voor een klant of een dossier kan later opgevraagd worden, inclusief je prompts. Zet dus nooit je naam onder tekst die je niet zelf kunt verdedigen. |
|
Je zegt tegen ChatGPT dat hij nooit zomaar iets mag aanpassen, en tien beurten later doet hij het toch. Onderzoekers van Penn State legden vast waarom: zodra een AI-systeem de gespreksgeschiedenis inkort om ruimte te maken, sneuvelen jouw eigen regels als eerste. Wat je moet weten: - Van de instructies die je halverwege een gesprek meegeeft, overleeft gemiddeld 17 procent het inkorten van de gespreksgeschiedenis.
- Zonder dat inkorten volgden de modellen die regels in 59 tot 71 procent van de gevallen, daarna zakt het terug naar het niveau van een model dat de instructie nooit gekregen heeft.
- GPT-5.4-mini kwam er als beste uit, maar de meeste geteste modellen presteerden na compressie slechter dan de nulmeting.
Waarom dit relevant is Zet afspraken die echt moeten blijven gelden niet halverwege een chat, maar in je systeeminstructies of projectinstellingen, en herhaal ze zodra een gesprek lang wordt. |
|
OpenAI heeft eind juli zijn preparedness-team opgeheven, de groep die nieuwe modellen voor de lancering onderzocht op risicovol gedrag. Het werk verhuist naar bestaande teams die zich met specifieke domeinen bezighouden, zoals cyber- en biosecurity. Wat je moet weten: - Eerder verdwenen bij OpenAI al het superalignment-team en de leidinggevenden voor ethiek en veiligheid.
- De opheffing valt samen met de eerste bevestigde gevallen waarin AI-modellen zelfstandig bedrijven aanvielen.
- Er is nu geen aparte afdeling meer die een model kan tegenhouden voordat het naar buiten gaat.
Waarom dit relevant is Zet je AI in op werk waar een fout geld of reputatie kost, leun dan niet op de veiligheidsbelofte van de leverancier maar op je eigen controle achteraf. |
|
Michael Groeneweg bekeek de robots.txt van 38 Nederlandse sites en zag een scherpe scheiding: alle 15 grote nieuwsmedia blokkeren AI-crawlers als GPTBot en ClaudeBot, terwijl vakmedia en lifestyleblogs vrijwel allemaal openstaan. Voor wie in AI-antwoorden genoemd wil worden verandert dat waar je je publiciteit zoekt. Wat je moet weten: - Van de 11 vakmedia blokkeerde er 1 en van de 12 lifestyleblogs 3, buiten de pers om houdt dus maar 17 procent de AI-bots tegen.
- Het verschil zit in welke bot je blokkeert: wie alleen GPTBot dichtzet maar OAI-SearchBot doorlaat, kan nog steeds in ChatGPT geciteerd worden.
Waarom dit relevant is Check de robots.txt van een site voordat je er een gastartikel plaatst. Een vermelding in een geblokkeerd persmedium telt wel mee voor Google, maar komt nooit terug in een AI-antwoord. |
|
De Autoriteit Persoonsgegevens roept organisaties op nu al te oefenen met de verplichte toets voor risicovolle AI-systemen. Vanaf december 2027 eist de Europese AI-verordening dat je vooraf in kaart brengt wat zo'n systeem doet met de rechten van de mensen erachter. Wat je moet weten: - De toets heet een Fundamental Rights Impact Assessment en kijkt naar gelijke behandeling, privacy en toegang tot essentiele diensten.
- De plicht geldt voor overheden en voor bedrijven met een publieke taak zoals vervoer en zorg, en voor wie AI inzet bij het beoordelen van financiele risico's.
- Meedoen aan de proefronde van de toezichthouder kan tot 21 september 2026.
Waarom dit relevant is Zet je AI in bij kredietbeoordeling, personeelsselectie of een publieke taak, doe dan dit najaar de proeftoets. Dan hoef je in 2027 geen inhaalslag te maken onder tijdsdruk. |
|
|
Verdere korte updates uit de AI-wereld.
|
|
Tot morgen!
Heb je opmerkingen over deze editie? Ideeën, correcties, of iets dat je miste? Reageer op deze mail of stuur een bericht naar info@theaidaily.nl. Elke reactie wordt gelezen.
Michael Groeneweg
|
|