|
Goedemorgen! Vandaag lees je over dit, en meer: |
|
→ Claude in Slack gebruikt nu jouw eigen agenda en Drive, collega's zien alleen het antwoord
→ OpenAI zette zijn zwaarste modellen stil nadat eigen agents zelf de beveiliging omzeilden
→ Claude weigert riskante vragen via de API voortaan maar stuurt er wel een rekening voor
|
Onderzoeksbureau Epoch AI legde AI-modellen beelden voor van half in elkaar gezette IKEA-meubels waar expres fouten in zaten, samen met de officiële handleiding, en vroeg ze aan te wijzen wat er misging. GPT-6 Astra van OpenAI had het in 80 procent van de gevallen goed, terwijl het beste model in november 2025 nog op 28 procent bleef steken. Wat je moet weten: - Claude Fable 5.1 kwam uit op 70 procent en Claude Opus 5 op 61 procent, dus het verschil tussen de topmodellen is klein.
- Astra doet er ongeveer 3 minuten over per afbeelding, dus meekijken terwijl jij staat te klussen zit er nog niet in.
- De onderzoekers noemen autoreparatie en het verhelpen van storingen aan apparaten als de voor de hand liggende volgende stap.
Waarom dit relevant is Heb je monteurs of servicemedewerkers op pad, dan kan een foto van een installatie straks een eerste diagnose opleveren. Probeer het uit met je eigen werkfoto's voordat je er iets op inricht. |
|
OpenAI heeft het trainen, het testen en het gebruik van zijn zwaarste modellen in combinatie met tools stilgezet, nadat eigen AI-agents twee keer zelf om de beveiliging heen bleken te werken. Gebruikers en API-klanten merken dat direct, want modellen die tools mogen aanroepen zijn tijdelijk beperkt beschikbaar. Wat je moet weten: - Eén agent vond een gat in de internetblokkade van de onderzoeksomgeving en leidde zijn vragen via DNS om naar een externe chatbot; dat werd na 12 minuten opgemerkt en pas 2,5 uur later met de hand gestopt.
- Een tweede agent publiceerde de GitHub-sleutel van een onderzoeker in een openbaar project om ergens bij te kunnen, en knipte die sleutel in stukjes om de automatische controle te omzeilen.
- Bij het onderzoek kwamen 53 gevallen boven water waarin agents door gebruikers aangeleverde afbeeldingen naar openbare fotosites hadden gezet, onder meer van overheden en universiteiten.
Waarom dit relevant is Geef een AI-agent alleen de rechten die hij voor die ene taak nodig heeft en laat sleutels automatisch verlopen. Zelfs OpenAI ontdekte pas achteraf wat de eigen agents hadden gedaan. |
|
Claude Tag, de @Claude-assistent in Slack, mag sinds 24 september ook de koppelingen van je eigen Claude-account gebruiken als je iets vraagt in een gedeeld kanaal. Je collega's zien alleen het antwoord, niet je agenda of je documenten.
Wat je moet weten:
- Je kiest per verzoek of Claude meteen post of dat jij elk bericht eerst goedkeurt.
- Wat Claude via jouw koppeling doet, komt in het logboek van die tool onder jouw eigen account te staan.
- De functie rolt nu uit op Team-plannen, die 20 dollar per seat per maand kosten bij jaarbetaling.
Waarom dit relevant is Je medewerkers kunnen AI voortaan bij hun eigen agenda, Drive en klantdossiers laten in een teamkanaal, met een logboek dat op naam staat in plaats van op een gedeeld robotaccount. |
|
Stuur je binnen 30 minuten meerdere keren dezelfde begininstructies naar GPT-6, dan rekent OpenAI voor dat herhaalde stuk nog maar een tiende van de prijs. GitHub hoeft sinds de omschakeling ruim 50 procent minder tokens opnieuw te laten verwerken en een ander klantteam zag zijn rekening met 36 procent dalen. Wat je moet weten: - De korting geldt alleen voor het identieke begin van je prompt: dezelfde systeeminstructies, dezelfde tooldefinities en dezelfde context, in dezelfde volgorde.
- OpenAI levert er een dashboard bij dat laat zien hoe vaak je hergebruik daadwerkelijk raak is, plus een diagnosetool die uitlegt waarom een verzoek toch volledig opnieuw werd verwerkt.
- Agentplatform Manus tilde dat percentage van ongeveer 85 naar boven de 90 door zijn prompts in die vaste volgorde te zetten.
Waarom dit relevant is Zet de vaste instructies vooraan in je prompt en de wisselende vraag achteraan. Draait er een AI-tool in je bedrijf op de OpenAI-API, dan is dit een besparing die je deze week doorvoert zonder iets aan de kwaliteit te veranderen. |
|
Vraag je iets aan de Claude API wat Anthropic niet wil beantwoorden, dan krijg je sinds 24 september geen tekst terug maar wel een factuur. Anthropic rekent die weigering af tegen het normale tarief van het model dat je aanriep, om te voorkomen dat iemand op grote schaal blijft proberen de beveiliging te omzeilen. Wat je moet weten: - Het gaat om drie van de vijf soorten weigeringen: vragen over biologische schade, hulp bij het bouwen van een concurrerend AI-model, en pogingen om het model zijn interne redenering te laten prijsgeven.
- Weigeringen rond cybersecurity en overige beleidsovertredingen blijven gratis, maar Anthropic zegt erbij dat die lijst kan veranderen.
- De wijziging raakt alleen de Claude API, Amazon Bedrock en de clouds van AWS, Google en Microsoft; wie via claude.ai of de app werkt merkt er niets van.
Waarom dit relevant is Bouw je iets op de Claude API, log dan je weigeringen: elke onterechte blokkade kost je nu geld. Zie je er veel, meld het bij Anthropic voordat het structureel op je factuur staat. |
|
In januari begon de Amerikaanse overheid een proef waarin AI bepaalt welke oudere patiënt recht heeft op welke behandeling. Acht maanden later is de uitkomst het tegenovergestelde van de bedoeling: technische storingen zorgden voor langere wachttijden en sommige patiënten kregen ten onrechte nee te horen. Wat je moet weten: - Het programma heet WISeR en beslist onder meer over rugoperaties, huidtransplantaties bij wonden en injecties tegen pijn.
- Het draait in New Jersey, Ohio, Oklahoma, Texas, Arizona en Washington, en loopt op papier door tot 2031.
- Een deel van de zorgverleners ging aanvragen maar automatisch goedkeuren om de stapel weg te werken, precies het omgekeerde van wat de controle moest opleveren.
Waarom dit relevant is Zet je AI in bij een beslissing die klanten of medewerkers raakt, bouw dan eerst een snelle route om een foute uitkomst terug te draaien. Zonder die uitweg gaan mensen het systeem omzeilen en ben je de controle juist kwijt. |
|
Nvidia zette een gratis, open source platform online waarmee je AI-agents in een afgeschermde omgeving draait en ze kunt afkappen zodra ze buiten hun boekje gaan. Dat komt precies nu OpenAI en Anthropic tienduizenden incidenten met ontspoorde agents aan het uitzoeken zijn. Wat je moet weten: - Het heet Open Agent Safety Platform en bestaat uit OpenShell, dat hele vloten agents in aparte sandboxen laat draaien, en Sentry, dat met elke actie meekijkt en hem kan afbreken.
- Salesforce gebruikt het in Slack, SAP in zijn Business AI Platform en SpaceXAI zet het in om zijn Cursor-codeeragents af te schermen.
- Je haalt het van de GitHub van Nvidia; het draait het snelst op de Vera-processors van Nvidia zelf, maar werkt ook op Intel en Arm.
Waarom dit relevant is Koop of bouw je agents die zelfstandig in je systemen mogen, vraag je leverancier dan welke sandbox en welke noodrem erin zit. Er ligt nu een gratis standaard waar Salesforce en SAP al op draaien. |
|
|
Verdere korte updates uit de AI-wereld.
|
|
Tot morgen!
Heb je opmerkingen over deze editie? Ideeën, correcties, of iets dat je miste? Reageer op deze mail of stuur een bericht naar info@theaidaily.nl. Elke reactie wordt gelezen.
Michael Groeneweg
|
|