De vijf koppen van vandaag
- Nederlandse artsen presteren beter met AI-assistent, maar vertrouwen hem ook te vaak wanneer hij ongelijk heeft
- OpenAI’s politieke campagnetak financiert AI-nieuwssite die critici van de AI-industrie aanvalt
- Oracle torst 130 miljard schuld en tekent voor 300 miljard aan datacenters — allemaal op basis van één OpenAI-contract
- Europa verplicht vanaf vandaag labeling van AI-content: deepfakes en chatbots moeten zich herkenbaar maken
- AI-poster wint ontwerpwedstrijd op Amerikaanse staatsjaarbeurs, organisatie vraagt zich nu af of dat wel mocht
Het nieuws van vandaag
Nederlandse artsen scoren beter met AI, maar verliezen hun weerstand wanneer de assistent ongelijk heeft
Een onderzoek laat zien dat bronvermelding artsen helpt, maar ook misleidt: bij een fout antwoord met citaten daalt de kritische houding van 92% naar 35%.
Onderzoekers lieten 46 artsen klinische vragen beantwoorden, eerst zonder hulp en daarna met ondersteuning van CORA, een AI-assistent die antwoorden voorziet van bronnen uit de medische literatuur. De nauwkeurigheid steeg van 71% naar 83%. Maar het experiment toonde ook een asymmetrisch effect: wanneer de AI een correct antwoord gaf met citaten, volgden artsen het advies in 77% van de gevallen (tegenover 34% zonder bronnen). Wanneer de AI fout zat maar wél citaten toonde, daalde de weerstand van artsen van 92% naar slechts 35%.
De onderzoekers noemen dit een “grounding-dependent bias”: de aanwezigheid van bronnen verhoogt het vertrouwen, ook wanneer de conclusie niet klopt. Het fenomeen lijkt vergelijkbaar met hoe mensen reageren op beweringen die vergezeld gaan van indrukwekkende maar irrelevante grafieken of tabellen.
OpenAI’s politieke campagnetak financiert AI-nieuwssite die critici van de industrie aanvalt
De SuperPAC van OpenAI bleek de afgelopen maanden geld te steken in een nieuwssite waarvan alle artikelen door bots worden geschreven.
Model Republic presenteert zich als onafhankelijk nieuwsplatform, maar uit onderzoek van journalistencollectief The Markup blijkt dat het wordt gefinancierd door Stargate PAC, de politieke campagneorganisatie van OpenAI. De site publiceert artikelen over AI-regelgeving en technologiebeleid, geschreven door fictieve auteurs met AI-gegenereerde profielfoto’s. Meerdere stukken vielen critici van de AI-industrie aan, waaronder academici die gewaarschuwd hadden voor de risico’s van ongereguleerde AI-ontwikkeling.
OpenAI bevestigde de financiering tegenover The Markup, maar ontkende dat de PAC redactionele invloed heeft. De site toont geen disclaimer over AI-gegenereerd materiaal. Dit gebeurt in dezelfde week dat Europa het labelen van AI-content verplicht stelt.
Oracle torst 130 miljard schuld en weddt alles op één OpenAI-deal
Het bedrijf tekende voor 300 miljard dollar aan datacenters over vijf jaar, maar twijfel groeit of OpenAI ooit genoeg omzet haalt om die rekening te betalen.
Oracle heeft zich diep in de schulden gestoken om datacentercapaciteit te bouwen voor OpenAI. Het contract loopt over vijf jaar en heeft een waarde van 300 miljard dollar — bijna het dubbele van de huidige marktkapitalisatie van Oracle zelf. Het bedrijf heeft nu 130 miljard dollar aan uitstaande schulden en neemt er honderden miljarden bij aan lease- en bouwverplichtingen.
Analisten uiten twijfel. OpenAI rapporteerde voor 2024 een omzet van ongeveer 3,7 miljard, met verliezen van meer dan een miljard. Om de Oracle-deal rendabel te maken, zou OpenAI zijn omzet de komende jaren met een factor twintig moeten opschalen — een groei die zelfs voor AI-maatstaven extreem is. Mocht OpenAI de betalingen niet kunnen dragen, dan zit Oracle met lege datacenters en een schuldenberg.
Europa verplicht vanaf vandaag labeling van AI-content
Bedrijven moeten deepfakes, chatbots en biometrische analyse voortaan expliciet markeren — de eerste concrete handhavingsregel uit de AI Act.
Vanaf 2 augustus zijn bedrijven in de EU verplicht om AI-gegenereerde media duidelijk te labelen als zodanig. Chatbots en virtuele assistenten moeten expliciet melden dat ze niet menselijk zijn. Systemen die actief biometrische gegevens analyseren — zoals emotieherkenning of gezichtsscans — moeten gebruikers daarvan op de hoogte stellen. De regels zijn onderdeel van de AI Act, maar dit is de eerste bepaling die daadwerkelijk met een deadline en handhaving komt.
Bedrijven die zich niet aan de regels houden, riskeren boetes tot 7,5 miljoen euro of 1,5% van de wereldwijde omzet. De Europese Commissie stelde de regels vast in februari, maar bedrijven kregen een half jaar om hun systemen aan te passen. Toezichthouders in lidstaten bepalen de komende maanden hoe streng ze gaan controleren.
AI-poster wint ontwerpwedstrijd jaarbeurs Ohio, organisatie twijfelt achteraf
De winnende inzending bleek volledig gegenereerd door AI — iets wat de regels niet expliciet verboden, maar ook niet voorzagen.
Een bezoeker won de posterwedstrijd van de Ohio State Fair met een ontwerp dat volledig door AI was gemaakt. De jury koos het werk uit honderden inzendingen, zonder te weten dat het gegenereerd was. Toen dat na de bekendmaking bekend werd, ontstond discussie: de regels van de wedstrijd verboden nergens AI-gebruik, maar de organisatie had er ook niet over nagedacht. De Fair liet de uitslag staan, maar kondigde aan de regels voor volgend jaar aan te scherpen.
Het incident lijkt op eerdere gevallen waarbij AI-kunst prijzen won op concoursen — met het verschil dat dit een lokale, traditionele wedstrijd betrof voor een breed publiek, geen gespecialiseerde kunstbeurs. Critici wezen erop dat de jury klaarblijkelijk geen verschil zag; voorstanders antwoordden dat de winnaar de tool effectief had ingezet en het resultaat op eigen merites werd beoordeeld.
via Ohio State Fair
Voor wie zelf met AI bouwt
RAG-TESTER: geautomatiseerd testen van retrieval-gestuurde AI-systemen
Een nieuw raamwerk genereert testgevallen, voert ze uit en evalueert antwoorden — specifiek gericht op de zwakke punten van RAG-pipelines.
Onderzoekers publiceerden RAG-TESTER, een testframework voor systemen die externe informatie ophalen voordat ze antwoorden genereren. Het raamwerk creëert automatisch complexe passages, moeilijke queries en antwoorden die niet door de documentenset ondersteund worden. Het draait de tests, vergelijkt uitkomsten en gebruikt een LLM als beoordelaar. In experimenten met acht LLM’s en zes embedding-modellen detecteerde RAG-TESTER 6,6% meer fouten dan een basislijn-generator, vooral bij multi-hop vragen en edge cases.
Aanbeveling: Nuttig als je RAG-systemen bouwt en verder wilt gaan dan handmatige spot-checks. De code is open source en werkt out-of-the-box met gangbare embeddings.
via ArXiv
Real-time detectie van agent-failures zonder second-guessing LLM
Een monitor die draait in microseconden per stap en enkel kijkt naar observeerbare telemetrie — geen dure extra LLM-calls meer nodig.
Een onderzoek toonde aan dat een ensemble van echo-state-netwerken met CUSUM-alarmen 71% van agent-failures kan detecteren bij een valse-alarm-budget van 5%, zonder een tweede LLM in te zetten. De monitor traint alleen op succesvolle runs en kijkt naar step-telemetrie: execution time, tool errors, context lengths. Het systeem werkt over drie frameworks (LangChain, CrewAI, AutoGPT) en vier modellen (Qwen, Llama, Gemini). Het presteert vooral goed naarmate meer stappen na de fout zijn uitgevoerd: +0,09 AUROC binnen drie stappen, +0,40 na negen stappen.
Aanbeveling: Interessant als je agents in productie draait en failures vroeg wilt detecteren zonder je inference-kosten te verdubbelen. Werkt beter voor langere trajecten.
via ArXiv
AutoFOAM: zelflerend LLM-agent voor computational fluid dynamics
Een fine-tuned model dat OpenFOAM-simulaties opzet, draait en verfijnt op basis van natuurlijke instructies — inclusief anti-collapse mechanisme tegen model-degeneratie.
AutoFOAM is een Qwen-gebaseerd model dat CFD-simulaties configureert en itereert zonder handmatige tussenkomst. Het model werd getraind op 252 prompts voor zeven OpenFOAM-solvers en dertien mesh-templates. Het bevat een zevendelige evolutie-loop met drie anti-collapse-streams: RAG-verrijkte retry-context, dictionary-level patching en prompt-diversiteit via parafrasering. Hiermee voorkomt het dat het model degradeert tijdens herhaalde self-training.
Aanbeveling: Relevant voor wie engineeringsimulaties automatiseert en zoekt naar een self-refining agent-architectuur die stabiel blijft over meerdere iteraties. De anti-collapse-streams zijn generiek toepasbaar.
via ArXiv
NRC · ArXiv · Model Republic · Euronews · Ohio State Fair · HackerNews · Bluesky
Transparantie: het maken van deze editie kostte ±€0,24 aan AI-modelgebruik (7-daags gemiddelde per editie; selectie, schrijven, verrijking en eindredactie meegeteld).
