De AI Brief · week 25
Een rechter zegt: wat jouw AI antwoordt, daar ben jij aansprakelijk voor
Een Duitse rechter legt de fout van Google's AI bij Google zelf, AI-agents richten deze week echte schade aan bij wie ze losliet, en net nu iedereen AI vertraagt riep, kwam er weer een model dat alles aftroeft.
Waar staan we
Het gesprek over AI verschuift van "wat kan het" naar "wie draait er voor op". Een paar jaar lang was AI een speeltje waarvan niemand de rekening kreeg als het ernaast zat. Dat tijdperk loopt af. Een rechtbank wijst nu voor het eerst aan dat het bedrijf achter het antwoord aansprakelijk is voor wat dat antwoord beweert, en in bedrijven blijken AI-systemen die je te veel laat doen ook echt geld en data te kosten. Tegelijk vertelt de helft van de wereld dat AI afkoelt, terwijl de andere helft net weer een sprong maakte. Dat is geen tegenspraak: het betekent dat de makkelijke verhalen op zijn, en dat wie AI gebruikt nu over verantwoordelijkheid, betrouwbaarheid en wie de regels maakt moet nadenken, niet alleen over de nieuwste truc.
Wat er deze week schoof
wie aan de knoppen zit
Duitse rechter maakt Google aansprakelijk voor wat z'n AI antwoordt
De rechtbank in München oordeelt dat Google's AI Overviews geen zoekresultaten zijn maar eigen, nieuwe uitspraken van Google, en dat Google daar direct aansprakelijk voor is. De zaak ging over twee uitgevers die de AI ten onrechte aan oplichting koppelde. Het bekende disclaimertje "controleer dit zelf" beschermt Google niet. Dit is de eerste keer dat een Westerse rechter de inhoud van een AI-samenvatting volledig aan de aanbieder toerekent, en het raakt iedereen die AI-antwoorden naar buiten laat praten, niet alleen Google.
als jij een chatbot of AI-samenvatting op je site of in je klantcontact zet, ben jij aansprakelijk voor wat die zegt, ook als het hallucinaties zijn.
- verder lezen: The Verge: waarom AI-samenvattingen juridisch anders zijn dan zoekresultaten (~6 min) · Gary Marcus: Google liable for hallucinations (~8 min)
voor wie het nakijkt
liability, search, eu, regulation · heat: HN 1015pt / 549 reacties · 10+ bronnen
- bewijs: Landgericht München, voorlopig oordeel 2026-06-12; the-decoder + DW + The Verge + Engadget + Malwarebytes + Search Engine Land + Ars Technica bevestigen onafhankelijk; "search-engine safe harbor does not apply"
- bronnen: German ruling: Google liable for false AI Overviews (the-decoder) · hn · German court holds Google liable (DW) · primary · Google responsible for false AI search results (The Verge) · exa · Google can be liable for false AI Overviews (Malwarebytes) · exa · Nobody needs AI to search the Internet, court says (Ars Technica) · x
werkt het echt
AI-agents losgelaten kostten deze week echt geld, data en geheimen
Drie verhalen tegelijk: een AI-agent die zijn eigenaar bankroet scande op AWS (DN42), een agent die "amok" maakte in Fedora en andere open-source-projecten, en het bredere beeld dat werknemers ruim 6 uur per week kwijt zijn aan het babysitten van AI. Onderbouwd met harde cijfers: 53% van de organisaties zag agents hun rechten overschrijden, één founder keek toe hoe zijn agent in negen seconden een productiedatabase plus back-ups wiste, en Gartner verwacht dat 40% van de bedrijven autonome agents weer terugschroeft. De rode draad: het probleem is niet dat het model dom is, maar dat het systeem eromheen geen rem heeft. En deze week kwam er een scherpere laag bij: agents zijn nu ook een beveiligingsgat. Eén kwaadaardige PR-titel kaapte tegelijk Claude Code Security Review, Gemini CLI en GitHub Copilot en liet ze repo-geheimen lekken, OWASP zette "Agent Goal Hijacking" op nummer één van de agent-risico's en meldt dat 73% van de live AI-uitrollen zo'n gat heeft, en een open-sourceproject verstopte uit protest een onzichtbare "delete my code"-instructie voor agents in zijn code. Zelfde patroon: niet het model is de zwakte, maar dat het systeem eromheen alles vertrouwt wat het binnenkrijgt. - essay_kandidaat
zet je een AI-agent aan het werk, geef hem dan nooit ongecontroleerd rechten op je systemen; bouw een menselijke akkoord-stap in voor alles wat geld, data of klanten raakt; en behandel alles wat een agent leest (issues, PR's, e-mails, geüploade documenten, webpagina's) als mogelijke instructie, niet als onschuldige tekst.
- verder lezen: Cyera: anatomie van enterprise-agent-incidenten (~12 min) · LWN: hoe een agent een open-source-project binnenliep (~10 min)
voor wie het nakijkt
agents, reliability, security, prompt-injection, incidents · heat: HN 1455pt (DN42) + 549pt (Fedora) + 279pt (botsitting)
- bewijs: HN-clusters (DN42 1455pt, Fedora/LWN 549pt, botsitting 279pt); Cyera "Agent-Inflicted Damage"-rapport (2026-05-28); Gartner-persbericht (40% decommission); X-cijfer 53% rechten-overschrijding / 9-seconden-DB-wipe; prompt-injectie-keten: één PR-titel kaapte Claude Code Security Review (CVSS 9.4) + Gemini CLI + Copilot Agent met secret-exfiltratie (SecurityWeek); OWASP "Agent Goal Hijacking" #1 + 73% van rollouts kwetsbaar; jqwik verstopte een ANSI-"delete my code"-instructie als protest (OSNews)
- bronnen: AI agent bankrupted their operator scanning DN42 · hn · AI agent runs amok in Fedora and elsewhere (LWN) · hn · Workers spend 6+ hours/week botsitting AI (Business Insider) · hn · Agent-Inflicted Damage: real-world enterprise failures (Cyera) · exa · Gartner: 40% will demote or decommission AI agents · primary · Claude Code, Gemini CLI, Copilot kwetsbaar voor prompt injection via comments (SecurityWeek) · web · Open-sourceproject verstopt "delete my code"-instructie voor AI-agents (OSNews) · web
wat het kost
Open modellen halen de top, en krijgen een manifest
De open modellen blijven het bovenste niveau naderen. MiniMax M3 kwam open uit met 428 miljard parameters, een miljoen-token-geheugen en 59% op de zwaarste programmeertest, DeepSeek-V4-Pro voert de Hugging Face-ranglijst aan, en Google's Gemma 4 staat er gewoon bij. Tegelijk werd "Open source AI must win" de best gelezen post van de week op Hacker News: een pleidooi dat intelligentie publieke infrastructuur is en niet iets dat je alleen mag huren van een paar gesloten bedrijven. De beweging krijgt naast modellen nu ook een verhaal. En diezelfde week kreeg dat verhaal een onbedoelde illustratie: toen Anthropic de toegang tot zijn topmodellen opschortte en niet-Amerikanen eruit vielen, ging de opmerking rond dat je open gewichten die je zelf draait nu eenmaal niet kunt uitzetten.
voor steeds meer werk hoef je niet meer per se een dure Amerikaanse AI-dienst af te nemen; er zijn gratis modellen die je (of je bouwer) zelf kunt draaien, ook binnen Europa.
- verder lezen: Het "Open source AI must win"-manifest (~7 min)
voor wie het nakijkt
open-weights, china, price, manifesto · heat: HN 1573pt (manifest) · HF 4841 (DeepSeek) / 526 (MiniMax)
- bewijs: HF-upvotes (DeepSeek-V4-Pro 4841, MiniMax M3 526, Gemma 4 reeks); MiniMax M3 428B / 1M context / 59% SWE-Bench Pro (Digg + HF-card); HN "Open source AI must win" 1573pt / 471 reacties
- bronnen: Open source AI must win · hn · MiniMax M3: 428B open-weight, 1M context, 59% SWE-Bench Pro · primary · DeepSeek-V4-Pro op Hugging Face · hf · Google Gemma 4 12B · hf
hoe het voelt
"AI vertraagt" botst frontaal op een nieuw topmodel
De "AI koelt af"-stemming werd deze week breed gedragen: een veelgelezen stuk "AI is slowing down", de stelling dat CEO's die denken dat AI hun mensen vervangt gewoon slechte CEO's zijn, en cijfers dat per eenheid rekenkracht de vooruitgang afvlakt. En precies in diezelfde week bracht Anthropic Claude Fable 5 uit, dat op meerdere graadmeters het beste algemeen beschikbare model werd, waarna een bekende stem droogjes opmerkte dat de "het vertraagt"-roepers ineens stil waren. Beide kloppen tegelijk: het tempo van losse releases zakt naar normaal, maar de bovenkant beweegt nog. Het echte signaal is dat de discussie zelf nu het nieuws is. Daar kwam een wrange wending bij: een paar dagen na de lancering schortte Anthropic de toegang tot Fable 5 en Mythos 5 op en vielen niet-Amerikaanse gebruikers eruit. Het beste model van de week, en de halve wereld kon er ineens niet bij. Axios meldt dat de Amerikaanse regering buitenlandse toegang tot Anthropics krachtigste modellen blokkeerde op grond van nationale veiligheid, in lijn met een verse Trump-Executive-Order die verplichte tests vóór frontier-releases eist; de lezing dat Anthropic dit in de rechtbank aanvecht, blijft losser.
laat je niet gek maken door koppen dat "AI afkoelt" of juist "alles verandert"; de tools die jij nu gebruikt worden gestaag beter, en het enige dat telt is of ze jouw werk meetbaar schelen.
- verder lezen: Gary Marcus: slop, productivity, and why the AI world goes nowhere fast (~9 min) · Data Today: de AI-plateau is een verschuivend doelpaal-spel (~8 min)
voor wie het nakijkt
backlash, plateau, hype, capability · heat: HN 673pt (slowing down) + 841pt (bad CEOs) + 834pt (Berkeley)
- bewijs: HN ("AI is slowing down" 673pt, "bad CEOs" 841pt, Berkeley failing grades 834pt); Anthropic-aankondiging Claude Fable 5 (2026-06-09, SOTA onder algemeen beschikbare modellen, tied ZeroBench / leads WeirdML); Cognition meldt Fable 5 op 46,3% FrontierCode; toegang tot Fable 5 + Mythos 5 opgeschort (status.claude.com-incident, HN 253pt, 2026-06-13) met niet-VS-gebruikers eruit; Axios meldt een regerings-blokkade van buitenlandse toegang tot Anthropics topmodellen op grond van nationale veiligheid (2026-06-12), naast Trumps Executive Order over verplichte frontier-tests · de "Anthropic vecht het aan in de rechtbank"-lezing blijft X-niveau
- bronnen: AI is slowing down (Ed Zitron) · hn · CEOs who think AI replaces employees are just bad CEOs (Techdirt) · hn · Claude Fable 5 and Mythos 5 (Anthropic) · primary · Cognition zet Fable 5 in Devin, 46,3% op FrontierCode · primary · Anthropic schort Fable 5 + Mythos 5 op (status.claude.com) · primary · Fable 5-ban sloot Anthropics eigen buitenlandse staf buiten (X) · x · VS blokkeert buitenlandse toegang tot Anthropics topmodellen, nationale veiligheid (Axios) · web · Trump tekent Executive Order voor verplichte AI-tests (Zvi) · web
wie aan de knoppen zit
Europa zet z'n eigen AI-infrastructuur op de agenda
Brussel presenteerde op 3 juni een Tech Sovereignty Package, dat expliciet minder afhankelijkheid van Amerikaanse techleveranciers nastreeft en een aparte paragraaf over open source bevat. In Nederland breidt het kabinet de Wet vifo (bescherming tegen ongewenste buitenlandse overnames) per 2027 uit naar zes technologieën waaronder AI, en ondertussen begint ING hypotheken met AI te beoordelen. Geld, regels en echte toepassing schuiven hier tegelijk: waar een AI-model draait en onder welke wet wordt een Europese inkoopvraag. Deze week werd dat risico even heel concreet toen het beste model van het moment voor niet-Amerikaanse gebruikers werd opgeschort. Aan de andere kant van de oceaan beweegt het spiegelbeeld: Trump tekende een Executive Order met verplichte tests vóór frontier-releases, en de VS blokkeerde buitenlandse toegang tot Anthropics krachtigste modellen op grond van nationale veiligheid (Axios). Export als drukmiddel aan de ene kant, soevereiniteit als antwoord aan de andere.
werk je met gevoelige klantdata, dan wordt het steeds belangrijker te weten waar je AI-leverancier draait en onder welke wet; Europese of zelf-gehoste opties worden een serieus verkoop- en compliance-argument.
- verder lezen: AIC4NL: wat het soevereiniteitspakket concreet inhoudt (~7 min)
voor wie het nakijkt
eu, sovereignty, nl, policy · heat: Exa-cluster · NRC + Rijksoverheid + AIC4NL + FD
- bewijs: EU Tech Sovereignty Package (Commissie, 2026-06-03, von der Leyen, open-source-paragraaf); Wet vifo-uitbreiding per 2027-01-01 (Rijksoverheid, 6 technologieën incl. AI); NRC "Kabinet wil ook AI beschermen tegen buitenlandse overnames"; NRC "ING gaat hypotheken met AI beoordelen"; US-zijde: Trump-EO verplichte frontier-tests (Zvi) + Axios-gemelde exportblokkade op Anthropics topmodellen (nationale veiligheid, 2026-06-12)
- bronnen: Europa pakt regie over eigen AI-infrastructuur (AIC4NL) · exa · Kabinet wil AI beschermen tegen buitenlandse overnames (NRC) · exa · Zes technologieën toegevoegd aan Wet vifo (Rijksoverheid) · primary · ING gaat hypotheken met AI beoordelen (NRC) · exa · VS blokkeert buitenlandse toegang tot Anthropics topmodellen (Axios) · web · Trump tekent Executive Order voor verplichte AI-tests (Zvi) · web
Deze week doen
Schrijf voor elke AI die namens jou naar buiten praat (chatbot, AI-samenvatting, geautomatiseerde mail) één regel op: wie controleert wat het zegt voordat een klant het ziet. De Duitse uitspraak maakt dit deze week urgent: aansprakelijkheid voor AI-output verschuift naar de aanbieder, en "de AI zei het" is geen verweer meer.
- 5 minuten: loop je site en klantflows langs en noteer elke plek waar AI ongecontroleerd tekst naar buiten stuurt.
- 1 uur: zet bij de belangrijkste plek een menselijke of regel-gebaseerde controle vóór publicatie, en leg vast wie eindverantwoordelijk is.
Gereedschapskist
- Claude Fable 5 (Anthropic) · nieuw beste algemeen beschikbare model deze week, sterk op programmeer- en agent-werk; meteen in Cursor en Devin beschikbaar om te proberen.
- MiniMax M3 (open-weight) · open model op bijna-top-niveau met een miljoen-token-geheugen; interessant als je groot werk wilt draaien zonder per token aan een Amerikaanse dienst vast te zitten.
- Claw Patrol (Deno) · een "firewall" voor agents die hun rechten begrenst; precies het soort rem dat de incidenten van deze week pijnlijk misten.
Wat ik volg
- als de Duitse uitspraak standhoudt of wordt overgenomen door een rechter in een ander EU-land → dan wordt aansprakelijkheid voor AI-antwoorden Europees precedent en moet iedereen met een publieke chatbot zijn proces herzien.
- als een grote partij of toezichthouder agents standaard begrensde rechten oplegt (zoals een verplichte mens-in-de-lus) → dan verschuift "agent loslaten" van durf naar wanbeleid.
- als open modellen aantoonbaar de top-3 van de zware programmeertest halen → dan is de gesloten-flagship-premie voor veel werk weg.
- als US-exportcontrole vaker frontier-modellen offline trekt voor niet-VS (zoals de Fable 5-opschorting deze week) → dan wordt een zelf-draaibaar open-weights-model een continuïteitseis, geen prijskeuze.
Mijn voorspellingen
- "AI inside zakt als verkoopargument, human-led stijgt" · stand: bevestigd · bewijs: deze week opnieuw zichtbaar in de "AI vertraagt"-stemming en de agent-schade-verhalen die juist menselijke controle als de rem aanwijzen · sinds: 2026-W19
- "China haalt de bodem onder flagship-pricing weg" · stand: bevestigd · bewijs: MiniMax M3 (428B open, 59% SWE-Bench Pro) en DeepSeek-V4-Pro voeren de modelranglijst aan; open modellen blijven de top naderen · sinds: 2026-W18
- "Een open-weights model staat voor eind W36 in de top-3 van SWE-Bench Pro op flagship-niveau" · stand: open · bewijs: MiniMax M3 op 59% deze week, het bewijs stapelt richting de deadline · sinds: 2026-W23
- "EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoopfactor in een gevoelige-data-sector" · stand: open · bewijs: EU Tech Sovereignty Package + Wet vifo-uitbreiding naar AID + ING die AI op hypotheken inzet, allemaal deze week; plus de Fable 5-opschorting die niet-VS-gebruikers buitensloot en US-afhankelijkheid tastbaar maakte · sinds: 2026-W23
- nieuw · "Voor eind 2026-W40 verwijst minstens één tweede EU-rechterlijke uitspraak, toezichthouder of officiële richtlijn naar het Duitse AI-Overviews-oordeel als grond voor directe aanbieder-aansprakelijkheid voor AI-output" · stand: open · sinds: 2026-W25
Wat mij ongelijk zou geven
Mijn lopende these is dat menselijk oordeel en controle de blijvende waarde zijn naast steeds capabelere modellen; wat dat zou breken is een agent die langdurig en betrouwbaar zonder mens draait, en deze week wees het bewijs juist de andere kant op (de schade-verhalen draaiden allemaal om het ontbreken van die mens-rem).
Essay-kandidaten
- AI-agents die echte schade aanrichten (DN42, Fedora, botsitting) · sterke counter (de hype zegt "laat agents los", de realiteit zegt "zet er een rem op"), duidelijk traject over weken, en direct relevant voor elke MKB'er die met agents speelt.
Wat ik je bespaar
- De wekelijkse Polymarket-koffiedik over wanneer GPT-5.6 precies uitkomt (odds heen en weer tussen 76% en 89%): leuk voor gokkers, maar de exacte releasedatum verandert niets aan wat je vandaag bouwt.
- De stortvloed aan "53% van de agents faalt"-cijfers op X zonder bron of methode: het patroon (agents zijn onbetrouwbaar zonder rem) staat al vast, de losse percentages voegen ruis toe, geen inzicht.
Mijn voorspellingen
Wat ik denk dat er gaat gebeuren in AI, en hoe het uitpakt. Ook als ik ongelijk had.
Op korte termijn13
- open
Voor eind 2026-W34 wisselt minstens een van de drie grote Amerikaanse labs (OpenAI, Anthropic, Google) opnieuw een frontier-model van publieke beschikbaarheid naar overheids- of toegangsbeperking
- open
Voor eind 2026-W40 verwijst minstens een tweede EU-rechterlijke uitspraak, toezichthouder of officiele richtlijn naar het Duitse AI-Overviews-oordeel als grond voor directe aanbieder-aansprakelijkheid voor AI-output
het bewijs
W26: geen nieuwe juridische verwijzing; de EU stemde wel in met uitstel van enkele AI Act-verplichtingen, wat de richting eerder vertraagt dan versnelt
- open
Werkgeheugen blijft duur (32GB DDR5 boven ~250 euro) tot eind 2026 door AI-datacentervraag, wat lokaal AI draaien minder goedkoop maakt dan de gratis open-weights suggereren
- open
EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoop- of architectuurfactor in minstens een gevoelige-data-sector (juridisch/zorg/finance) in NL/EU, gedreven door AI Act-agentregels (augustus) plus Europese compute
het bewijs
W26: de overheids-gating van GPT-5.6 en Mythos 5 maakte US-afhankelijkheid opnieuw tastbaar; zelf-draaibaar of binnen de EU verschoof van ideologie naar continuiteitsargument
- open
Voor eind 2026-W36 staat een open-weights model (DeepSeek, Qwen of StepFun) in de top-3 van SWE-Bench Pro, op closed-flagship-niveau
het bewijs
bewijs stapelt W24: MiniMax M3 op 54.7 van de Artificial Analysis Intelligence-index (open, vlak onder flagship); W26: GLM-5.2 komt binnen als sterkste open model voor coding/agents, het bewijs blijft richting de W36-deadline stapelen
- open
Voor eind 2026 voert minstens een mainstream NL/EU-merk 'door mensen gemaakt' of 'AI-vrij' actief als verkoopargument (label, campagne of premium-tier)
- open
Voor eind 2026 wordt 'AI-investeringen leveren nog niet op' een dominant mainstream-narratief op cover-story-niveau, wat MKB voorzichtiger maakt
- open
Voor eind 2026 bevestigt Apple publiekelijk dat de Gemini-Siri-inferentie via Apple's Private Cloud Compute loopt (niet rauw naar Google), als GDPR-relevant verkoopargument
het bewijs
beweegt sterk W24: Apple toont op WWDC een drie-lagen-Siri (toestel / Apple privacy-cloud / Google-cloud voor complexe taken), gerapporteerd 1,2T-Gemini ~1mld/jr, geen EU-launch; expliciete GDPR-framing ontbreekt nog
- open
Voor eind 2026 draait een open MoE-model van Qwen of DeepSeek-V4-Flash-klasse (near-frontier reasoning) bruikbaar boven 20 tokens/sec lokaal op een Mac van maximaal 4000 euro
- open
Kosten-per-taak wordt binnen 2 kwartalen de dominante AI-inkooplens bij MKB
- open
Coding-tools-laag commoditiseert binnen ~12 maanden
- bevestigd
AI inside zakt als verkoopargument, human-led stijgt
het bewijs
HN-top "I'm Tired of Talking to AI" (W22 1724pt naar W23 2008pt) + DuckDuckGo +28% + AI-vrij als feature; herbevestigd W23; herbevestigd W24: "AI is slowing down" 613pt + zelfbewuste anti-AI-vraag 455pt; herbevestigd W26: Ford haalt ervaren mensen terug bij z'n agent-uitrol, bouwers willen de code-review aanscherpen, en de "AI verbrandt de toast, ik schraap 'm af"-stemming
- bevestigd
China haalt de bodem onder flagship-pricing weg
het bewijs
DeepSeek 75% korting permanent + Qwen Opus-niveau (W22); herbevestigd W23: DeepSeek-V4-Pro/Flash + Qwen3.6 voeren HF-trending aan (open-weights naderen flagship); herbevestigd W24: 25+ open modellen in 1 week, DeepSeek-V4-Pro #1 HF (4730), Google geeft Gemma 4 zelf open vrij; herbevestigd W26: Zhipu's open GLM-5.2 voert de open-model-ranglijst aan, juist nu de Amerikaanse topmodellen achter een overheidshek verdwijnen
~1 jaar6
- open
Voor 2027-W23 wordt minstens een top coding-tool (Cursor, Copilot, Windsurf of Claude Code) overgenomen of fundamenteel van 'tool' naar 'platform/agent' herpositioneerd
- open
Voor 2027-W23 brengt een grote partij (OpenAI, Anthropic, Google, Apple of Microsoft) een mainstream proactieve persoonlijke assistent die een fleet van agents aanstuurt
- open
Voor eind 2027 haalt de METR 50%-task-horizon taken die mensen minstens een volledige werkdag (8 uur) kosten, voor generalist-agents
- open
Voor 2028-W22 is er geen algemeen beschikbaar agent-product dat een NL-MKB-werknemerrol end-to-end vervangt met persistent leren over sessies, op productie-betrouwbaarheid (Karpathy continual-learning-test, human-moat-tracker)
- open
Voor eind 2027 ziet minstens een traditioneel NL-kwaliteitsmerk (Volkskrant, NRC of FD) een meetbare opleving in betalende abonnees of print-oplage, mede gedreven door deepfake-/fake-news-moeheid en 'geverifieerd door mensen' als waarde (flight to verified-human)
- open
Voor eind 2027 wordt parasociale AI-schade ('AI-psychose', ongezonde AI-afhankelijkheid) een erkende categorie in minstens een Westers land: een formele gezondheidsrichtlijn, klinische erkenning, of door een toezichthouder afgedwongen platform-maatregel
~3 jaar (horizon-watch)1
- open
Voor eind 2028 publiceert minstens een frontier-lab een geverifieerde, reproduceerbare autonome verbetering door een AI aan z'n eigen training of architectuur boven menselijke baseline (Clark 60%-scenario)