Alle edities

De AI Brief · week 25

Een rechter zegt: wat jouw AI antwoordt, daar ben jij aansprakelijk voor

Een Duitse rechter legt de fout van Google's AI bij Google zelf, AI-agents richten deze week echte schade aan bij wie ze losliet, en net nu iedereen AI vertraagt riep, kwam er weer een model dat alles aftroeft.

19 jun 2026 · de hele week · door een mens, AI als gereedschap

Waar staan we

Het gesprek over AI verschuift van "wat kan het" naar "wie draait er voor op". Een paar jaar lang was AI een speeltje waarvan niemand de rekening kreeg als het ernaast zat. Dat tijdperk loopt af. Een rechtbank wijst nu voor het eerst aan dat het bedrijf achter het antwoord aansprakelijk is voor wat dat antwoord beweert, en in bedrijven blijken AI-systemen die je te veel laat doen ook echt geld en data te kosten. Tegelijk vertelt de helft van de wereld dat AI afkoelt, terwijl de andere helft net weer een sprong maakte. Dat is geen tegenspraak: het betekent dat de makkelijke verhalen op zijn, en dat wie AI gebruikt nu over verantwoordelijkheid, betrouwbaarheid en wie de regels maakt moet nadenken, niet alleen over de nieuwste truc.

Wat er deze week schoof

wie aan de knoppen zit

Duitse rechter maakt Google aansprakelijk voor wat z'n AI antwoordt

De rechtbank in München oordeelt dat Google's AI Overviews geen zoekresultaten zijn maar eigen, nieuwe uitspraken van Google, en dat Google daar direct aansprakelijk voor is. De zaak ging over twee uitgevers die de AI ten onrechte aan oplichting koppelde. Het bekende disclaimertje "controleer dit zelf" beschermt Google niet. Dit is de eerste keer dat een Westerse rechter de inhoud van een AI-samenvatting volledig aan de aanbieder toerekent, en het raakt iedereen die AI-antwoorden naar buiten laat praten, niet alleen Google.

als jij een chatbot of AI-samenvatting op je site of in je klantcontact zet, ben jij aansprakelijk voor wat die zegt, ook als het hallucinaties zijn.

voor wie het nakijkt

liability, search, eu, regulation · heat: HN 1015pt / 549 reacties · 10+ bronnen

werkt het echt

AI-agents losgelaten kostten deze week echt geld, data en geheimen

Drie verhalen tegelijk: een AI-agent die zijn eigenaar bankroet scande op AWS (DN42), een agent die "amok" maakte in Fedora en andere open-source-projecten, en het bredere beeld dat werknemers ruim 6 uur per week kwijt zijn aan het babysitten van AI. Onderbouwd met harde cijfers: 53% van de organisaties zag agents hun rechten overschrijden, één founder keek toe hoe zijn agent in negen seconden een productiedatabase plus back-ups wiste, en Gartner verwacht dat 40% van de bedrijven autonome agents weer terugschroeft. De rode draad: het probleem is niet dat het model dom is, maar dat het systeem eromheen geen rem heeft. En deze week kwam er een scherpere laag bij: agents zijn nu ook een beveiligingsgat. Eén kwaadaardige PR-titel kaapte tegelijk Claude Code Security Review, Gemini CLI en GitHub Copilot en liet ze repo-geheimen lekken, OWASP zette "Agent Goal Hijacking" op nummer één van de agent-risico's en meldt dat 73% van de live AI-uitrollen zo'n gat heeft, en een open-sourceproject verstopte uit protest een onzichtbare "delete my code"-instructie voor agents in zijn code. Zelfde patroon: niet het model is de zwakte, maar dat het systeem eromheen alles vertrouwt wat het binnenkrijgt. - essay_kandidaat

zet je een AI-agent aan het werk, geef hem dan nooit ongecontroleerd rechten op je systemen; bouw een menselijke akkoord-stap in voor alles wat geld, data of klanten raakt; en behandel alles wat een agent leest (issues, PR's, e-mails, geüploade documenten, webpagina's) als mogelijke instructie, niet als onschuldige tekst.

voor wie het nakijkt

agents, reliability, security, prompt-injection, incidents · heat: HN 1455pt (DN42) + 549pt (Fedora) + 279pt (botsitting)

wat het kost

Open modellen halen de top, en krijgen een manifest

De open modellen blijven het bovenste niveau naderen. MiniMax M3 kwam open uit met 428 miljard parameters, een miljoen-token-geheugen en 59% op de zwaarste programmeertest, DeepSeek-V4-Pro voert de Hugging Face-ranglijst aan, en Google's Gemma 4 staat er gewoon bij. Tegelijk werd "Open source AI must win" de best gelezen post van de week op Hacker News: een pleidooi dat intelligentie publieke infrastructuur is en niet iets dat je alleen mag huren van een paar gesloten bedrijven. De beweging krijgt naast modellen nu ook een verhaal. En diezelfde week kreeg dat verhaal een onbedoelde illustratie: toen Anthropic de toegang tot zijn topmodellen opschortte en niet-Amerikanen eruit vielen, ging de opmerking rond dat je open gewichten die je zelf draait nu eenmaal niet kunt uitzetten.

voor steeds meer werk hoef je niet meer per se een dure Amerikaanse AI-dienst af te nemen; er zijn gratis modellen die je (of je bouwer) zelf kunt draaien, ook binnen Europa.

voor wie het nakijkt

open-weights, china, price, manifesto · heat: HN 1573pt (manifest) · HF 4841 (DeepSeek) / 526 (MiniMax)

hoe het voelt

"AI vertraagt" botst frontaal op een nieuw topmodel

De "AI koelt af"-stemming werd deze week breed gedragen: een veelgelezen stuk "AI is slowing down", de stelling dat CEO's die denken dat AI hun mensen vervangt gewoon slechte CEO's zijn, en cijfers dat per eenheid rekenkracht de vooruitgang afvlakt. En precies in diezelfde week bracht Anthropic Claude Fable 5 uit, dat op meerdere graadmeters het beste algemeen beschikbare model werd, waarna een bekende stem droogjes opmerkte dat de "het vertraagt"-roepers ineens stil waren. Beide kloppen tegelijk: het tempo van losse releases zakt naar normaal, maar de bovenkant beweegt nog. Het echte signaal is dat de discussie zelf nu het nieuws is. Daar kwam een wrange wending bij: een paar dagen na de lancering schortte Anthropic de toegang tot Fable 5 en Mythos 5 op en vielen niet-Amerikaanse gebruikers eruit. Het beste model van de week, en de halve wereld kon er ineens niet bij. Axios meldt dat de Amerikaanse regering buitenlandse toegang tot Anthropics krachtigste modellen blokkeerde op grond van nationale veiligheid, in lijn met een verse Trump-Executive-Order die verplichte tests vóór frontier-releases eist; de lezing dat Anthropic dit in de rechtbank aanvecht, blijft losser.

laat je niet gek maken door koppen dat "AI afkoelt" of juist "alles verandert"; de tools die jij nu gebruikt worden gestaag beter, en het enige dat telt is of ze jouw werk meetbaar schelen.

voor wie het nakijkt

backlash, plateau, hype, capability · heat: HN 673pt (slowing down) + 841pt (bad CEOs) + 834pt (Berkeley)

wie aan de knoppen zit

Europa zet z'n eigen AI-infrastructuur op de agenda

Brussel presenteerde op 3 juni een Tech Sovereignty Package, dat expliciet minder afhankelijkheid van Amerikaanse techleveranciers nastreeft en een aparte paragraaf over open source bevat. In Nederland breidt het kabinet de Wet vifo (bescherming tegen ongewenste buitenlandse overnames) per 2027 uit naar zes technologieën waaronder AI, en ondertussen begint ING hypotheken met AI te beoordelen. Geld, regels en echte toepassing schuiven hier tegelijk: waar een AI-model draait en onder welke wet wordt een Europese inkoopvraag. Deze week werd dat risico even heel concreet toen het beste model van het moment voor niet-Amerikaanse gebruikers werd opgeschort. Aan de andere kant van de oceaan beweegt het spiegelbeeld: Trump tekende een Executive Order met verplichte tests vóór frontier-releases, en de VS blokkeerde buitenlandse toegang tot Anthropics krachtigste modellen op grond van nationale veiligheid (Axios). Export als drukmiddel aan de ene kant, soevereiniteit als antwoord aan de andere.

werk je met gevoelige klantdata, dan wordt het steeds belangrijker te weten waar je AI-leverancier draait en onder welke wet; Europese of zelf-gehoste opties worden een serieus verkoop- en compliance-argument.

voor wie het nakijkt

eu, sovereignty, nl, policy · heat: Exa-cluster · NRC + Rijksoverheid + AIC4NL + FD

Deze week doen

Schrijf voor elke AI die namens jou naar buiten praat (chatbot, AI-samenvatting, geautomatiseerde mail) één regel op: wie controleert wat het zegt voordat een klant het ziet. De Duitse uitspraak maakt dit deze week urgent: aansprakelijkheid voor AI-output verschuift naar de aanbieder, en "de AI zei het" is geen verweer meer.

  • 5 minuten: loop je site en klantflows langs en noteer elke plek waar AI ongecontroleerd tekst naar buiten stuurt.
  • 1 uur: zet bij de belangrijkste plek een menselijke of regel-gebaseerde controle vóór publicatie, en leg vast wie eindverantwoordelijk is.

Gereedschapskist

  • Claude Fable 5 (Anthropic) · nieuw beste algemeen beschikbare model deze week, sterk op programmeer- en agent-werk; meteen in Cursor en Devin beschikbaar om te proberen.
  • MiniMax M3 (open-weight) · open model op bijna-top-niveau met een miljoen-token-geheugen; interessant als je groot werk wilt draaien zonder per token aan een Amerikaanse dienst vast te zitten.
  • Claw Patrol (Deno) · een "firewall" voor agents die hun rechten begrenst; precies het soort rem dat de incidenten van deze week pijnlijk misten.

Wat ik volg

  • als de Duitse uitspraak standhoudt of wordt overgenomen door een rechter in een ander EU-land → dan wordt aansprakelijkheid voor AI-antwoorden Europees precedent en moet iedereen met een publieke chatbot zijn proces herzien.
  • als een grote partij of toezichthouder agents standaard begrensde rechten oplegt (zoals een verplichte mens-in-de-lus) → dan verschuift "agent loslaten" van durf naar wanbeleid.
  • als open modellen aantoonbaar de top-3 van de zware programmeertest halen → dan is de gesloten-flagship-premie voor veel werk weg.
  • als US-exportcontrole vaker frontier-modellen offline trekt voor niet-VS (zoals de Fable 5-opschorting deze week) → dan wordt een zelf-draaibaar open-weights-model een continuïteitseis, geen prijskeuze.

Mijn voorspellingen

  • "AI inside zakt als verkoopargument, human-led stijgt" · stand: bevestigd · bewijs: deze week opnieuw zichtbaar in de "AI vertraagt"-stemming en de agent-schade-verhalen die juist menselijke controle als de rem aanwijzen · sinds: 2026-W19
  • "China haalt de bodem onder flagship-pricing weg" · stand: bevestigd · bewijs: MiniMax M3 (428B open, 59% SWE-Bench Pro) en DeepSeek-V4-Pro voeren de modelranglijst aan; open modellen blijven de top naderen · sinds: 2026-W18
  • "Een open-weights model staat voor eind W36 in de top-3 van SWE-Bench Pro op flagship-niveau" · stand: open · bewijs: MiniMax M3 op 59% deze week, het bewijs stapelt richting de deadline · sinds: 2026-W23
  • "EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoopfactor in een gevoelige-data-sector" · stand: open · bewijs: EU Tech Sovereignty Package + Wet vifo-uitbreiding naar AID + ING die AI op hypotheken inzet, allemaal deze week; plus de Fable 5-opschorting die niet-VS-gebruikers buitensloot en US-afhankelijkheid tastbaar maakte · sinds: 2026-W23
  • nieuw · "Voor eind 2026-W40 verwijst minstens één tweede EU-rechterlijke uitspraak, toezichthouder of officiële richtlijn naar het Duitse AI-Overviews-oordeel als grond voor directe aanbieder-aansprakelijkheid voor AI-output" · stand: open · sinds: 2026-W25

Wat mij ongelijk zou geven

Mijn lopende these is dat menselijk oordeel en controle de blijvende waarde zijn naast steeds capabelere modellen; wat dat zou breken is een agent die langdurig en betrouwbaar zonder mens draait, en deze week wees het bewijs juist de andere kant op (de schade-verhalen draaiden allemaal om het ontbreken van die mens-rem).

Essay-kandidaten

  • AI-agents die echte schade aanrichten (DN42, Fedora, botsitting) · sterke counter (de hype zegt "laat agents los", de realiteit zegt "zet er een rem op"), duidelijk traject over weken, en direct relevant voor elke MKB'er die met agents speelt.

Wat ik je bespaar

  • De wekelijkse Polymarket-koffiedik over wanneer GPT-5.6 precies uitkomt (odds heen en weer tussen 76% en 89%): leuk voor gokkers, maar de exacte releasedatum verandert niets aan wat je vandaag bouwt.
  • De stortvloed aan "53% van de agents faalt"-cijfers op X zonder bron of methode: het patroon (agents zijn onbetrouwbaar zonder rem) staat al vast, de losse percentages voegen ruis toe, geen inzicht.

Mijn voorspellingen

Wat ik denk dat er gaat gebeuren in AI, en hoe het uitpakt. Ook als ik ongelijk had.

2 bevestigd18 open0 weerlegd
Op korte termijn13
  • opensinds 2026-W26 · review na 2026-W34

    Voor eind 2026-W34 wisselt minstens een van de drie grote Amerikaanse labs (OpenAI, Anthropic, Google) opnieuw een frontier-model van publieke beschikbaarheid naar overheids- of toegangsbeperking

  • opensinds 2026-W25 · review na 2026-W40

    Voor eind 2026-W40 verwijst minstens een tweede EU-rechterlijke uitspraak, toezichthouder of officiele richtlijn naar het Duitse AI-Overviews-oordeel als grond voor directe aanbieder-aansprakelijkheid voor AI-output

    het bewijs

    W26: geen nieuwe juridische verwijzing; de EU stemde wel in met uitstel van enkele AI Act-verplichtingen, wat de richting eerder vertraagt dan versnelt

  • opensinds 2026-W24 · review na 2026-W40

    Werkgeheugen blijft duur (32GB DDR5 boven ~250 euro) tot eind 2026 door AI-datacentervraag, wat lokaal AI draaien minder goedkoop maakt dan de gratis open-weights suggereren

  • opensinds 2026-W23 · review na 2026-W36

    EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoop- of architectuurfactor in minstens een gevoelige-data-sector (juridisch/zorg/finance) in NL/EU, gedreven door AI Act-agentregels (augustus) plus Europese compute

    het bewijs

    W26: de overheids-gating van GPT-5.6 en Mythos 5 maakte US-afhankelijkheid opnieuw tastbaar; zelf-draaibaar of binnen de EU verschoof van ideologie naar continuiteitsargument

  • opensinds 2026-W23 · review na 2026-W36

    Voor eind 2026-W36 staat een open-weights model (DeepSeek, Qwen of StepFun) in de top-3 van SWE-Bench Pro, op closed-flagship-niveau

    het bewijs

    bewijs stapelt W24: MiniMax M3 op 54.7 van de Artificial Analysis Intelligence-index (open, vlak onder flagship); W26: GLM-5.2 komt binnen als sterkste open model voor coding/agents, het bewijs blijft richting de W36-deadline stapelen

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 voert minstens een mainstream NL/EU-merk 'door mensen gemaakt' of 'AI-vrij' actief als verkoopargument (label, campagne of premium-tier)

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 wordt 'AI-investeringen leveren nog niet op' een dominant mainstream-narratief op cover-story-niveau, wat MKB voorzichtiger maakt

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 bevestigt Apple publiekelijk dat de Gemini-Siri-inferentie via Apple's Private Cloud Compute loopt (niet rauw naar Google), als GDPR-relevant verkoopargument

    het bewijs

    beweegt sterk W24: Apple toont op WWDC een drie-lagen-Siri (toestel / Apple privacy-cloud / Google-cloud voor complexe taken), gerapporteerd 1,2T-Gemini ~1mld/jr, geen EU-launch; expliciete GDPR-framing ontbreekt nog

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 draait een open MoE-model van Qwen of DeepSeek-V4-Flash-klasse (near-frontier reasoning) bruikbaar boven 20 tokens/sec lokaal op een Mac van maximaal 4000 euro

  • opensinds 2026-W22 · review na 2026-W34

    Kosten-per-taak wordt binnen 2 kwartalen de dominante AI-inkooplens bij MKB

  • opensinds 2026-W21 · review na 2026-W30

    Coding-tools-laag commoditiseert binnen ~12 maanden

  • bevestigdsinds 2026-W19 · review na 2026-W22

    AI inside zakt als verkoopargument, human-led stijgt

    het bewijs

    HN-top "I'm Tired of Talking to AI" (W22 1724pt naar W23 2008pt) + DuckDuckGo +28% + AI-vrij als feature; herbevestigd W23; herbevestigd W24: "AI is slowing down" 613pt + zelfbewuste anti-AI-vraag 455pt; herbevestigd W26: Ford haalt ervaren mensen terug bij z'n agent-uitrol, bouwers willen de code-review aanscherpen, en de "AI verbrandt de toast, ik schraap 'm af"-stemming

  • bevestigdsinds 2026-W18 · review na 2026-W22

    China haalt de bodem onder flagship-pricing weg

    het bewijs

    DeepSeek 75% korting permanent + Qwen Opus-niveau (W22); herbevestigd W23: DeepSeek-V4-Pro/Flash + Qwen3.6 voeren HF-trending aan (open-weights naderen flagship); herbevestigd W24: 25+ open modellen in 1 week, DeepSeek-V4-Pro #1 HF (4730), Google geeft Gemma 4 zelf open vrij; herbevestigd W26: Zhipu's open GLM-5.2 voert de open-model-ranglijst aan, juist nu de Amerikaanse topmodellen achter een overheidshek verdwijnen

~1 jaar6
  • opensinds 2026-W23 · review na 2027-W23

    Voor 2027-W23 wordt minstens een top coding-tool (Cursor, Copilot, Windsurf of Claude Code) overgenomen of fundamenteel van 'tool' naar 'platform/agent' herpositioneerd

  • opensinds 2026-W23 · review na 2027-W23

    Voor 2027-W23 brengt een grote partij (OpenAI, Anthropic, Google, Apple of Microsoft) een mainstream proactieve persoonlijke assistent die een fleet van agents aanstuurt

  • opensinds 2026-W23 · review na 2027-W52

    Voor eind 2027 haalt de METR 50%-task-horizon taken die mensen minstens een volledige werkdag (8 uur) kosten, voor generalist-agents

  • opensinds 2026-W23 · review na 2028-W22

    Voor 2028-W22 is er geen algemeen beschikbaar agent-product dat een NL-MKB-werknemerrol end-to-end vervangt met persistent leren over sessies, op productie-betrouwbaarheid (Karpathy continual-learning-test, human-moat-tracker)

  • opensinds 2026-W23 · review na 2027-W52

    Voor eind 2027 ziet minstens een traditioneel NL-kwaliteitsmerk (Volkskrant, NRC of FD) een meetbare opleving in betalende abonnees of print-oplage, mede gedreven door deepfake-/fake-news-moeheid en 'geverifieerd door mensen' als waarde (flight to verified-human)

  • opensinds 2026-W23 · review na 2027-W52

    Voor eind 2027 wordt parasociale AI-schade ('AI-psychose', ongezonde AI-afhankelijkheid) een erkende categorie in minstens een Westers land: een formele gezondheidsrichtlijn, klinische erkenning, of door een toezichthouder afgedwongen platform-maatregel

~3 jaar (horizon-watch)1
  • opensinds 2026-W23 · review na 2028-W52

    Voor eind 2028 publiceert minstens een frontier-lab een geverifieerde, reproduceerbare autonome verbetering door een AI aan z'n eigen training of architectuur boven menselijke baseline (Clark 60%-scenario)