De AI Brief · week 26
De krachtigste AI mag niet meer zomaar uit: de overheid bepaalt nu wie erbij kan
Verder deze week: het beste open model dat je zelf op een doos op je bureau draait kwam uit China, agents struikelen massaal bij de stap van demo naar productie (Ford haalt zelfs ervaren mensen terug), en er ging 120 miljard dollar naar AI in een half jaar terwijl centrale bankiers voor een crash waarschuwen.
Waar staan we
Een jaar lang ging het gesprek over AI vooral over wat het kon. Nu gaat het over wie erbij mag en wie ervoor opdraait. De Amerikaanse overheid zit deze week aan de kraan van de krachtigste modellen: een groot nieuw model werd uitgesteld na een overheidsreview, een ander kwam alleen terug voor een handvol vertrouwde organisaties. Tegelijk gebeurt het omgekeerde aan de onderkant: de beste modellen die je gratis zelf draait, ook in Europa, kwamen weer een stap dichter bij de top, en die kun je niet uitzetten. Daartussenin botst de praktijk op de werkelijkheid: bedrijven die AI-systemen te veel lieten doen, halen mensen terug en bouwen remmen in. En boven dat alles hangt een ongemakkelijke vraag, want er ging recordgeld naar AI terwijl steeds meer mensen zich hardop afvragen of het wel iets oplevert. Het makkelijke verhaal "AI wordt elke maand beter en goedkoper voor iedereen" klopt niet meer; waar je AI vandaan haalt en wie er grip op heeft, wordt het echte onderwerp.
Wat er deze week schoof
wie aan de knoppen zit
De Amerikaanse overheid zet de krachtigste AI achter een hek
De toegang tot de zwaarste AI-modellen loopt deze week via de overheid, niet meer via de markt. OpenAI stelde de publieke uitrol van GPT-5.6 uit nadat de Amerikaanse overheid om vroege toegang en een review vroeg. Anthropics topmodel Mythos 5, in juni stilgelegd, kwam terug, maar alleen voor een kleine groep "vertrouwde" Amerikaanse organisaties. En Google zette een rem op hoeveel concurrent Meta van Google's Gemini mag gebruiken. Dit is de week waarin "wie mag bij het beste model" een politieke beslissing werd: nationale veiligheid en bedrijfsbelang bepalen de toegang, niet je creditcard. Het raakt iedereen buiten die kring, en zeker iedereen buiten de VS.
als jouw tool of bouwer leunt op één Amerikaans topmodel, kan dat model van de ene op de andere dag worden afgeknepen om redenen die niets met jou te maken hebben; zorg dat je kunt wisselen.
- verder lezen: TechCrunch: hoe de export-ban de markt voor topmodellen verandert (~6 min)
voor wie het nakijkt
export-controls, government, frontier, geopolitics · heat: Reddit r/artificial (frontier locked behind approval) · Semafor + TechCrunch + Reuters + CNBC
- bewijs: OpenAI stelt GPT-5.6-rollout uit na verzoek om vroege toegang door de Amerikaanse overheid (Reuters via Threads, 2026-06; Reddit r/artificial 1uim7jw); VS geeft Anthropics Mythos 5 terug aan "trusted" US-organisaties (Semafor, 2026-06-27; ~100 kritieke US-orgs hersteld per 27 juni, Threads); Aziatische startups lanceren Mythos-achtige modellen "nu de export-ban aansleept" (TechCrunch); Google beperkt Meta's gebruik van Gemini (CNBC + Reddit r/singularity 1uhx4vo); Trump zegt overheidscontract met Anthropic op (TikTok-bericht, losser)
- bronnen: VS geeft Anthropics Mythos terug aan "vertrouwde" US-organisaties (Semafor) · primary · Aziatische startups lanceren Mythos-achtige modellen nu de export-ban aansleept (TechCrunch) · web · OpenAI stelt GPT-5.6 uit, VS wil eerst toegang tot frontier-modellen (Reuters via Threads) · primary · Open AI stelde GPT-5.6 uit na een US-overheidsreview (Reddit r/artificial) · hn · Google beperkt Meta's gebruik van z'n Gemini-modellen (CNBC) · web · De AI-frontier zit nu achter overheidsgoedkeuring, en de meesten staan niet op de lijst (Reddit r/artificial) · hn
wat het kost
Het beste model dat je zelf draait kwam uit China, precies nu het hek dichtgaat
Terwijl de Amerikaanse topmodellen achter een overheidshek verdwenen, kwam het sterkste open model van het moment uit China: Zhipu's GLM-5.2, gemaakt voor programmeren en langlopend agent-werk, voert nu de ranglijst van open modellen aan. Het belangrijke: een open model kun je zelf draaien, op je eigen machine of binnen Europa, en niemand kan het uitzetten. In dezelfde week kondigde codetool Cursor aan een eigen model van 1,5 biljoen parameters from scratch te trainen, en doken Amerikaanse open modellen op die expliciet het punt maken: "ze kunnen een app verbieden, geen bestand dat al op je laptop staat." De timing is het verhaal: het hek aan de bovenkant duwt iedereen naar de open onderkant, en die onderkant is goed genoeg geworden.
voor steeds meer werk hoef je niet vast te zitten aan een Amerikaanse AI-dienst; er zijn gratis modellen die jij of je bouwer zelf kunt draaien, ook binnen de EU, en die je dus nooit kwijtraakt door een ban of prijssprong.
- verder lezen: Can Open Source Models Compete with the Frontier? (YouTube) (~15 min)
voor wie het nakijkt
open-weights, china, local, sovereignty · heat: Digg + DeepLearning.ai (GLM-5.2 top open model) · Reddit r/LocalLLaMA
- bewijs: GLM-5.2 (Zhipu) nu het beste open model, gebouwd voor coding + langlopende agentic jobs (DeepLearning.ai The Batch); China's Zhipu brengt open GLM-5.2 uit terwijl US-exportcontrole Anthropic en OpenAI blokkeert (Digg s72dpj2n); Cursor traint eerste eigen frontier-model from scratch, 1,5 biljoen parameters op Colossus (TechTimes); "open modellen haalden net in, en draaien op een doos op je bureau" (TikTok)
- bronnen: GLM-5.2 is het nieuwe beste open model, gemaakt voor coding en agent-werk (DeepLearning.ai) · primary · China's Zhipu brengt open GLM-5.2 uit terwijl US-export Anthropic en OpenAI blokkeert (Digg) · primary · Cursor traint eerste eigen frontier-model from scratch: 1,5 biljoen parameters (TechTimes) · web · Frontier wordt afgeknepen, maar de open modellen haalden net in en draaien lokaal (TikTok) · x
werkt het echt
Agents struikelen bij de stap van demo naar productie, en bedrijven halen mensen terug
De demo's waren indrukwekkend, de productie valt tegen. Ford haalt ervaren kwaliteitsinspecteurs ("gray beards") terug nadat AI op de fabrieksvloer tekortschoot, een zeldzaam concreet voorbeeld van een groot bedrijf dat terugdraait. Tegelijk schat Microsoft dat er zo'n 20 miljoen AI-agents tegelijk draaien, met de eerlijke kanttekening dat niemand nog weet hoe je die beheert. En de bouwers zelf slaan alarm: ervaren ontwikkelaars op LinkedIn schrijven dat agents code zó snel produceren dat de controle erop juist beter moet, en dat ze principes die ze jaren aanhingen opnieuw tegen het licht houden. Het patroon van de afgelopen weken houdt aan: het probleem is niet dat het model dom is, maar dat het systeem eromheen geen rem heeft en de mens te vroeg wegliep. - essay_kandidaat
zet je een AI-agent aan het werk, ga er dan vanuit dat de demo mooier is dan de productie; bouw een menselijke controle in vóór alles wat geld, klanten of data raakt, en reken niet op "zet 'm aan en laat 'm gaan".
- verder lezen: Reflections on software engineering in the age of AI (~10 min) · Why Enterprise AI Adoption Is Slower Than You Think · Aaron Levie + Harrison Chase (YouTube) (~30 min)
voor wie het nakijkt
agents, reliability, production, human-in-the-loop · heat: Bloomberg + TechCrunch + Independent (Ford) · IG (20M agents Microsoft) · LinkedIn
- bewijs: Ford haalt "gray beard"-inspecteurs terug nadat AI tekortschoot (Bloomberg + TechCrunch + The Independent + Reddit r/technology 1ui7kif); ~20 miljoen AI-agents draaien bij Microsoft, beheer ervan "nog niet opgelost" (Instagram-reel); LinkedIn-praktijk: "agents schrijven sneller, dus review moet beter" (umaabu) + "ik bevraag de engineering-principes die ik jaren aanhield" (yasir-khalid); "wat breekt er als agents van demo naar productie gaan" als terugkerende vraag (Reddit r/AI_Agents 1uilbl1); AgentWatch: runtime-budget om op hol geslagen agents te stoppen (HN, Show HN)
- bronnen: Ford haalt 'gray beard'-engineers terug nadat AI tekortschoot (TechCrunch) · web · Ford huurde AI in en ontsloeg mensen, het pakte slecht uit (The Independent) · web · Misschien draaien er 20 miljoen AI-agents bij Microsoft, maar ze beheren is nog onopgelost (Instagram) · x · AI-coding-agents schrijven sneller, dus de review moet beter (LinkedIn) · x · Wat breekt er als AI-agents van demo's naar productie gaan (Reddit r/AI_Agents) · hn · AgentWatch: voorkom op hol geslagen agents met runtime-budget (HN) · hn
hoe het voelt
Recordbedrag naar AI, terwijl steeds meer mensen zich afvragen of het iets oplevert
Twee dingen tegelijk, en allebei luid. Aan de geldkant ging er in de eerste helft van 2026 zo'n 120 miljard dollar naar AI-startups, een record, met opvallend veel geld naar bedrijven die AI bouwen om andere AI te testen en betrouwbaarder te maken (Patronus haalde 50 miljoen op, Mirendil 200 miljoen). Aan de stemmingskant koelt het af: "The AI burns the toast, I scrape it" werd een veelgedeelde verzuchting onder ervaren ontwikkelaars, "de AI-backlash is net begonnen" trendde, en centrale bankiers waarschuwden hardop dat de AI-boom een financiële crash riskeert. Het ongemak is dat het geld en de twijfel naar dezelfde plek wijzen: niemand weet zeker of dit een nieuwe normaal is of een zeepbel, en het kapitaal vloeit nu juist naar het opruimen van AI's eigen rommel.
laat je niet gek maken door recordbedragen of doemverhalen; het enige dat telt is of de AI-tool die jij gebruikt jouw werk meetbaar scheelt, en of je de fouten die hij maakt zelf nog kunt zien en corrigeren.
- verder lezen: How Big Tech Hides the True Cost of the AI Buildout (YouTube) (~20 min)
voor wie het nakijkt
bubble, funding, backlash, roi · heat: Networkcraft ($120B H1) · Reddit r/technology (backlash, financial crash) · grounding-cluster funding
- bewijs: AI-startupfunding bereikt 120 miljard dollar in H1 2026, "bubble of nieuw normaal" (Networkcraft); funding sterk geconcentreerd in een handvol regio's (LinkedIn minhtran); Patronus AI haalt 50 miljoen op voor "digitale werelden" die AI-agents stresstesten (TechCrunch); Mirendil 200 miljoen voor "AI die AI verbetert" (TNW); Scaled Cognition 100 miljoen voor betrouwbare AI (TNW); "The AI burns the toast, I scrape it" (Reddit r/ExperiencedDevs 1uh8uts); "de AI-backlash is net begonnen" (Reddit r/technology 1ug4lut); centrale bankiers waarschuwen dat de AI-boom een wereldwijde crash riskeert (Telegraph + Reddit r/technology 1uieadj)
- bronnen: AI-startupfunding raakt 120 miljard in H1 2026, zeepbel of nieuw normaal (Networkcraft) · web · Patronus AI haalt 50 miljoen op om AI-agents te stresstesten (TechCrunch) · web · Mirendil haalt 200 miljoen op om AI te bouwen die AI verbetert (TNW) · web · De AI verbrandt de toast, ik schraap 'm af (Reddit r/ExperiencedDevs) · hn · AI-boom riskeert wereldwijde financiële crash, waarschuwen centrale bankiers (Telegraph) · web · De AI-backlash is nog maar net begonnen (Reddit r/technology) · hn
Deze week doen
Maak één lijst: welke AI-modellen of -diensten zit ik (of mijn bouwer) écht aan vast, en wat is mijn uitwijk als er één wegvalt. Waarom nu: deze week werd een topmodel uitgesteld door de overheid en een ander afgeknepen tot een handvol organisaties; "het beste model is een API-sleutel weg" is geen veilige aanname meer.
- 5 minuten: schrijf op welk AI-model onder je belangrijkste tool of automatisering zit, en of je weet hoe je naar een ander zou wisselen.
- 1 uur: test je belangrijkste AI-taak één keer op een alternatief model (een open model dat binnen de EU draait telt dubbel), zodat "wisselen" geen theorie blijft.
Gereedschapskist
- GLM-5.2 (Zhipu, open) · het sterkste open model van de week, gemaakt voor programmeren en langlopend agent-werk; interessant als je serieus werk wilt draaien zonder vast te zitten aan een Amerikaanse dienst die kan worden afgeknepen.
- AgentWatch · zet een hard budget en een noodrem op je agents zodat een op hol geslagen agent niet eindeloos doordraait of kosten maakt; precies de rem die de productie-verhalen van deze week misten.
- Seedance 2.5 / 4K (ByteDance) + Kling native 4K · de AI-videorace ging deze week naar 4K en clips tot 30 seconden; als je korte video voor social maakt, is de kwaliteitslat opnieuw verschoven en het proberen waard.
Wat ik volg
- als de overheids-gating van topmodellen langer dan een paar weken aanhoudt of structureel wordt → dan is leunen op één Amerikaans frontier-model een continuïteitsrisico, geen prijskeuze, en wordt "kan wisselen" een harde eis.
- als een open model (zoals GLM-5.2) aantoonbaar de top haalt op het zware programmeer- of agent-werk → dan is de meerprijs van een gesloten topmodel voor veel werk weg.
- als nog een groot bedrijf na Ford publiekelijk een AI-uitrol terugdraait en mensen terughaalt → dan kantelt het verhaal van "agents loslaten" definitief naar "mens-in-de-lus is de norm".
- als het "AI-zeepbel"-frame de cover van een mainstream zakenmedium haalt → dan wordt MKB aantoonbaar voorzichtiger en telt "laat de return zien" zwaarder dan "kijk wat AI kan".
Mijn voorspellingen
- "AI inside zakt als verkoopargument, human-led stijgt" · stand: bevestigd · bewijs: deze week opnieuw zichtbaar in Ford dat ervaren mensen terughaalt, bouwers die schrijven dat de review beter moet, en de "AI verbrandt de toast, ik schraap 'm af"-stemming · sinds: 2026-W19
- "China haalt de bodem onder flagship-pricing weg" · stand: bevestigd · bewijs: Zhipu's open GLM-5.2 voert de ranglijst van open modellen aan, juist nu de Amerikaanse topmodellen achter een overheidshek verdwijnen · sinds: 2026-W18
- "Een open-weights model staat voor eind W36 in de top-3 van de zware programmeertest op flagship-niveau" · stand: open · bewijs: GLM-5.2 komt deze week binnen als beste open model voor coding/agents; het bewijs blijft richting de deadline stapelen · sinds: 2026-W23
- "EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoopfactor in een gevoelige-data-sector" · stand: open · bewijs: de overheids-gating van GPT-5.6 en Mythos 5 maakte US-afhankelijkheid deze week opnieuw tastbaar; "zelf draaibaar / binnen de EU" verschoof van ideologie naar continuïteitsargument · sinds: 2026-W23
- "Voor eind W40 verwijst minstens een tweede EU-bron naar het Duitse AI-aansprakelijkheidsoordeel" · stand: open · bewijs: geen nieuwe juridische verwijzing deze week; de EU stemde wel in met uitstel van enkele AI Act-verplichtingen, wat de richting eerder vertraagt dan versnelt · sinds: 2026-W25
- nieuw · "Voor eind 2026-W34 wisselt minstens één van de drie grote Amerikaanse labs (OpenAI, Anthropic, Google) opnieuw een frontier-model van publieke beschikbaarheid naar overheids- of toegangsbeperking" · stand: open · sinds: 2026-W26
Wat mij ongelijk zou geven
Mijn lopende these is dat de waarde verschuift naar het zelf kunnen kiezen en wisselen van modellen plus menselijk oordeel erbovenop; wat dat zou breken is een wereld waarin het beste werk alléén nog kan met één gesloten topmodel waar je niet omheen kunt. Deze week wees het bewijs juist mijn kant op: het open alternatief haalde in, en het gesloten topmodel werd onbetrouwbaar in beschikbaarheid.
Essay-kandidaten
- Agents van demo naar productie (Ford haalt mensen terug, 20M agents bij Microsoft onbeheerbaar, bouwers die de review willen aanscherpen) · sterke counter (de hype zegt "laat agents los", de praktijk haalt de ervaren mens terug), duidelijk traject over weken, en direct relevant voor elke MKB'er die met agents experimenteert.
Wat ik je bespaar
- De stortvloed aan "America's open-source model is here"-promo (Ornith-1.0 en consorten) op TikTok en Threads: het echte signaal (open modellen halen in en draaien lokaal) staat al vast met GLM-5.2; de losse hype-clips voegen ruis toe, geen inzicht.
- De crypto-AI-agent-hoek (agents met een eigen wallet, "onchain economic actors", betaalrails voor agents): veel volume op X deze week, maar het is een eigen niche die niets verandert aan wat een MKB'er vandaag met AI doet.
- Het exacte release-giswerk rond GPT-5.6 (welke variant, welke datum, "Sol/Terra/Luna"): de overheids-gating is het verhaal, niet de precieze releasedatum, die verandert niets aan wat je vandaag bouwt.
Mijn voorspellingen
Wat ik denk dat er gaat gebeuren in AI, en hoe het uitpakt. Ook als ik ongelijk had.
Op korte termijn13
- open
Voor eind 2026-W34 wisselt minstens een van de drie grote Amerikaanse labs (OpenAI, Anthropic, Google) opnieuw een frontier-model van publieke beschikbaarheid naar overheids- of toegangsbeperking
- open
Voor eind 2026-W40 verwijst minstens een tweede EU-rechterlijke uitspraak, toezichthouder of officiele richtlijn naar het Duitse AI-Overviews-oordeel als grond voor directe aanbieder-aansprakelijkheid voor AI-output
het bewijs
W26: geen nieuwe juridische verwijzing; de EU stemde wel in met uitstel van enkele AI Act-verplichtingen, wat de richting eerder vertraagt dan versnelt
- open
Werkgeheugen blijft duur (32GB DDR5 boven ~250 euro) tot eind 2026 door AI-datacentervraag, wat lokaal AI draaien minder goedkoop maakt dan de gratis open-weights suggereren
- open
EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoop- of architectuurfactor in minstens een gevoelige-data-sector (juridisch/zorg/finance) in NL/EU, gedreven door AI Act-agentregels (augustus) plus Europese compute
het bewijs
W26: de overheids-gating van GPT-5.6 en Mythos 5 maakte US-afhankelijkheid opnieuw tastbaar; zelf-draaibaar of binnen de EU verschoof van ideologie naar continuiteitsargument
- open
Voor eind 2026-W36 staat een open-weights model (DeepSeek, Qwen of StepFun) in de top-3 van SWE-Bench Pro, op closed-flagship-niveau
het bewijs
bewijs stapelt W24: MiniMax M3 op 54.7 van de Artificial Analysis Intelligence-index (open, vlak onder flagship); W26: GLM-5.2 komt binnen als sterkste open model voor coding/agents, het bewijs blijft richting de W36-deadline stapelen
- open
Voor eind 2026 voert minstens een mainstream NL/EU-merk 'door mensen gemaakt' of 'AI-vrij' actief als verkoopargument (label, campagne of premium-tier)
- open
Voor eind 2026 wordt 'AI-investeringen leveren nog niet op' een dominant mainstream-narratief op cover-story-niveau, wat MKB voorzichtiger maakt
- open
Voor eind 2026 bevestigt Apple publiekelijk dat de Gemini-Siri-inferentie via Apple's Private Cloud Compute loopt (niet rauw naar Google), als GDPR-relevant verkoopargument
het bewijs
beweegt sterk W24: Apple toont op WWDC een drie-lagen-Siri (toestel / Apple privacy-cloud / Google-cloud voor complexe taken), gerapporteerd 1,2T-Gemini ~1mld/jr, geen EU-launch; expliciete GDPR-framing ontbreekt nog
- open
Voor eind 2026 draait een open MoE-model van Qwen of DeepSeek-V4-Flash-klasse (near-frontier reasoning) bruikbaar boven 20 tokens/sec lokaal op een Mac van maximaal 4000 euro
- open
Kosten-per-taak wordt binnen 2 kwartalen de dominante AI-inkooplens bij MKB
- open
Coding-tools-laag commoditiseert binnen ~12 maanden
- bevestigd
AI inside zakt als verkoopargument, human-led stijgt
het bewijs
HN-top "I'm Tired of Talking to AI" (W22 1724pt naar W23 2008pt) + DuckDuckGo +28% + AI-vrij als feature; herbevestigd W23; herbevestigd W24: "AI is slowing down" 613pt + zelfbewuste anti-AI-vraag 455pt; herbevestigd W26: Ford haalt ervaren mensen terug bij z'n agent-uitrol, bouwers willen de code-review aanscherpen, en de "AI verbrandt de toast, ik schraap 'm af"-stemming
- bevestigd
China haalt de bodem onder flagship-pricing weg
het bewijs
DeepSeek 75% korting permanent + Qwen Opus-niveau (W22); herbevestigd W23: DeepSeek-V4-Pro/Flash + Qwen3.6 voeren HF-trending aan (open-weights naderen flagship); herbevestigd W24: 25+ open modellen in 1 week, DeepSeek-V4-Pro #1 HF (4730), Google geeft Gemma 4 zelf open vrij; herbevestigd W26: Zhipu's open GLM-5.2 voert de open-model-ranglijst aan, juist nu de Amerikaanse topmodellen achter een overheidshek verdwijnen
~1 jaar6
- open
Voor 2027-W23 wordt minstens een top coding-tool (Cursor, Copilot, Windsurf of Claude Code) overgenomen of fundamenteel van 'tool' naar 'platform/agent' herpositioneerd
- open
Voor 2027-W23 brengt een grote partij (OpenAI, Anthropic, Google, Apple of Microsoft) een mainstream proactieve persoonlijke assistent die een fleet van agents aanstuurt
- open
Voor eind 2027 haalt de METR 50%-task-horizon taken die mensen minstens een volledige werkdag (8 uur) kosten, voor generalist-agents
- open
Voor 2028-W22 is er geen algemeen beschikbaar agent-product dat een NL-MKB-werknemerrol end-to-end vervangt met persistent leren over sessies, op productie-betrouwbaarheid (Karpathy continual-learning-test, human-moat-tracker)
- open
Voor eind 2027 ziet minstens een traditioneel NL-kwaliteitsmerk (Volkskrant, NRC of FD) een meetbare opleving in betalende abonnees of print-oplage, mede gedreven door deepfake-/fake-news-moeheid en 'geverifieerd door mensen' als waarde (flight to verified-human)
- open
Voor eind 2027 wordt parasociale AI-schade ('AI-psychose', ongezonde AI-afhankelijkheid) een erkende categorie in minstens een Westers land: een formele gezondheidsrichtlijn, klinische erkenning, of door een toezichthouder afgedwongen platform-maatregel
~3 jaar (horizon-watch)1
- open
Voor eind 2028 publiceert minstens een frontier-lab een geverifieerde, reproduceerbare autonome verbetering door een AI aan z'n eigen training of architectuur boven menselijke baseline (Clark 60%-scenario)