Alle edities

De AI Brief · week 28

Nu twijfelen de bouwers zelf of AI wel oplevert

Verder deze week: Cloudflare gaat AI-agents standaard blokkeren op een vijfde van het web, er ging een recordbedrag naar AI-startups, en een AI-agent ontdekte vier nieuwe materialen.

7 jul 2026 · de hele week · door een mens, AI als gereedschap

Waar staan we

Al weken groeit de twijfel of AI de beloftes waarmaakt. Deze week kwam die twijfel uit een nieuwe hoek: niet van critici buiten de sector, maar van de mensen die het bouwen en verkopen. De baas van Meta zei tegen zijn eigen personeel dat de slimme assistenten trager vooruitgaan dan gehoopt, terwijl het bedrijf er dit jaar 145 miljard dollar in stak. De topman van Palantir zei op tv dat bedrijven flink betalen en er bijna niets voor terugkrijgen. En een onderzoek becijferde dat AI ongeveer 3 procent van je werkuren bespaart, waarvan bijna niets in de omzet terechtkomt.

Tegelijk stroomt het geld door en gaat de techniek gewoon door. Startups haalden in het eerste halfjaar meer op dan in heel vorig jaar, en een AI-systeem vond vier nieuwe materialen die wetenschappers nog niet kenden. Het beeld is dus niet "AI werkt niet", maar "AI werkt op smalle, goed afgebakende taken, en veel minder op de brede belofte die eromheen verkocht is". Dat gat tussen belofte en resultaat wordt deze week door de sector zelf hardop benoemd.

Wat er deze week schoof

werkt het echt

Zelfs Meta zegt dat de assistenten nog niet leveren

De baas van Meta vertelde zijn personeel dat AI-agents langzamer vooruitgaan dan gehoopt, in een jaar waarin Meta 145 miljard dollar in AI-infrastructuur stak. Een studie becijferde dat AI ongeveer 3 procent van de werkuren bespaart en dat daar bijna geen omzet uit voortkomt. Op r/ClaudeAI staat een veelgelezen bericht met de titel "AI heeft me geen tijd bespaard". Microsoft draaide na klachten een stukje terug en laat je nu de AI-hulpjes in Teams middenin een vergadering uitzetten. En Cloudflare gaat AI-agents standaard blokkeren op ongeveer een vijfde van het web. Het gat tussen demo en productie wordt nu door de grootste bouwers zelf toegegeven en tegelijk in de infrastructuur ingebouwd.

Koop uitkomsten, geen agents. Vraag bij elke AI-inzet om de meetbare besparing in uren of euro's, niet om de demo.

voor wie het nakijkt

reliability, roi, agents, production · heat: Zuckerberg-memo via Reuters + TechCrunch, r/ClaudeAI "AI has not saved me any time"

hoe het voelt

Palantir-topman: bedrijven betalen voor tokens en krijgen bijna niets terug

Alex Karp, de topman van Palantir, zei op CNBC dat de duurste AI-modellen bedrijven geen echte uitkomsten leveren: klanten betalen voor tokens en krijgen er bijna niets voor terug. Het viel op omdat het van een verkoper zelf kwam. Daarnaast lieten onderzoekers AI 112 bekende publieke figuren nadoen; mensen vonden de nagemaakte versies vaak echter en overtuigender dan de echte politici, wat de onderzoekers een ernstige waarschuwing noemden. En de bredere onvrede verschuift van "AI pikt onze banen in" naar "waarom slurpt dat datacenter stiekem onze stroom en ons water op". De stemming buiten de bubbel wordt concreter en kritischer.

Je klant of personeel heeft de twijfel nu van topmensen zelf gehoord. Kom met een resultaat, niet met een belofte.

voor wie het nakijkt

enterprise, backlash, trust, roi · heat: Karp op CNBC, cross-source (YouTube + Instagram + TikTok)

wat het kost

Goedkope en open modellen halen de top in, samen of uit China

De beste kwaliteit hoeft niet meer uit één duur model te komen. Z.ai gaf zijn open model GLM-5.2 een eigen bouwomgeving (ZCode) voor langlopende agent-klussen. MiniMax M3 wordt aangeprezen als bijna-topniveau voor een fractie van de prijs. En een Japans lab (Sakana) laat drie modellen samenwerken en claimt daarmee het beste losse model te verslaan. De rode draad: je kunt near-top kwaliteit draaien met open of goedkope modellen, of door meerdere modellen slim te combineren, in plaats van te betalen voor het ene vlaggenschip.

Je kunt bijna-topkwaliteit draaien zonder het duurste model. Vraag je bouwer om een opzet die van model kan wisselen.

voor wie het nakijkt

open-weights, china, cost, orchestration · heat: GLM-5.2 + ZCode, MiniMax M3, Sakana multi-model

wie aan de knoppen zit

Recordgeld blijft stromen terwijl Washington een augustus-deadline zet

In het eerste halfjaar van 2026 ging er 510 miljard dollar naar startups, meer dan in heel vorig jaar samen, met AI als grote motor. Nvidia geeft startups nu rekenkracht in ruil voor een deel van hun toekomstige omzet, en Together AI haalde 800 miljoen op. Tegelijk zetten de Amerikaanse regels door: het Witte Huis werkt naar vrijwillige standaarden voor het vrijgeven van topmodellen met 1 augustus als deadline, en senator Warner stelde een wet voor die een officiële lijst van "vertrouwde" AI-agents zou maken. Anthropic vroeg het Congres zelfs om onafhankelijke veiligheidstests. Geld en regels worden allebei tegelijk intenser, en beide worden buiten je eigen bedrijf bepaald.

Markt en regels worden nu elders bepaald. Houd in de gaten wat "vertrouwde agent"-eisen betekenen voor de tools die je gebruikt.

voor wie het nakijkt

funding, regulation, agents, geopolitics · heat: $510B startups H1 2026, White House 1 augustus, Warner AI Agent Act

wat er nu kan

Een AI-agent ontdekt echte nieuwe materialen, maar zakt op een simpele test

Een AI-agent van Alibaba's Damo Academy vond vier nieuwe supergeleiders, materialen die wetenschappers nog niet kenden, een echt en verifieerbaar resultaat. Tegelijk scoren de topmodellen op een nieuwe puzzeltest (ARC-AGI-3) in hun eentje onder de 1 procent, op een opgave die een kind aankan. Dat is het patroon van dit moment: AI kan bovenmenselijk zijn op een smalle, goed gedefinieerde taak en tegelijk vastlopen op iets simpels. En de geruchten lopen door: Google's volgende model zou rond 17 juli komen, met veel meer werkgeheugen voor lange opdrachten.

Zet AI in op de smalle, duidelijk afgebakende klus waar het uitblinkt. Reken niet op brede betrouwbaarheid buiten die klus.

voor wie het nakijkt

capability, science, benchmarks, jagged · heat: Damo Academy 4 superconductors, r/singularity + SCMP

Deze week doen

Meet de echte opbrengst van één AI-workflow die je al hebt uitgerold, en zet die in een cijfer. Waarom nu: deze week werd "AI levert nog niet op" een kop uit de mond van Zuckerberg, Karp en een ROI-studie tegelijk; wie als enige een gemeten besparing kan laten zien, wint het gesprek. 5-min-versie: pak één uitgerolde workflow en schrijf voor één echte taak op hoe lang die duurt met en zonder AI. 1-uur-versie: meet het echt, log de taak een paar keer, en zet er één euro- of urenbesparing onder die je aan een klant durft te laten zien.

Gereedschapskist

  • Z.ai ZCode (op GLM-5.2) · gids · een bouwomgeving op een sterk open model, voor coding- en agent-klussen die je liever niet naar een Amerikaans vlaggenschip stuurt.
  • MiniMax M3 + MiniMax Code · bijna-topniveau voor een fractie van de kosten, geschikt voor taken met veel volume waar de prijs telt.
  • De short-leash-methode voor AI-coding · uitleg · een werkwijze om agents kort te houden en hun werk te laten bewijzen, precies waar de betrouwbaarheid deze week schuurt.

Wat ik volg

  • als Cloudflare AI-agents standaard blokkeert op ~20% van het web → agent-gebaseerde scraping en automatisering worden fragieler; bouw met afgesproken of aangekondigde toegang, niet met stille bots.
  • als de White House-standaard (1 augustus) of Warner's agent-registry landt → "vertrouwde agent"-eisen kunnen doorsijpelen naar wat je bij klanten mag inzetten.
  • als Google's volgende model rond 17 juli echt komt met veel meer werkgeheugen → de context-limiet als bouwbeperking verschuift weer, en lange-documenttaken worden makkelijker.

Mijn voorspellingen

  • "AI inside zakt als verkoopargument, human-led stijgt" · bevestigd · deze week herbevestigd: Zuckerberg en Karp zeggen zelf dat het nog niet levert, en een studie zet er 3% besparing onder · sinds 2026-W19
  • "China haalt de bodem onder flagship-pricing weg" · bevestigd · deze week herbevestigd: GLM-5.2 krijgt een eigen agent-bouwomgeving en MiniMax M3 wordt als bijna-top voor een fractie aangeprezen · sinds 2026-W18
  • "AI-investeringen leveren nog niet op wordt een dominant mainstream-narratief" · open, beweegt sterk · de ROI-studie plus de uitspraken van Meta en Palantir duwen dit richting cover-story-niveau · sinds 2026-W23
  • "Een open-weights model staat voor eind W36 in de top-3 van de coding-benchmark" · open · GLM-5.2 blijft het bewijs richting de deadline stapelen · sinds 2026-W23
  • Nieuw: "Voor eind 2026-W40 blokkeert of tarifeert minstens één groot web-infrastructuurbedrijf AI-agents standaard op een significant deel van het web" · open · aanleiding: Cloudflare kondigt default-blokkade op ~20% aan · sinds 2026-W28

Wat mij ongelijk zou geven

Mijn "AI levert nog niet op"-lezing zou breken als de meetbare winst zich begint op te stapelen; deze week was er één sterk tegensignaal, een Dartmouth-tutor met een groot leereffect (0,71-1,30 SD), wat laat zien dat AI op een strak afgebakende taak wél degelijk levert.

Essay-kandidaten

  • De reckoning van binnenuit: waarom de scherpste AI-scepsis deze week van Meta en Palantir kwam, en wat dat betekent voor wie AI koopt. Sterke counter (Dartmouth-tutor), lang traject (loopt sinds W20), raakt elke MKB-eigenaar. Bouwt door op de Ford-terugtrekking van W26.
  • Cloudflare zet de deur dicht voor agents: de agentische web-belofte botst op de infrastructuur, en bijna niemand buiten de tech weet dat het eraan komt.

Wat ik je bespaar

  • Het eindeloze "ik bouwde een agent die geld verdiende terwijl ik sliep"-genre op TikTok en Threads: veel volume, geen verifieerbaar signaal.
  • De crypto-randjes rond AI (mining-oorlogen op Base, AI-fondsen met tickers): het leunt op AI als woord, niet op AI die je werk raakt.
  • De "6 AI-agent-definities die je moet kennen"-lijstjes op LinkedIn: engagement-aas zonder nieuws.

Mijn voorspellingen

Wat ik denk dat er gaat gebeuren in AI, en hoe het uitpakt. Ook als ik ongelijk had.

2 bevestigd18 open0 weerlegd
Op korte termijn13
  • opensinds 2026-W26 · review na 2026-W34

    Voor eind 2026-W34 wisselt minstens een van de drie grote Amerikaanse labs (OpenAI, Anthropic, Google) opnieuw een frontier-model van publieke beschikbaarheid naar overheids- of toegangsbeperking

  • opensinds 2026-W25 · review na 2026-W40

    Voor eind 2026-W40 verwijst minstens een tweede EU-rechterlijke uitspraak, toezichthouder of officiele richtlijn naar het Duitse AI-Overviews-oordeel als grond voor directe aanbieder-aansprakelijkheid voor AI-output

    het bewijs

    W26: geen nieuwe juridische verwijzing; de EU stemde wel in met uitstel van enkele AI Act-verplichtingen, wat de richting eerder vertraagt dan versnelt

  • opensinds 2026-W24 · review na 2026-W40

    Werkgeheugen blijft duur (32GB DDR5 boven ~250 euro) tot eind 2026 door AI-datacentervraag, wat lokaal AI draaien minder goedkoop maakt dan de gratis open-weights suggereren

  • opensinds 2026-W23 · review na 2026-W36

    EU-gehoste of on-prem AI wordt voor eind W36 een expliciete inkoop- of architectuurfactor in minstens een gevoelige-data-sector (juridisch/zorg/finance) in NL/EU, gedreven door AI Act-agentregels (augustus) plus Europese compute

    het bewijs

    W26: de overheids-gating van GPT-5.6 en Mythos 5 maakte US-afhankelijkheid opnieuw tastbaar; zelf-draaibaar of binnen de EU verschoof van ideologie naar continuiteitsargument

  • opensinds 2026-W23 · review na 2026-W36

    Voor eind 2026-W36 staat een open-weights model (DeepSeek, Qwen of StepFun) in de top-3 van SWE-Bench Pro, op closed-flagship-niveau

    het bewijs

    bewijs stapelt W24: MiniMax M3 op 54.7 van de Artificial Analysis Intelligence-index (open, vlak onder flagship); W26: GLM-5.2 komt binnen als sterkste open model voor coding/agents, het bewijs blijft richting de W36-deadline stapelen

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 voert minstens een mainstream NL/EU-merk 'door mensen gemaakt' of 'AI-vrij' actief als verkoopargument (label, campagne of premium-tier)

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 wordt 'AI-investeringen leveren nog niet op' een dominant mainstream-narratief op cover-story-niveau, wat MKB voorzichtiger maakt

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 bevestigt Apple publiekelijk dat de Gemini-Siri-inferentie via Apple's Private Cloud Compute loopt (niet rauw naar Google), als GDPR-relevant verkoopargument

    het bewijs

    beweegt sterk W24: Apple toont op WWDC een drie-lagen-Siri (toestel / Apple privacy-cloud / Google-cloud voor complexe taken), gerapporteerd 1,2T-Gemini ~1mld/jr, geen EU-launch; expliciete GDPR-framing ontbreekt nog

  • opensinds 2026-W23 · review na 2026-W52

    Voor eind 2026 draait een open MoE-model van Qwen of DeepSeek-V4-Flash-klasse (near-frontier reasoning) bruikbaar boven 20 tokens/sec lokaal op een Mac van maximaal 4000 euro

  • opensinds 2026-W22 · review na 2026-W34

    Kosten-per-taak wordt binnen 2 kwartalen de dominante AI-inkooplens bij MKB

  • opensinds 2026-W21 · review na 2026-W30

    Coding-tools-laag commoditiseert binnen ~12 maanden

  • bevestigdsinds 2026-W19 · review na 2026-W22

    AI inside zakt als verkoopargument, human-led stijgt

    het bewijs

    HN-top "I'm Tired of Talking to AI" (W22 1724pt naar W23 2008pt) + DuckDuckGo +28% + AI-vrij als feature; herbevestigd W23; herbevestigd W24: "AI is slowing down" 613pt + zelfbewuste anti-AI-vraag 455pt; herbevestigd W26: Ford haalt ervaren mensen terug bij z'n agent-uitrol, bouwers willen de code-review aanscherpen, en de "AI verbrandt de toast, ik schraap 'm af"-stemming

  • bevestigdsinds 2026-W18 · review na 2026-W22

    China haalt de bodem onder flagship-pricing weg

    het bewijs

    DeepSeek 75% korting permanent + Qwen Opus-niveau (W22); herbevestigd W23: DeepSeek-V4-Pro/Flash + Qwen3.6 voeren HF-trending aan (open-weights naderen flagship); herbevestigd W24: 25+ open modellen in 1 week, DeepSeek-V4-Pro #1 HF (4730), Google geeft Gemma 4 zelf open vrij; herbevestigd W26: Zhipu's open GLM-5.2 voert de open-model-ranglijst aan, juist nu de Amerikaanse topmodellen achter een overheidshek verdwijnen

~1 jaar6
  • opensinds 2026-W23 · review na 2027-W23

    Voor 2027-W23 wordt minstens een top coding-tool (Cursor, Copilot, Windsurf of Claude Code) overgenomen of fundamenteel van 'tool' naar 'platform/agent' herpositioneerd

  • opensinds 2026-W23 · review na 2027-W23

    Voor 2027-W23 brengt een grote partij (OpenAI, Anthropic, Google, Apple of Microsoft) een mainstream proactieve persoonlijke assistent die een fleet van agents aanstuurt

  • opensinds 2026-W23 · review na 2027-W52

    Voor eind 2027 haalt de METR 50%-task-horizon taken die mensen minstens een volledige werkdag (8 uur) kosten, voor generalist-agents

  • opensinds 2026-W23 · review na 2028-W22

    Voor 2028-W22 is er geen algemeen beschikbaar agent-product dat een NL-MKB-werknemerrol end-to-end vervangt met persistent leren over sessies, op productie-betrouwbaarheid (Karpathy continual-learning-test, human-moat-tracker)

  • opensinds 2026-W23 · review na 2027-W52

    Voor eind 2027 ziet minstens een traditioneel NL-kwaliteitsmerk (Volkskrant, NRC of FD) een meetbare opleving in betalende abonnees of print-oplage, mede gedreven door deepfake-/fake-news-moeheid en 'geverifieerd door mensen' als waarde (flight to verified-human)

  • opensinds 2026-W23 · review na 2027-W52

    Voor eind 2027 wordt parasociale AI-schade ('AI-psychose', ongezonde AI-afhankelijkheid) een erkende categorie in minstens een Westers land: een formele gezondheidsrichtlijn, klinische erkenning, of door een toezichthouder afgedwongen platform-maatregel

~3 jaar (horizon-watch)1
  • opensinds 2026-W23 · review na 2028-W52

    Voor eind 2028 publiceert minstens een frontier-lab een geverifieerde, reproduceerbare autonome verbetering door een AI aan z'n eigen training of architectuur boven menselijke baseline (Clark 60%-scenario)