Beluister Turing Station op Spotify | Apple Podcasts | YouTube.
Open-weights modellen liepen jarenlang hopeloos achter op de gesloten frontier models. En toen kwam GLM-5.2. Ineens is dat gat nog maar drie tot vier maanden. Hoe groot is dat verschil tussen open en closed nu echt? Dat is de vraag waarmee we deze allereerste aflevering openen.
TL;DR
- [00:05:00] GLM-5.2 laat zien dat open-weights modellen nog maar 3 Ã 4 maanden achterlopen op de beste gesloten modellen â al heb je een investering van $300.000 nodig om het thuis fatsoenlijk te draaien.
- [00:29:00] Tokenmaxxing liep uit de hand: Peter Steinberger verbrandt $1,3 miljoen aan tokens per maand, terwijl bedrijven als Uber en Amazon juist limieten instellen.
- [00:40:00] Moeten we AI vertragen? Wij kiezen voor versnellen â de trein rijdt toch, en het voorzorgsprincipe wordt te makkelijk uit de kast getrokken.
- [00:54:00] De Amerikaanse overheid blokkeerde de export van Claude Fable en Mythos, waarna Anthropic de modellen voor iedereen introk.
GLM-5.2 en de sprong van open-weights modellen
Een tweet van Haider Khan vatte het mooi samen: de sprong van GLM-5.2 is zo groot dat open source nog maar drie tot vier maanden achterloopt op de nieuwste gesloten modellen. Het model van het Chinese bedrijf Zhipu (tegenwoordig Z.AI) zit qua coding ergens tussen GPT-5.4 en Opus 4.7/4.8 in. Net als bij DeepSeek R1 begin 2025 zorgt zo'n model ervoor dat OpenAI en Anthropic ineens een stuk minder uniek lijken.
De nuance zit in de hardware. Het topmodel draai je niet zomaar thuis. Een Mac Studio met 512 gigabyte geheugen kost al snel $40.000 en is dan nog traag â wat bij Claude vijftien seconden kost, duurt daar vijf minuten. Voor een setup die echt vergelijkbaar is met frontier models via de cloud kijk je naar een investering van $300.000 aan Nvidia-GPU's. De allerbeste modellen die je op een krachtige laptop kunt draaien lopen daarmee al snel negen tot twaalf maanden achter. In de praktijk merkten wij bij dagelijkse taken â een Python-scriptje, een agenda-invite bijwerken â eerlijk gezegd nauwelijks verschil.
Tokenmaxxing en de echte kosten van AI
Tokenmaxxing was vanaf voorjaar 2026 een ding: zoveel mogelijk tokens verbranden als bewijs dat je echt met AI bezig was. Maar zodra een maatstaf een doel wordt, houdt het op een goede maatstaf te zijn â Goodhart's Law. Mensen lieten Claude expres langer doorwerken of schreven scriptjes die nutteloos tokens verbrandden. Peter Steinberger, de man achter OpenClaw, verbrandt naar verluidt $1,3 miljoen aan tokens per maand. Dat is voor niemand anders haalbaar.
Inmiddels zien we de tegenbeweging. Amazon haalde zijn token-leaderboard weg, Uber zette een cap van âŦ1.500 per maand per werknemer, en bij dure tools als Codex en modellen als Fable schakelden de aanbieders over op pay as you go. Dit laat vooral zien hoe vroeg we in de cyclus zitten: het gebruik is nog te duur en de prijsstelling moet echt nog uitgedokterd worden. Geniet dus van de gesubsidieerde abonnementen zolang het kan â voor âŦ100 krijg je nu al snel zo'n âŦ1.000 aan compute.
Moeten we AI-ontwikkeling vertragen?
In The Atlantic schreef Emma Pierson een stuk met de titel "I'd Rather Risk Cancer than See AI Move this Fast". Haar argument: de snelheid waarmee AI beter wordt, gaat het aanpassingsvermogen van samenleving en economie te boven. Daar tegenover staat het voorzorgsprincipe van Nassim Taleb (alleen ingrijpen bij echte risk of ruin) en het idee van de "normal tech"-denkers dat technologie zich in de praktijk veel langzamer verspreidt dan twitteraars denken.
Wij kiezen voor versnellen. Het voorzorgsprincipe wordt hier te makkelijk uit de kast getrokken, en te veel verschillende risico's worden op ÊÊn hoop gegooid. Bovendien: de trein rijdt toch. Trapt Amerika op de rem, dan gaat China door â de geopolitieke voordelen zijn te groot. En wat betekenis betreft: AI is beter in schaken, maar we schaken nog steeds graag tegen elkaar. De echt grappige video's worden nog altijd door mensen gemaakt. AI verrijkt onze creativiteit, het vervangt haar niet.
Het nieuws van de maand: Claude Fable en Mythos
Misschien wel het grootste nieuws sinds de lancering van ChatGPT. Anthropic kreeg het aan de stok met de Amerikaanse overheid, die de modellen wilde inzetten voor surveillance en autonome wapens. Met Project Glasswing gaf Anthropic eerst zo'n 200 bedrijven en overheden toegang tot Mythos om security-bugs te dichten â onder meer in Firefox. Op 9 juni kwamen Fable en Mythos uit preview.
De vreugde was van korte duur. Volgens The Economist meldde Amazon â zelf investeerder in Anthropic â dat er een smalle jailbreak in Fable zat. De Amerikaanse overheid besloot daarop dat alleen Amerikanen toegang mochten hebben. Omdat Anthropic dat niet kon garanderen, trokken ze de modellen voor iedereen in. De facto een verbod. Wij verwachten dat Fable binnen enkele maanden terugkomt â of dat andere bouwers het niveau evenaren, misschien wel volgende week al.
We zijn net begonnen en willen vooral meer mensen bereiken. Ken je iemand die dit ook leuk vindt? Stuur de aflevering door â bijvoorbeeld door turingstation.nl te delen. Dat helpt ons op dit moment het meest.
Bronnen
GLM-5.2
- Haider over de grote sprong van GLM-5.2
- Epoch AI: verschil tussen open en closed weights modellen
- DeepSeek haalt 7,4 miljard op bij waardering van 50 miljard
- Alex Finn draait GLM-5.2 lokaal
- Fortune 500-bedrijf verplaatst helft van coding naar GLM-5.2
- Benchmark van Arena.ai
- Benchmark van Kilo Code
- Benchmark van Artificial Analysis
Tokenmaxxing & kosten
- WSJ: waarom bedrijven 'tokenmaxxing' cruciaal vinden
- Peter Steinberger verbruikt 1,3 miljoen dollar aan tokens per maand
- GitHub Copilot stapt over op gebruiksgebaseerde facturering
- Anthropic pauzeert tokenfacturering voor Claude Agent SDK
- OpenAI Codex: flexibele prijzen op basis van gebruik voor teams
- Uber maximeert AI-uitgaven na overschrijding budget in 4 maanden
- Amazon schrapt AI-leaderboard om jacht op gebruiksscores te stoppen
- OpenAI verliezen bijna verachtvoudigd in 2025: 34 miljard uitgaven
- Ed Zitron: de winstgevendheids-zwendel van Anthropic
Moeten we AI-ontwikkeling vertragen?
Nieuws van de maand: Claude Mythos/Fable
- Anthropic-statement over Department of War en AI-oorlogsvoering
- Anthropic introduceert Mythos en Project Glasswing
- Dario Amodei: beleid voor de AI-exponentieel
- VS verbiedt toegang tot Fable 5 en Mythos 5
- Anthropic verwijdert Fable 5 uit abonnementen per 23 juni
- Reuters: vroege gebruikers houden toegang tot Mythos-preview
- Ars Technica: hoe Anthropic zichzelf in een exportverbod praatte
Timestamps
[00:00:00] - Intro
[00:05:00] - GLM 5.2
[00:29:00] - Tokenmaxxing
[00:40:00] - Moeten we AI-ontwikkeling vertragen?
[00:54:00] - Claude Mythos/Fable
[01:13:00] - De metrokaart van AI