Notities bij de aflevering
De Amerikaanse overheid verbood voor het eerst een softwaremodel, Grok leverde de volgende dag een militaire AI, het Chinese lab GLM 5.2 evenaarde de intelligentie van Fable tegen een fractie van de kosten met open weights, en de robotvloot van Figure AI overtrof het aantal menselijke werknemers.
Hoofdstukken
- 05:00 — Fable wereldwijd verboden door Amerikaanse exportcontroles, Grok gemilitariseerd van de ene op de andere dag
- 13:00 — Sakana's Fugu multi-agent router, Apple's AI-stagnatie, en de realiteitscheck van het gebruik
- 19:00 — GLM 5.2: Fable-niveau intelligentie tegen 15x lagere kosten, volledig open weights
- 28:00 — Robots van Figure AI overtreffen mensen, Mondo's filmrobot, en de koptelefoonchip-exploit
Links
- https://www.youtube.com/watch?v=80mnCpYHZrE
- https://www.anthropic.com/
- https://www.sakana.ai/
- https://www.figure.ai/
- https://www.mondorobotics.com/
Aflevering 13 — In de minderheid door robots
Beschrijving: Fable wordt wereldwijd verboden door Amerikaanse exportcontroles, Grok gaat naar het slagveld, GLM 5.2 evenaart Fable tegen 15x lagere kosten, en de robots van Figure AI overtreffen nu hun menselijke werknemers.
Het eerste software-exportverbod in de Amerikaanse geschiedenis landde deze week, en het betrof een AI-model. Een dag later kondigde Grok een militair model aan dat al direct targetingbeslissingen op het slagveld aanstuurt. Ondertussen bracht een Chinees lab een open-weight model uit dat de intelligentie van Fable evenaart tegen 15 keer lagere kosten, en een robotica-bedrijf overschreed een symbolische drempel waarbij robots op de eigen fabrieksvloer de mensen overtroffen.
Fable wereldwijd verboden: de eerste software-exportcontrole
Het Bureau of Industry and Security, de Amerikaanse instantie die normaal hardware-exportcontroles afhandelt, verbood Fable voor het eerst als software in plaats van hardware. Omdat Anthropic niet betrouwbaar kan verifiëren wie een Amerikaanse burger is versus een niet-burger op verkeersniveau, geldt de beperking voor iedereen wereldwijd, inclusief blijkbaar Anthropic's eigen niet-Amerikaanse medewerkers.
- Interne tegenstrijdigheid: Anthropic gebruikt Mephos vrijwel zeker intern voor ontwikkeling en mogelijk training. Ongeveer de helft van het team codeert met Fable 5, de andere helft met Opus 4.8. Het verbieden van niet-Amerikaanse werknemers om hun eigen model te gebruiken, is een zelf toegebrachte wond die het bedrijf realistisch gezien niet kan afdwingen.
- De jailbreak-trigger: De beperking werd niet gedreven door commerciële overwegingen, maar door een beveiligingsbevinding. Intern Amerikaans overheidsonderzoek wees uit dat Fable te gemakkelijk kon worden gejailbreakt, vergelijkbaar met de Pliny-exploit. Het beveiligde model zelf was niet het probleem; het gemak waarmee deze beveiligingen konden worden omzeild, werd als een onaanvaardbaar beveiligingsrisico beschouwd.
- De Europese kwestie: Het verbod onderstreept hoe afhankelijk Europa blijft van de Amerikaanse inlichtingeninfrastructuur. De GPS-parallel is leerzaam: er bestaan nu drie afzonderlijke satellietnetwerken (Amerikaans, Chinees, Europees) juist omdat het vertrouwen op één militair gecontroleerd netwerk onhoudbaar was. AI gaat dezelfde kant op, maar Europa loopt enorm achter, en Mistral alleen kan de kloof niet dichten.
Grok gaat naar de oorlog: militaire AI de dag na het verbod
Eén dag nadat Fable werd beperkt, kondigde xAI een Grok-model aan dat is aangepast voor militair gebruik. Het is al bevestigd dat het targetingbeslissingen aanstuurt in live actieve militaire operaties.
- Snelheid van implementatie: Van een "Mega Hitler"-persona zes maanden geleden naar targetingbeslissingen op het slagveld gaan, is een snelheid die vragen oproept over de volwassenheid van de beveiligingen.
- De ethische asymmetrie: Anthropic wordt intensief onder de loep genomen over ethiek en veiligheid, terwijl Grok direct naar het slagveld wordt gestuurd met relatief weinig publiek debat. De kloof in wie toegang krijgt tot intelligentie en wie niet, is nu niet alleen zichtbaar over grenzen heen, maar ook over gebruiksscenario's.
- Token-economie: Een model dat redeneert via lange denkloops en zijn eigen output herleest om tot betere antwoorden te komen, is fundamenteel duur in tokens, ongeacht de prijs per token.
Sakana's Fugu: een router vermomd als model
Een klein Japans lab, Sakana AI, bracht een model genaamd Fugu uit dat het adverteert als intelligentie van Mephos-klasse. De architectuur is geen enkel model, maar een multi-agent routing systeem.
- Hoe het werkt: Fugu orkestreert over meerdere gesloten en open modellen, waarbij queries worden gerouteerd naar het model dat het meest geschikt is. Sakana bouwde de router en orkestratielaag bovenop zijn eigen modellen, waardoor intelligentie wordt gecreëerd door diversiteit aan trainingsdata en perspectief in plaats van pure schaal.
- De zwermbenadering: Dit weerspiegelt wat OpenRouter op platformniveau doet, maar dan verpakt als één enkel model-endpoint. Meerdere modellen met verschillende trainingsdata en verschillende perspectieven op het probleem produceren gezamenlijk betere outputs dan welk enkel model dan ook.
- Kostenkwestie: Het tokengebruik over een multi-model router is noodzakelijkerwijs hoog. De intelligentie-per-dollar berekening hangt sterk af van hoe efficiënt de router onnodige oproepen kan minimaliseren.
Apple's AI: nog steeds zoek
Apple kondigde zijn nieuwste AI-functies aan op WWDC, die in september worden geleverd. De belangrijkste Siri-revisie werd gedemonstreerd door te vragen "wie speelt er vanavond op het WK?" en de wedstrijd op te roepen.
- Verkeerd publiek: Een WK-score opzoeken als vlaggenschipdemo signaleert dat Apple zich richt op de gemiddelde iPhone-gebruiker, niet op ontwikkelaars of power users. De consensus van het team: de Siri-revisie lijkt nutteloos voor iedereen die Gemini of ChatGPT al dagelijks gebruikt.
- Gemini onder de motorkap: Apple's nieuwe Siri wordt effectief aangedreven door Gemini. De visuele intelligentie en interface-lagen zijn waar Apple zich onderscheidt, maar de intelligentie zelf komt van Google.
- De bubbelrealiteit: Een veel verspreide grafiek toont dat elke stip 3,2 miljoen mensen vertegenwoordigt die nooit AI gebruiken. Gratis chatbotgebruikers, betalende gebruikers en power users vormen scherp onderscheiden lagen. De AI-markt is nog lang niet verzadigd, wat betekent dat Apple's massamarktstrategie niet verkeerd is, maar gewoon niet op ons gericht.
GLM 5.2: Fable-intelligentie tegen 15x minder, volledig open
Het Chinese lab Zhipu bracht GLM 5.2 uit, en als je de benchmarks vertrouwt, zit het op Fable-niveau intelligentie tegen ongeveer 15 keer lagere kosten. Het is een model met één biljoen parameters, en alles is gepubliceerd: weights, architectuur, en al een Q2 quant.
- Open weights: Het volledige model en een Q2 kwantisatie zijn beschikbaar. De kwantisatie brengt de VRAM-vereisten terug van 1,56 terabyte naar een "redelijke" 260 gigabyte, nog steeds massief maar hanteerbaar op high-end hardware.
- Hardware-realiteit: Het draaien van het volledige model vereist 1,56 TB VRAM. De Tiny Box van Tiny Corp, die GLM 5.2 kan draaien, kost $20 miljoen. Een kleinere versie met zes RTX 6000's (96 GB elk) kost $50.000 tot $80.000. Dit is geen hobbyisten-setup.
- Redeneren boven schaal: GLM 5.2 bereikt zijn intelligentie door uitgebreide redeneerloops, waarbij het binnen het model herleest en itereert in een patroon dat doet denken aan Karpathy's auto-onderzoeksloop. Het denkt harder in plaats van groter getraind te worden, wat een fundamenteel andere kostenstructuur is.
- Dagelijkse driver: Voor praktisch gebruik is GLM 5.2 al een dagelijks werktuig van Fable-kwaliteit, en de open weights betekenen dat de lokale-naar-cloud ladder werkt binnen één enkele modelfamilie.
Figure AI: robots overtreffen nu mensen
Brett Adcock, oprichter en CEO van Figure AI, deelde mee dat robots het aantal mensen in het bedrijf hebben overtroffen. De cijfers: 660 werknemers en ongeveer 740 geproduceerde robots, die ongeveer één robot per uur bouwen.
- Niet allemaal actief: Het cijfer van 740 omvat robots in productie, in testen en klaar voor levering aan klanten, niet 740 die rondlopen en afwassen. Maar de productiesnelheid van één robot per uur is een echte productiemijlpaal.
- BMW-testen: Figure-robots testen al ongeveer anderhalf jaar bij BMW, ruim voorbij de pilotfase. De vraag neemt toe, en de productiestijging weerspiegelt echte bestellingen, niet alleen opgeslagen voorraad.
- De singulariteitsvraag: Of robots nu robots bouwen bij Figure blijft onduidelijk, maar het omslagpunt waarop de output van een robotica-bedrijf zijn personeelsbestand overtreft, is een betekenisvol keerpunt.
Mondo Robotics: een filmrobot van $499 die springt
Mondo Robotics bracht een grondgebonden filmrobot uit die 25 km/u haalt, springt, flipt, zichzelf herstelt na een val, en alle terreinen aankan, inclusief gras en modder. Prijs: $499. Verwerking gebeurt op het apparaat.
- Het gebruiksscenario: Het volgt je via een polsbandtracker, wat een tracking shot op grondniveau geeft dat drones niet kunnen repliceren. Drones winnen op flexibiliteit in hoogte; deze wint op nabijheid en interactie met het terrein.
- Ontwerplijn: Het ziet eruit als een DJI-product, en deelt waarschijnlijk componenten. De vormfactor en de dubbele camera-opstelling weerspiegelen DJI's industriële ontwerptaal.
- Het oordeel: Geen tool voor iedereen, maar voor skaten, fietsen en actiesportbeelden vult het een gat tussen luchtdrones en statische statieven. Als een moderne RC-auto vervanging voor kinderen is het een directe upgrade.
Zwarte markt abonnementen en de Bluetooth koptelefoon exploit
Twee beveiligingsverhalen sloten de aflevering af. Ten eerste verkopen marktplaatsen Claude Code-abonnementen voor $6, waarschijnlijk afkomstig van gestolen accounts in plaats van regionale prijsarbitrage. Ten tweede ontdekten twee onderzoekers uit Heidelberg een exploit in een Bluetooth-chip van een Taiwanese fabrikant die in meer dan 100 koptelefoonmodellen wordt gebruikt.
- De chip-exploit: De chip had een open onderhoudspoort die gesloten had moeten zijn. Binnen 10 meter Bluetooth-bereik kon een aanvaller de koppelingssleutel extraheren, verbinding maken met de koptelefoon en commando's naar de gekoppelde telefoon sturen, inclusief toegang tot het geheugen van de telefoon.
- Bereik: Meer dan 100 koptelefoonmodellen werden getroffen, waaronder Beats Studio Pro en Nothing-oordopjes. Apple's eigen AirPods gebruiken een eigen chip en werden niet getroffen.
- Patch-tijdlijn: Apple deed er ongeveer anderhalve maand over om het probleem op te lossen, aanzienlijk langer dan concurrenten. De kwetsbaarheid was geen zero-day in de traditionele zin, alleen een fabrikant die vergat een onderhoudspoort te sluiten.
Conclusie
Het signaal deze week is dat AI nu tegelijkertijd bewapend, gereguleerd, gecommodificeerd en fysiek is. Een Amerikaanse instantie die een taalmodel behandelt als een munitie-export is een precedent dat het beleid jarenlang zal bepalen. Open-weight modellen die grensverleggende intelligentie evenaren tegen een fractie van de kosten zullen de prijsstelling van elk gesloten lab onder druk zetten. En wanneer een robotica-bedrijf één robot per uur bouwt en zijn vloot zijn personeelsbestand overtreft, is de vraag niet langer of robots overal zullen zijn, maar wanneer de rest van ons het opmerkt.