Episodennotizen
Frisch nach dem Hackathon nimmt das Team den persönlichen Voice-DJ von Spotify unter die Lupe, beleuchtet Anthropics neues Fable-Modell (den frei zugänglichen Ableger des abgeschirmten Mephos) und analysiert die OpenRouter-Rankings, in denen chinesische Modelle den Token-Markt aufrollen.
Kapitel
- 01:00 — Spotifys persönlicher DJ: ein Voice Agent, der tatsächlich funktioniert
- 13:00 — Hackathon-Recap: Builder, Keyboards und Haarlem auf der Tech-Landkarte
- 20:00 — Fable und Mephos: Anthropics Sicherheitsmodell wird öffentlich
- 30:00 — OpenRouter Token Wars: Wie chinesische Modelle den Markt übernehmen
Links
- https://www.youtube.com/watch?v=C223zTW1fLU
- https://open.spotify.com/episode/0bRQ6a6FdbCzhNLTsgMB19
- https://www.anthropic.com/
- https://openrouter.ai/
- https://www.deepseek.com/
Episode 12 — Fables Preisschild und Chinas Token-Dominanz
Beschreibung: Anthropics Fable-Modell bringt Mephos-Intelligenz für 50 $ pro Million Output-Tokens – während chinesische Labs um DeepSeek die Token-Charts auf OpenRouter dominieren.
Zwei Kräfte ziehen aktuell in völlig entgegengesetzte Richtungen. Anthropic bringt sein bisher teuerstes und fähigstes Modell an den Start – allerdings in einem eng befristeten Zeitfenster. Gleichzeitig rollen chinesische Labs im Stillen die Token-Statistiken auf, weil sie schlicht unverschämt günstig sind. Die Spannung zwischen diesen beiden Strategien ist das zentrale Thema dieser Episode.
Spotifys persönlicher DJ: Der erste Voice Agent, der hängenbleibt
Spotify hat einen persönlichen DJ gelauncht, der sich anfühlt wie ein Siri oder Alexa, das für Musik tatsächlich funktioniert. Du sprichst mit ihm, er steuert die Wiedergabe und durchforstet jahrelange Hörgewohnheiten, um genau den richtigen Track zu treffen.
- Kontextsensitives Sequencing: Das System analysiert, was du ohnehin hörst, schlägt proaktiv neue Musik in derselben Richtung vor und wechselt mitten in der Session den Vibe („Lass uns jetzt etwas mehr Richtung Latin gehen“).
- Verhaltensdaten richtig genutzt: Das Fazit des Teams: Wenn ein Produkt historische Verhaltensdaten so treffsicher einsetzt, fühlt es sich plötzlich lohnend an, noch mehr Daten preiszugeben. Nach drei Tagen hatte das Feature bereits tägliche Routinen verändert.
- Die Kehrseite: Musik ist ein verlässlicher Indikator für Stimmungen. Sobald Spotifys emotionales Profil mit Suchhistorien oder Kaufverhalten verknüpft wird, sind die Möglichkeiten für gezieltes Targeting enorm – und vermutlich passiert genau das längst im Hintergrund.
Hackathon-Recap: Haarlem auf der Landkarte
Der erste Digilize-Hackathon brachte Builder aus den gesamten Niederlanden und sogar einen Teilnehmer aus Italien zusammen – mit unbegrenzter Verpflegung, sechs Stunden reiner Bauzeit und zwei Challenges.
- Starkes Feedback für ein erstes Event, mit klaren Hebeln, um das Format beim nächsten Mal noch weiter zu schärfen.
- Echtes Community-Signal: Die Leute brachten ihre eigenen Keyboards mit, blieben das gesamte Zeitfenster über voll fokussiert – und die Energie bestätigte unsere Wette, Haarlem als Ort zu etablieren, an dem echte Software gebaut wird.
- Wie es weitergeht: Die wöchentlichen Episoden laufen wieder regulär, dazu sind weitere Community-Events geplant. Recap und Fotos sind auf der Hackathon-Website online.
Fable und Mephos: Anthropics Sicherheitsmodell wird öffentlich
Anthropics Mephos ist das Modell mit ausgeprägten Cybersecurity- und Biologiefähigkeiten, über das wir ursprünglich unter dem Codenamen Mythos berichtet haben – damals im Rahmen von Project Glasswick nur für ausgewählte US-Unternehmen zugänglich. Fable ist das öffentliche Gegenstück, jetzt verfügbar in Claude Code und im Web-Interface, allerdings mit deutlich strengeren Guardrails.
- Guardrails per Routing: Wer Fable Fragen zu Cybersecurity oder Biologie stellt, wird intern über Opus 4.8 geroutet, statt Antworten aus der Mephos-Architektur zu erhalten. Es ist ein gigantisches Modell – vermutlich weit jenseits einer Billion Parameter – und bei komplexen Aufgaben spürbar intelligenter als Opus.
- Preisgestaltung: 10 $ pro Million Input-Tokens und 50 $ pro Million Output-Tokens. Im Vergleich zu DeepSeek V4 Pro mit rund 0,43 $ für Input und 0,87 $ für Output pro Million Tokens ist der Abstand schwindelerregend.
- Zeitlich begrenzter Zugriff: Fable steht in Pro- und Max-Abonnements nur bis zum 22. Juni zur Verfügung. Danach nimmt Anthropic das Modell aus dem Frontend und verweist auf die API-Plattform. Eine Verlängerung wurde jedoch in Aussicht gestellt, sollten sie zusätzliche Rechenkapazitäten sichern.
- Subventionierte Abos: Unabhängige Analysen zeigen, dass der Max-Plan (200 $/Monat) effektiv einem API-Gegenwert von bis zu 8.800 $ entspricht – ein klassischer Loss Leader, um Nutzer tief ins eigene Ökosystem zu ziehen.
- Bereits gejailbreakt: Pliny knackte Fable mithilfe von Out-of-Distribution-Tokens (Tokens aus Sprachen außerhalb von Anthropics Trainingsdaten) und mehrstufiger Destillation. Anthropic leitet Prompts mit dem Namen „Pliny“ mittlerweile an Fable vorbei – ein unfreiwilliges Eingeständnis.
Das Playbook, das sich in der Community herauskristallisiert: Fable für Architektur, Code-Reviews und übergeordnete Reasoning-Aufgaben nutzen – und die eigentliche Implementierung an ein günstigeres Modell wie DeepSeek V4 Pro übergeben.
OpenRouter Token Wars: Chinesische Modelle fressen den Markt
Ein wöchentlicher OpenRouter-Chart über den Token-Verbrauch der neun führenden Modelle zeichnet ein klares geopolitisches Bild – und setzt den Trend fort, den wir bereits beim Aufstieg von OpenClaw in China beobachtet haben.
- Kopf-an-Kopf-Rennen, dann der Bruch: US-Modelle lagen lange Zeit nahezu gleichauf, bis es im November zu einem Einbruch kam (vermutlich eine Mischung aus Release-Flaute und Jahresend-Budgets). Danach explodierte der Token-Verbrauch förmlich – getrieben durch chinesische Modelle.
- Die Spitze ist komplett chinesisch: DeepSeek, Minimax M3, Tencent, Xiaomi und Step 3.7 dominieren das wöchentliche Ranking. Die spontane Reaktion im Podcast: „Chinesisch, chinesisch, chinesisch.“
- Der Preis öffnet die Tür, aber die Leistung muss stimmen: Billig allein reicht nicht. Chinesische Modelle gewinnen, weil sie extrem günstig und gleichzeitig verdammt gut sind – allen voran Qwen 3.6 als Standard für lokales Deployment.
- Open Weights treiben die Adoption: Die Brücke von lokal zu Cloud ist entscheidend: Erst Qwen 3.6 lokal betreiben und bei Bedarf innerhalb derselben Modellfamilie in die Cloud skalieren. Diese Kontinuität ist ein echter Wettbewerbsvorteil, den geschlossene US-Modelle nicht bieten können.
- Neues lokales Coder-Modell: Die Community hat Opus 4.8 in Qwen 3.6 destilliert und unter dem Namen „Quopus 35B Coder“ veröffentlicht – das erste spezialisierte lokale Coding-Modell auf Basis der Qwen-3.5-Architektur, inklusive MTP für maximale Geschwindigkeit.
Die offene Frage lautet: Wie nachhaltig sind die chinesischen Subventionen? Die Parallele zur E-Auto-Industrie drängt sich auf: Aggressive staatliche Förderungen treiben die Zahlen nach oben – bis der Geldhahn zugedreht wird. Wie die New York Times berichtete, steht der Hedgefonds hinter DeepSeek in Verbindung mit der KPCh, mutmaßlich auch, um Trainingsdaten abzugreifen. Ein Muster, das sich so ähnlich allerdings auch bei US-Labs und deren Geldgebern beobachten lässt.
Fazit
Der Modellmarkt spaltet sich in Echtzeit. Anthropic setzt darauf, dass Spitzenintelligenz Premiumpreise rechtfertigt, und Fable dient als Beweis für diese These. Chinesische Labs wetten darauf, dass Open Weights und Tiefstpreise das Volumen abräumen. Beide Seiten können gleichzeitig recht behalten. Gewinnen werden am Ende die Entwickler und Unternehmen, die genau wissen, welches Modell für welchen Job das richtige ist.