Fable bekommt Aufschub. GPT-5.6 spart Tokens. Die Token-Ökonomie schlägt zu.
Diese Folge steht ganz im Zeichen der Model News. Fabian Walther und Ole Wendland sprechen über Fable, das doch noch eine Gnadenfrist samt Quota-Reset bekommt, und über die Frage, was das alles eigentlich kostet. Der DeepSWE Benchmark zeigt: Sonnet 5 lohnt sich für Coding kaum, und OpenAIs neue Modelle Soul, Terra und Luna setzen voll auf Effizienz. Dazu ein neues Grok von SpaceX xAI, trainiert auf Cursor-Sessions, und der Frontier-Code-Benchmark fragt endlich: Würde ein Senior das wirklich mergen? Außerdem: lokale Modelle zum Selbstbauen und ein Security-Paper über Prompt Injection.
Shownotes
Claude Sonnet 5 (Anthropic):Fable 5 zurück (Anthropic):GPT-5.6 Sol/Terra/Luna (OpenAI):Grok 4.5 (SpaceX / XAI):Ornith-1.0, a self-improving family of open-source models for agentic coding:FrontierCode (Cognition): „We have Mythos at Home" – GLM-5.2 in Cyber-Benchmarks (Semgrep): Anthropic Q3-Profit >1 Mrd. $ / IPO (SemiAnalysis): TokenBudgeting (SemiAnalysis):Paper: Prompt Injection as Role Confusion (ICML 2026):Kapitel:
00:00:29.432 Rückkehr und Model-News
00:02:05.090 Anthropic und Fable 5
00:05:49.187 Effizienz statt Modellgröße
00:12:50.659 OpenAI und GPT-5.6
00:18:24.855 Frontier-Code für echte MRs
00:22:07.987 Grok und Datenfragen
00:26:27.185 Open-Weight-Modelle im Fokus
00:30:27.911 Tokenökonomie im Alltag
00:35:03.154 Prompt Injection neu gedacht