Google bringt Computer Use in Gemini 3.5 Flash — Entwickler bekommen eine dritte Wahl für GUI-Agents. Das Qwen-Team zeigt mit dem Verification-Horizon-Paper, warum der Engpass bei KI-Code nicht mehr das Generieren ist, sondern das Prüfen. GLM 5.2 von Zhipu AI übertrifft Claude in Benchmarks und beweist: Chinesische Modelle sind auf Augenhöhe. Dazu: Meta baut seine komplette KI-Infrastruktur (Chips, Vision, Superintelligenz) und neue ROI-Zahlen belegen, dass KI im Kundenservice funktioniert.
Quellen
- Google DeepMind — Introducing computer use in Gemini 3.5 Flash
- The Verification Horizon — No Silver Bullet for Coding Agent Rewards (arXiv)
- GLM 5.2 — Artificial Analysis Intelligence Index
- GauntletBench — Re-evaluating Agent Capabilities (arXiv)
- Fin AI — ROI of AI Customer Service 2026 Benchmarks
- Meta — MTIA Custom AI Chips
- Meta — SAM 3.1 Real-Time Video Detection
- Meta — Muse Spark Personal Superintelligence
Zur Episode auf ailissy.de