Seit 2012 im Online-Marketing. Heute: Prompt Engineering, KI-Agenten und Automatisierung im Agenturalltag. Was davon wirklich funktioniert – und was nicht – steht hier.
Drei aktuelle Studien zeigen dasselbe Muster: Bei KI-Agenten entscheiden Datenqualität, enger Scope und klare Ownership oft mehr als die Modellwahl. Was McKinsey, Salesforce und Teradata dazu messen – und welche drei Fragen vor dem Modellnamen gehören.
Anthropic veröffentlicht Claude Fable 5.1 und Mythos 5.1 als identisches Modell mit verschiedenen Safeguards. Auf Terminal-Bench 4.0 trennen sie 5,1 Punkte – nur wurden dafür noch die älteren, gröberen Filter gemessen.
Drei chinesische Open-Weights-Modelle in drei Tagen, zwei Dokumenten-Parser, ein gekaperter Claude Code Auto Mode, OpenAIs Cursor-Rauswurf nach der SpaceXAI-Übernahme und Metas geplatztes Project OT – der Wochenrückblick der 35. KW.
Auto Mode ist seit Mitte August Default in Claude Code – der Agent fragt nicht mehr bei jedem Schritt. Warum ich ihn auf meinem t01.li-Stack machen lasse, wo der eigentliche Steuerungshebel liegt und wann Accept edits die bessere Wahl bleibt.
ChatGPT sucht seit dem 8. August gezielt innerhalb einzelner Domains, Hetzner erklärt schonungslos, warum sein Inference-Experiment einknickte, und auf OpenRouter verschenkt ein anonymes Lab Frontier-Kapazität. Dazu Multica, dessen Lizenz nur so aussieht wie Apache 2.0.
Seit August 2026 wird Art. 4 EU AI Act durchgesetzt – aber anders, als viele Schulungsanbieter behaupten. Keine Zertifikatspflicht, kein Einheitskurs. Was KMU wirklich tun müssen: rollenbezogen befähigen, schlank dokumentieren. Ein Reality-Check mit Rechtsstand August 2026.
Muse Glimmer, Qwen3.8-27B, Grok 4.6 und GLM-5.3 in einer Woche. Auffällig ist nicht, wer im Benchmark vorn liegt, sondern dass fast jeder Release über Tokens pro Aufgabe argumentiert. Dazu Preisbewegungen in beide Richtungen und ein Weight-Delay aus Sicherheitsgründen.
Fünf Prompt-Vorlagen für die Aufgaben, die im Arbeitsalltag ständig anfallen: Extraktion, Klassifikation, Analyse, Recherche und Texte. Zum Kopieren, Anpassen und Weitergeben ans Team – plus die zwei Querschnittsregeln, die jede Vorlage besser machen.
Qwen3.8-Max mit 2,4 Billionen Parametern, Metas Muse Code, marodierende Modelle als neues Statussymbol der Labs, drei Cloudflare-Releases, ein Rust-Parser von Firecrawl und eine Preiswarnung von DeepSeek – die AI Picks der 32. Kalenderwoche.
Reasoning-Modelle wollen anders angesprochen werden als klassische LLMs – wer beide gleich promptet, verschenkt Qualität oder Geld. Wann welcher Modelltyp die richtige Wahl ist, was ihm hilft, was ihm schadet und welche Few-Shot-Regeln 2026 gelten.