KI funktioniert. Nur selten so, wie es beschrieben wird.
Was generative KI in echten Projekten taugt, was maßlos überschätzt wird und wo Versprechen auf Realität trifft – mit Meinung, für Entscheider und Praktiker.
Fünf Prompt-Vorlagen für die Aufgaben, die im Arbeitsalltag ständig anfallen: Extraktion, Klassifikation, Analyse, Recherche und Texte. Zum Kopieren, Anpassen und Weitergeben ans Team – plus die zwei Querschnittsregeln, die jede Vorlage besser machen.
Qwen3.8-Max mit 2,4 Billionen Parametern, Metas Muse Code, marodierende Modelle als neues Statussymbol der Labs, drei Cloudflare-Releases, ein Rust-Parser von Firecrawl und eine Preiswarnung von DeepSeek – die AI Picks der 32. Kalenderwoche.
Reasoning-Modelle wollen anders angesprochen werden als klassische LLMs – wer beide gleich promptet, verschenkt Qualität oder Geld. Wann welcher Modelltyp die richtige Wahl ist, was ihm hilft, was ihm schadet und welche Few-Shot-Regeln 2026 gelten.
Microsoft bringt ein Security-Modell, zwei Bündnisse streiten für Open Weights – ohne Anthropic, Gemini-Agenten bekommen Hooks und Budgets, und drei Viertel der Wissensarbeiter wollen die Zeit vor ChatGPT zurück. Dazu Inkling-Small, LogWerk 1.4.0 und eine Bürokiste für KI.
CO-STAR, RISEN, RTF – die Akronym-Frameworks von 2023 sind Checklisten, keine Best Practice mehr. Was moderne LLMs stattdessen brauchen, welche Prompt-Tricks du streichen kannst und eine Vorlage, die du direkt an dein Team weiterreichen kannst.
Moonshot hat Wort gehalten: Seit dem 27. Juli liegen die kompletten Kimi-K3-Weights auf Hugging Face – 1,56 Terabyte, pünktlich wie angekündigt. Was die Lizenz erlaubt, was Self-Hosting kostet und warum „offen“ trotzdem nicht Open Source heißt.
Security-Woche in den Picks der 30. KW: OpenAIs Modell bricht aus der Sandbox aus und hackt Hugging Face, Claude Security und Codex Security treten an, die USA streiten über chinesische Open Weights – dazu der große MCP-Umbau, neue Flash-Modelle, Spark 4.2 und AMD Helios.
Anthropic bringt Claude Opus 5 – fast Fable-5-Niveau zum halben Preis, sagt der Hersteller. Artificial Analysis bestätigt inzwischen Platz 1 auf dem Intelligence Index, misst aber 26 % Ersparnis pro Task statt der Hälfte. Eine Einordnung mit Update.
Das Community-Plugin Local REST API bringt inzwischen einen eigenen MCP-Server mit und öffnet Claude Code, Codex und Antigravity den Weg in deinen Obsidian-Vault. Wie die Einrichtung läuft, welche Alternativen es gibt – und warum deine CLAUDE.md und AGENTS.md keine Guardrails ersetzt.
AutoMem lernt Erinnern, Tracebit dreht die Prompt Injection um, Soofi S liefert den Tech-Report, GPT-5.6 Sol löscht, was nicht bei drei auf dem Baum ist, und OpenAI verkauft eine 230-$-Tastatur. Dazu Bonsai 27B, Inkling, LiteParse und LogWerk 1.3.0 – die AI Picks der 29. Kalenderwoche.