Modell-Woche im Minutentakt: Microsoft wirft sieben MAI-Modelle ab, Google bringt Gemma 4 12B auf den Laptop, JetBrains Mellum2 und Holo3.1 stärken lokale KI – dazu versteckte API-Kosten, Nvidias RTX Spark und Anthropics Glasswing-PR. Die 13 AI-Picks der 23. Kalenderwoche.
Das Modell soll vor der Antwort kurz planen, Annahmen offenlegen, Edge Cases benennen. Klingt vernünftig – und war es lange auch. Stand Juni 2026 ist die
MiniMax startet M3 als „erstes Open-Weight-Modell" mit Coding, 1M-Context und Multimodalität. Nur fehlen zum Launch die Gewichte, die offizielle Parameterzahl und jede unabhängige Benchmark-Messung. Eine Einordnung zwischen echter Substanz und Marketing-Gegenwartsform.
DeepSeek macht den 75-%-Rabatt auf V4-Pro permanent, Mistral konsolidiert Le Chat in Vibe, Anthropic veröffentlicht ein Zero-Trust-Framework für Agenten, und China verschärft Reisebeschränkungen für KI-Talente.
Das wird etwas länger heute – die Recherche war sehr ergiebig und obendrauf kann ich auch noch reichlich eigene Erfahrungswerte beisteuern.
Der Holzhammer kurz und bündig:
Anthropic veröffentlicht Claude Opus 4.8 zum gleichen Preis wie den Vorgänger und macht „Ehrlichkeit“ zum Hauptargument. Ein Inkrement mit ein paar praktisch relevanten Features drumherum – und Benchmarks, die ausnahmslos aus dem eigenen Haus kommen.
Vorweg, weil es beim Thema sonst sofort rutschig wird: Ich nutze Claude Code im Max 5x Plan, primär für Python, Handlebars, PHP und TypeScript, gelegentlich
Ich schreibe diesen Beitrag nicht, weil Persona Prompting ein neues Thema wäre. Ich schreibe ihn, weil die Empfehlung, einem LLM eine Expertenrolle zuzuweisen, in den
Potzblitz: Es war I/O-Woche, und das färbt natürlich ab. Google hat ausgepackt, Anthropic hat in London zurückgespielt, Cursor hat mittendrin Composer 2.5