Gemini 3.8 FlashGoogle DeepMindGemini 3.8 Flash ist das neue "Arbeitspferd" der Gemini-Familie von Google DeepMind und laut Google bereits der vierte Flash-Release in unter vier Monaten. Ein neues Basismodell gibt es nicht: 3.8 Flash baut ausdrücklich auf Gemini 3.7 Flash auf und wurde vor allem für agentisches Coding und mehrstufiges Reasoning nachtrainiert. Im Software-Engineering-Benchmark DeepSWE v1.1 steigt der Score von 65,3 % auf 73,7 % und liegt damit nur knapp unter Claude Opus 5 (74,0 %), aber deutlich über Claude Sonnet 5 (53,8 %). Der Einführungspreis von $0,75 / $3,75 pro 1 Mio. Input-/Output-Token liegt bei der Hälfte von Gemini 3.6 Flash ($1,50 / $7,50), gilt allerdings nur bis Ende 2026. Dazu kommt ein spürbar höherer Token-Verbrauch: Die realen Kosten pro Aufgabe steigen laut übereinstimmenden Analysen um rund 40 % gegenüber 3.7 Flash. Für effizienz- und latenzkritische Workloads empfiehlt Google selbst, bei 3.7 Flash zu bleiben. Nach unserer Einschätzung ist 3.8 Flash damit in erster Linie ein Coding-Update für Agenten-Workflows und kein Grund für einen Wechsel bei einfachen, latenzkritischen Aufgaben.ParameterUnbekanntVeröffentlichungSeptember 2026TrainingUnbekanntLizenzProprietärMultimodalWeb Search
Qwen 3.8 MaxAlibabaQwen3.8 Max 0902 ist ein aktualisierter Snapshot von Alibabas Flaggschiff Qwen 3.8 Max, veröffentlicht am 1. September 2026. Architektur und Größe bleiben unverändert: ein Sparse-Mixture-of-Experts-Modell (MoE) mit rund 2,4 Billionen Parametern, 1 Mio. Token Kontextfenster, optionalem Thinking-Modus und nativer Verarbeitung von Text, Bild und Video. Der Fortschritt stammt laut Qwen-Team ausschließlich aus zusätzlichem Post-Training auf Coding- und Cowork-Aufgaben. Im Front-End-Ranking der CodeArena legt der Snapshot um 22 Punkte auf 1.691 zu und übernimmt damit Platz 1. Alibaba sieht das Modell in mehreren Coding-Benchmarks vor Claude Opus 5; in der Gesamtwertung unabhängiger Tests liegt es je nach Aufgabe aber knapp vor oder hinter Opus 5. Die Stärke bei Coding- und Agenten-Aufgaben ist also real, eine durchgängige Führung sehen wir nicht. Preislich bleibt es bei $2 / $6 pro 1 Mio. Input-/Output-Token und damit deutlich unter Opus 5 ($5 / $25).Parameter2.400 Mrd.VeröffentlichungSeptember 2026TrainingUnbekanntLizenzProprietärMultimodal
Claude Fable 5.1AnthropicClaude Fable 5.1 ist der Nachfolger von Claude Fable 5 und damit das neue Spitzenmodell von Anthropic. Wie der Vorgänger ist es auf anspruchsvolles Reasoning und langlaufende Aufgaben als KI-Agent ausgelegt: autonomes Coding über Stunden, mehrstufige Recherchen sowie Dokumenten-, Tabellen- und Slide-Aufgaben. Gegenüber Fable 5 legt das Modell laut Anthropic vor allem bei agentischem Coding zu (Terminal-Bench 4.0: 55,8 % statt 42,0 %). Die Token-Preise bleiben mit $10 / $50 pro 1 Mio. Input-/Output-Token unverändert, Cache-Reads kosten mit $0,25 pro 1 Mio. Token aber nur noch ein Viertel. Gerade bei agentischen Workloads mit viel wiederholtem Kontext sinken die realen Kosten dadurch spürbar. Anthropic selbst empfiehlt für die meisten Aufgaben weiterhin das halb so teure Claude Opus 5 ($5 / $25). Fable 5.1 lohnt sich nach unserer Einschätzung erst dann, wenn Opus 5 auch bei hohem Effort an seine Grenzen stößt. Das inhaltsgleiche Claude Mythos 5.1 mit anderen Sicherheitsstufen bleibt ausgewählten Organisationen über das Trusted-Access-Programm "Project Glasswing" vorbehalten.ParameterUnbekanntVeröffentlichungSeptember 2026TrainingUnbekanntLizenzProprietärMultimodal