Zum Inhalt springen
/ Home / Knowledge / KI-Modelle-Update KW 38: DeepSeek V4.1 Flash, Sakana Fugu Ultra v2 und Tencent Hy4

KI-Modelle-Update KW 38: DeepSeek V4.1 Flash, Sakana Fugu Ultra v2 und Tencent Hy4

Andreas Olbricht
KI: Künstliche Intelligenz-Experte
OIT GmbH
Profil ansehen

In der Kalenderwoche 38 (8.–15. September 2026) ging es bei den KI-Modellen erneut Schlag auf Schlag. Die spannendsten echten Neuigkeiten der letzten Tage: ein sehr günstiges, offenes Modell von DeepSeek mit riesigem Kontextfenster, ein ungewöhnlicher Orchestrierungs-Ansatz von Sakana AI und ein weiteres chinesisches Modell im Preview. Wir fassen zusammen, was passiert ist – und was es konkret für Unternehmen bedeutet.

Die Neuigkeiten der Woche im Überblick

1. DeepSeek V4.1 Flash – günstig, offen, mit Bildverständnis
Anbieter: DeepSeek · veröffentlicht 10.09.2026
DeepSeek hat V4.1 Flash live geschaltet: ein Mixture-of-Experts-Modell mit 552 Mrd. Parametern, nativem Bildverständnis, 1 Mio. Token Kontext und MIT-Lizenz (offene Gewichte). Die Preise sind aggressiv – rund 0,15 $ pro Mio. Eingabe- und 0,60 $ pro Mio. Ausgabe-Token außerhalb der Stoßzeiten (0,30 $ / 1,20 $ zu Spitzenzeiten). Seit dem 14.09. wird zudem der komplette Verkehr des bisherigen V4 Pro von V4.1 Flash bedient und zu Flash-Preisen abgerechnet, bis ein V4.1 Pro erscheint.
Was heißt das für Unternehmen: Ein leistungsfähiges, offenes Modell mit Bild-Input und sehr großem Kontext zu Mini-Preisen ist attraktiv für DSGVO-konformes Self-Hosting oder den Betrieb über ein eigenes Gateway. Gleichzeitig zeigt der stille Austausch hinter dem Namen „V4 Pro“: Wer direkt auf einen Modellnamen setzt, kann von heute auf morgen ein anderes Modell bekommen. Eine Abstraktionsschicht schützt davor.
2. Sakana AI: Fugu Ultra v2 & Fugu Max – Frontier-Qualität ohne Frontier-Modell
Anbieter: Sakana AI · veröffentlicht 11.09.2026
Sakana AI ist kein klassisches Einzelmodell, sondern eine gelernte Multi-Agent-Orchestrierung: Ein Sprachmodell verteilt Aufgaben über einen Pool spezialisierter Modelle und ruft sich rekursiv selbst auf. Fugu Ultra v2 (1 Mio. Token Kontext, 128K Output, Text-, Bild- und PDF-Eingabe, Websuche) erreichte auf dem Benchmark Chartography für visuelles Reasoning 48,3 Punkte – gegenüber 27,3 für Anthropics Opus 5 und 29,5 für Fable 5. Preis: rund 5 $ / 30 $ pro Mio. Token; die günstigere Variante heißt Fugu Max.
Was heißt das für Unternehmen: Geschickt orchestrierte, teils offene Modelle können teure Einzel-Frontier-Modelle bei bestimmten Aufgaben schlagen. Genau dieses Prinzip – die richtige Aufgabe an das richtige Modell routen – steckt hinter einem KI-Gateway und senkt Kosten bei gleicher oder besserer Qualität.
3. Tencent Hy4 Preview – noch ein Anbieter mehr
Anbieter: Tencent Cloud · als Preview gelistet 12.09.2026
Mit Tencents Hy4 Preview ist ein weiteres chinesisches Modell in den einschlägigen Gateways und Vergleichslisten aufgetaucht. Es befindet sich noch im Vorschau-Stadium, verbreitert aber die ohnehin schon große Anbietervielfalt weiter.
Was heißt das für Unternehmen: Der Markt wird voller und schnelllebiger. Für den Alltag zählt weniger, welches Modell heute vorne liegt, sondern wie leicht man wechseln kann, wenn ein besseres oder günstigeres erscheint.
4. Einordnung: „Model Fatigue“ statt großer Sprünge
Kontext · Anfang September 2026
Bereits Anfang des Monats kam eine ganze Flaggschiff-Welle: Anthropic Claude Fable 5.1, OpenAI GPT-6 Astra und Google Gemini 3.8 Flash. In der Branche ist inzwischen von „Model Fatigue“ die Rede – neue Versionen und Preisrutsche folgen im Wochentakt. Die Neuigkeiten dieser Woche reihen sich genau da ein: kein spektakulärer Qualitätssprung, aber spürbar mehr Auswahl und weiter fallende Preise.
Was heißt das für Unternehmen: Wer sich fest an einen einzelnen Anbieter bindet, riskiert Kosten- und Leistungsnachteile. Eine modellunabhängige Schicht hält den Wechsel jederzeit offen – ohne dass Anwendungen umgebaut werden müssen.

Kompakt: die neuen Modelle dieser Woche

Modell Anbieter Kontext Besonderheit Preis /1M (In/Out)
V4.1 Flash DeepSeek 1 Mio. 552B MoE, native Vision, MIT-Lizenz ab 0,15 $ / 0,60 $
Fugu Ultra v2 Sakana AI 1 Mio. Multi-Agent-Orchestrierung 5 $ / 30 $
Hy4 (Preview) Tencent neues Preview-Modell n. v.

Der rote Faden: Modellunabhängigkeit

Eine vollständige, laufend gepflegte Übersicht der wichtigsten aktuellen Sprachmodelle findest du in unserer Hub-Seite Frontier-LLM-Modelle im Vergleich. Und wenn du diese Modellvielfalt praktisch nutzen willst, ohne dich an einen Anbieter zu ketten: Das OIT KI Gateway ist modellunabhängig, DSGVO-konform und gibt dir volle Kostenkontrolle – ein Modellwechsel wird damit zur Konfigurationssache statt zum Projekt.

OIT KI Gateway entdecken →

Häufige Fragen (FAQ)

Was ist die wichtigste KI-Modell-Neuigkeit in KW 38/2026?

Am auffälligsten war DeepSeek V4.1 Flash (10.09.2026): ein offenes Modell mit 1 Mio. Token Kontext, nativem Bildverständnis und sehr niedrigen Preisen, das ab dem 14.09. auch den bisherigen V4-Pro-Verkehr übernimmt.

Was macht Sakana AI Fugu Ultra v2 besonders?

Fugu ist kein einzelnes Modell, sondern eine gelernte Orchestrierung, die Aufgaben über einen Pool spezialisierter Modelle verteilt. Auf dem Chartography-Benchmark für visuelles Reasoning übertraf Fugu Ultra v2 sogar Frontier-Modelle wie Opus 5 und Fable 5.

Sollten Unternehmen bei jedem neuen Modell wechseln?

Nein. Wichtiger als das jeweils aktuell beste Modell ist die Fähigkeit, unkompliziert wechseln zu können. Eine modellunabhängige Schicht wie ein KI-Gateway macht Wechsel zur Konfigurationssache und schützt vor Anbieter-Bindung.


Andreas Olbricht
Dein Ansprechpartner
OIT GmbH
Profil ansehen

Hast du eine Frage zu diesem Artikel?

Schreib uns – wir antworten in der Regel innerhalb eines Werktages.