Zum Inhalt springen
/ Home / Knowledge / KI-Modelle-Update KW 35: DeepSeek wird multimodal, GLM-5.3 setzt Open-Source-Bestmarken

KI-Modelle-Update KW 35: DeepSeek wird multimodal, GLM-5.3 setzt Open-Source-Bestmarken

Tom Köhne
KI: Künstliche Intelligenz-Experte
OIT GmbH
Profil ansehen

Auch diese Woche hat sich bei den großen KI-Modellen einiges getan – vor allem im offenen und im multimodalen Lager. Hier die wichtigsten Entwicklungen der vergangenen Tage (KW 34/35) kompakt eingeordnet, jeweils mit Blick darauf, was das konkret für Unternehmen heißt.

DeepSeek wird multimodal: V4 Flash Vision (Experimental)

Anbieter: DeepSeek · veröffentlicht 21.08.2026. DeepSeek steigt erstmals in den Wettbewerb um multimodale Modelle ein. V4 Flash Vision Exp versteht jetzt auch Bilder – also Dokumente, Charts, Screenshots und visuelle Fragestellungen – und behält beim Text die bekannten Stärken (Agenten, Reasoning, Weltwissen). Technisch ist es ein sparsames Mixture-of-Experts-Modell (13 Mrd. aktive von 284 Mrd. Parametern) mit rund 1 Mio. Token Kontext. Laut DeepSeek rückt es bei multimodalen Agenten-Benchmarks nah an Anthropics Spitzenmodell heran – bei einem Preis von nur rund 0,22 $ pro Mio. Input- und 0,66 $ pro Mio. Output-Token.

Was heißt das für Unternehmen? Bild- und Dokumentenverständnis auf hohem Niveau wird nochmals deutlich günstiger. Für Anwendungsfälle wie automatische Rechnungs- und Belegprüfung, Formularerfassung oder das Auslesen von Diagrammen entsteht eine sehr preiswerte Alternative zu den etablierten Premium-Modellen – noch ist es allerdings als „experimental" markiert und für Produktivbetrieb nur mit Tests einsetzbar.

GLM-5.3: neue Open-Source-Bestmarke bei Coding

Anbieter: Z.ai · Mitte August vorgestellt, in dieser Woche breiter verfügbar. GLM-5.3 nutzt dieselbe 743-Mrd.-Parameter-MoE-Basis wie der Vorgänger, holt die Fortschritte aber komplett aus verbessertem Post-Training. Das Ergebnis ist nach Angaben von Z.ai das derzeit stärkste offene Modell fürs Programmieren: In Coding-Agenten-Benchmarks (u. a. Terminal-Bench 3.0, DeepSWE) legt es massiv gegenüber GLM-5.2 zu und setzt neue Open-Source-Bestwerte. Der Kontext liegt bei 1 Mio. Token. Die Gewichte sollen nach einer Sicherheitsprüfung in den kommenden Wochen frei verfügbar werden.

Was heißt das für Unternehmen? Wer aus Datenschutz- oder Kostengründen auf selbst gehostete Modelle setzt, bekommt eine ernstzunehmende Alternative für Entwickler-Workflows und Automatisierung. Zugleich zeigt der Sprung bei sicherheitsrelevanten (Cyber-)Fähigkeiten, dass offene Spitzenmodelle im Governance- und Sicherheitskonzept mitgedacht werden müssen.

Tencent Hy-MT2: spezialisierte Übersetzungsmodelle

Anbieter: Tencent · 19.–20.08.2026. Tencent hat mit der Hy-MT2-Reihe (Größen von 1,8 Mrd. bis 30 Mrd. Parametern) eine Familie kleiner, auf Übersetzung spezialisierter Modelle veröffentlicht. Der Trend: nicht nur immer größere Allrounder, sondern kompakte Modelle für eng umrissene Aufgaben.

Was heißt das für Unternehmen? Für klar abgegrenzte Aufgaben wie Übersetzung sind kleine Spezialmodelle oft schneller, günstiger und leichter lokal zu betreiben als ein universelles Frontier-Modell. Für mehrsprachige Shops, Support oder Dokumentation lohnt der Vergleich.

Preise & Ausblick

Der Preiswettbewerb bleibt hart: Bei den großen Anbietern liegt die Untergrenze für gängige API-Modelle inzwischen bei rund 0,20 $ pro Mio. Input-Token (OpenAI GPT-5.6 „Luna"). Parallel tauchte diese Woche mit „Ox Alpha" ein noch nicht zugeordnetes Testmodell auf einer offenen Plattform auf – ein Muster, das häufig einem größeren Release vorausgeht. Kurz gesagt: gleiche oder bessere Leistung für weniger Geld, und immer mehr Modalitäten im Standard.

Was heißt das für Unternehmen? Wer heute eine Modellwahl trifft, sollte sie nicht auf Jahre festzurren. Sinnvoller ist eine Architektur, in der sich Modelle je nach Aufgabe und Preis austauschen lassen – genau dafür ist ein zentrales OIT KI Gateway gedacht: Ein Zugang, viele Modelle, volle Kostenkontrolle und Datenschutz.

Überblick behalten

Einen laufend gepflegten Vergleich der führenden Modelle – Claude, GPT, Gemini, Grok, Llama, Mistral, DeepSeek & Co. – finden Sie in unserer Übersicht Welches KI-Modell ist das beste? LLM-Vergleich 2026. Wenn Sie diese Modelle sicher und wirtschaftlich in Ihrem Unternehmen einsetzen möchten, unterstützt Sie das OIT KI Gateway als zentrale, DSGVO-konforme Schaltstelle.

Stand: 25.08.2026. Quellen u. a.: Caixin Global, Seeking Alpha und DeepSeek API-Doku (DeepSeek V4 Flash Vision); Unite.AI und DataNorth (GLM-5.3); Price Per Token Release-Ledger.

Tom Köhne
Dein Ansprechpartner
OIT GmbH
Profil ansehen

Hast du eine Frage zu diesem Artikel?

Schreib uns – wir antworten in der Regel innerhalb eines Werktages.