DeepSeek V4.1 Flash schlägt Kimi K3 im Terminal-Bench
DeepSeek meldet, dass V4.1 Flash mit 552 Milliarden Parametern das eigene Spitzenmodell V4 Pro schlägt – öffentlich belegt ist bislang ein Benchmark.
Kurz gesagt
DeepSeek stellt V4.1 Flash als günstigeres und schnelleres Modell vor und beansprucht mit 90,6 Punkten auf Terminal-Bench 2.1 den Vorsprung vor GPT-5.6 Sol (88,8), Kimi K3 (88,3) und dem eigenen V4 Pro (87,9).
Auf einen Blick
- Release am 10.09.2026: Architektur laut DeepSeek Causal-Encoder-Decoder plus Mixture-of-Experts (MoE).
- 552 Milliarden Parameter gesamt, davon 8 Milliarden aktiv beim Verarbeiten der Eingabe und 16 Milliarden beim Generieren.
- Terminal-Bench 2.1: V4.1 Flash 90,6 – GPT-5.6 Sol 88,8 – Kimi K3 88,3 – V4 Pro 87,9.
- Natives multimodales Bildverständnis gehört laut DeepSeek zum Funktionsumfang des Modells.
- Zu Preis pro Token, beziffertem Geschwindigkeitsgewinn und Lizenz der Gewichte macht der Bericht keine Angaben.
DeepSeek hat am Donnerstag V4.1 Flash vorgestellt und beansprucht damit einen Platz vor Kimi K3 von Moonshot AI. Auf Terminal-Bench 2.1, dem einzigen im Bericht namentlich genannten Test, liegt das Modell bei 90,6 Punkten. Kimi K3 kommt dort auf 88,3, GPT-5.6 Sol von OpenAI auf 88,8 und DeepSeeks bisheriges Spitzenmodell V4 Pro auf 87,9.
Was an der Architektur neu sein soll
DeepSeek beschreibt V4.1 Flash als Kombination aus einer Causal-Encoder-Decoder-Struktur und einem Mixture-of-Experts-Aufbau. Von insgesamt 552 Milliarden Parametern sind demnach 8 Milliarden beim Verarbeiten der Eingabe aktiv und 16 Milliarden beim Erzeugen der Antwort. Diese Trennung ist der technische Hebel hinter dem Versprechen, günstiger und schneller zu arbeiten. Natives multimodales Bildverständnis nennt das Unternehmen ebenfalls als Bestandteil.
Wie belastbar die Benchmark-Aussage ist
Die Angaben stammen von DeepSeek selbst; eine unabhängige Nachmessung liegt nicht vor. Über Terminal-Bench 2.1 hinaus nennt der Bericht nur Kategorien – Programmierung, Cybersicherheit und autonome Agenten-Aufgaben –, aber keine weiteren Testnamen und keine Einzelwerte. Die vier genannten Modelle liegen auf derselben Skala nur wenige Punkte auseinander. Wer daraus einen Führungsanspruch ableitet, stützt sich auf einen einzigen veröffentlichten Wert.
Was offen bleibt
Zum Preis pro Million Token äußert sich der Bericht nicht, ebenso wenig zu einem bezifferten Geschwindigkeitsgewinn gegenüber V4 Pro. Auch ob die Gewichte zum Download bereitstehen und unter welcher Lizenz, bleibt dort offen. Die Aussage, das Modell senke die Inferenzkosten, steht damit ohne Zahl da.
Warum der Zeitpunkt zählt
Chinesische Anbieter entwickeln unter Exportbeschränkungen für ausländische Chips und bei steigenden Hardwarekosten. Effizienz ist dort eine Randbedingung, kein Marketingargument. V4.1 Flash reiht sich in genau diesen Wettbewerb um Preis und Leistung ein.
Häufige Fragen
Was ist DeepSeek V4.1 Flash?
Ein am 10.09.2026 vorgestelltes Modell von DeepSeek mit 552 Milliarden Parametern, das laut Hersteller günstiger und schneller arbeitet als das bisherige Spitzenmodell V4 Pro.
Ist V4.1 Flash besser als Kimi K3?
Auf Terminal-Bench 2.1 gibt DeepSeek 90,6 Punkte für V4.1 Flash und 88,3 für Kimi K3 an. Die Messung stammt vom Hersteller selbst, unabhängige Werte liegen nicht vor.
Was kostet DeepSeek V4.1 Flash?
Der Bericht nennt keinen Preis pro Token. DeepSeek spricht allgemein von niedrigeren Inferenzkosten, ohne dafür eine Zahl zu nennen.