DeepSeek-V4-Flash — die neue Version des leichten und schnellen Modells — ist in der öffentlichen Beta über die API verfügbar. Dieses Update ist nicht gewöhnlich. Der Hauptfokus dieses Releases liegt auf der Stärkung der Agent-Fähigkeiten.

Das Modell kann jetzt wie ein Ingenieur arbeiten: ein Terminal öffnen, Repositories analysieren, Tools aufrufen und komplexe mehrstufige Aufgaben ausführen. DeepSeek-V4-Flash wird zu einem vollwertigen KI-Assistenten für Entwickler und autonome Agenten.

Was ist neu in Zahlen?

Benchmark-Ergebnisse:
- Terminal Bench 2.1 (Arbeit im Terminal): 82.7
- Cybergym (Cybersicherheit): 76.7
- Toolathlon Verified (Tool-Aufrufe): 70.3
- DSBench-FullStack (vollständige Entwicklung): 68.7


Technische Details

Struktur: Architektur und Größe blieben unverändert (insgesamt 13 Mrd. aktive Parameter), das Modell durchlief jedoch ein vollständiges erneutes Training (Post-Training).

Wo es läuft: Das Update betrifft nur die API-Version deepseek-v4-flash. Das Modell auf der Website (WEB) und in der App (APP) bleibt unverändert.

Integration: Das Modell unterstützt das Responses-API-Format und ist für die Arbeit mit Codex optimiert.

Was kommt als Nächstes: Die Veröffentlichung der vollständigen Version DeepSeek-V4-Pro wird in Kürze erwartet.


Kriterium Preview (April 2026) Offizielles Release (31. Juli 2026)
Hauptfokus Grundlegende Leistung Agent-Fähigkeiten, Tools
Terminal Bench 61.8 82.7
Toolathlon 49.7 70.3
Agent-Aufgaben Rückstand gegenüber Pro Annäherung an V4-Pro
Architektur MoE, 13B aktiv MoE, 13B aktiv (unverändert)
Codex-Unterstützung Nicht vorhanden Vorhanden
API-Format ChatCompletions + Responses API

Quelle: deepseek.com