DeepSeek leitet V4-Pro-Anfragen vorübergehend auf V4.1-Flash um
DeepSeek hat V4.1-Flash für seine Programmierschnittstelle veröffentlicht. Das multimodale Modell kann Bilder verarbeiten und benötigt weniger Speicher für seinen KV-Zwischenspeicher als die vorherige Generation. Ab dem 14. September werden auch Anfragen an V4-Pro vorübergehend zu V4.1-Flash geleitet.
DeepSeek stellte V4.1-Flash am 10. September 2026 vor. Das Modell besitzt 552 Milliarden Parameter und nutzt eine sogenannte Mixture-of-Experts-Architektur (Expertengemisch), bei der spezialisierte Modellteile unterschiedliche Aufgaben übernehmen. Für Eingaben sind 8 Milliarden Parameter aktiv, für Ausgaben 16 Milliarden. Als Grundlage dient eine neue Kausal-Encoder-Decoder-Architektur.
Nach Angaben des Unternehmens erzielten neue Verfahren für das Vortraining und ein umfangreicheres Nachtraining durch bestärkendes Lernen, bei dem das Modell durch Rückmeldungen lernt, Ergebnisse, die vor führenden Modellen liegen, darunter DeepSeek-V4-Pro.
Unabhängig davon verweist DeepSeek auf Untersuchungen mehrerer Parteien, die V4.1-Flash bei Leistung, Kosten, Geschwindigkeit und Gesamtlaufzeit vor V4-Pro einordnen.
Weniger Speicher für den KV-Zwischenspeicher
Der KV-Zwischenspeicher von V4.1-Flash benötigt laut DeepSeek gegenüber der vorherigen Generation nur ein Viertel des HBM-Speichers und ein Achtel des SSD-Speichers. Weil Treffer im Zwischenspeicher einen großen Anteil an den Kosten von KI-Agenten ausmachen können, soll die Verringerung diese Ausgaben deutlich senken.
V4.1-Flash ist über die DeepSeek API unter der Modellbezeichnung deepseek-flash verfügbar und unterstützt Bilder nativ. V4-Flash und V4-Flash-Vision-Exp wurden eingestellt. Aus Gründen der Kompatibilität leitet DeepSeek Anfragen an deepseek-v4-flash und deepseek-v4-flash-vision-exp vorübergehend an das neue Modell weiter. WorkBuddy einschließlich CodeBuddy sowie OpenCode unterstützen V4.1-Flash.
Übergangslösung bis V4.1-Pro
Ab dem 14. September 2026 um 04:00 Uhr UTC werden sämtliche Anfragen an deepseek-v4-pro bis zur Einführung von V4.1-Pro zu V4.1-Flash geleitet. Dabei gelten die Preise von V4.1-Flash.
Neue Preise und Modellveröffentlichung
Die neue Preisgestaltung gilt seit dem 10. September 2026 um 04:00 Uhr UTC. DeepSeek behält unterschiedliche Tarife für Spitzenzeiten und Zeiten geringerer Auslastung bei. Außerhalb der Spitzenzeiten beträgt der Preis 50 Prozent des Spitzentarifs.
Das Modell ist außerdem bei Hugging Face verfügbar. DeepSeek will mit der quelloffenen Gemeinschaft an weiterer Unterstützung für die Ausführung von V4.1-Flash arbeiten und zusätzliche Möglichkeiten für den Betrieb untersuchen. DeepSeek richtet sich dabei an Interessenten, die eine Großinstallation mit rund 2.000 Grafikprozessoren und einem Speicherverbund planen.
Dieser Artikel wurde KI-generiert erstellt. Die Themenauswahl trifft die Redaktion, die redaktionelle Verantwortung liegt bei KI-Prüfstand.