Mehr als ein Jahr nachdem sein R1-Reasoning-Modell Schockwellen durch die globalen Technologiemärkte gesendet hatte, hat das chinesische KI-Startup DeepSeek eine Vorschau auf sein V4-Modell enthüllt — die bedeutendste Produkteinführung des Unternehmens seit dieser viralen Veröffentlichung. Das neue Modell ist quelloffen und angepasst, um auf Huaweis Ascend KI-Prozessoren zu laufen, eine Abkehr von der bisherigen Abhängigkeit des Unternehmens von Nvidia $NVDA-Chips.
Das V4 kommt in zwei Versionen: DeepSeek-V4-Pro, mit insgesamt 1,6 Billionen Parametern und 49 Milliarden aktiven Parametern, und DeepSeek-V4-Flash, mit 284 Milliarden Gesamtparametern und 13 Milliarden aktiven Parametern. Beide unterstützen eine Kontextlänge von einer Million Tokens. DeepSeek sagte, dass die Pro-Version andere quelloffene Modelle in Weltwissen-Benchmarks übertrifft, nur hinter Googles geschlossenem Gemini-3.1-Pro.
Laut Reuters, sagte Huawei, es habe eng mit DeepSeek zusammengearbeitet, um die V4-Kompatibilität über alle Ebenen seines Ascend-Produktportfolios sicherzustellen, und bestätigte separat, dass sein Ascend-gestützter Rechencluster in der Lage ist, das neue Modell auszuführen. Welcher Teil des V4-Trainings auf Huawei-Hardware im Vergleich zu Nvidia $NVDA-Chips beruhte, ist nicht bekannt, obwohl Huawei zugab, dass seine Prozessoren im Prozess eine Rolle spielten.