DeepSeek V4.1-Flash ist kleiner, schneller und übertrifft das Pro-Modell bereits.
DeepSeek setzt sein aggressives Entwicklungstempo fort. Das Unternehmen hat das DeepSeek-V4.1-Flash-Modell vorgestellt, das kleinste seiner neuen Architekturfamilie, das nicht nur auf einen niedrigeren Preis, sondern auch auf höhere Geschwindigkeit und bessere Leistung setzt.
DeepSeek zufolge ist die neue Architektur auf schnellere Modellausführung, höheren Durchsatz und einfachere Skalierung auf deutlich größere Systeme ausgelegt. V4.1-Flash bietet einen ersten Einblick in die Technologie, die voraussichtlich die Grundlage für die zukünftigen größeren Modelle des Unternehmens bilden wird.
Noch interessanter ist der Vergleich mit dem bestehenden DeepSeek-V4 Pro. Laut Herstellerangaben übertrifft V4.1-Flash die Pro-Version hinsichtlich Leistung, Geschwindigkeit, Kosten und Gesamtlaufzeit. Bis zum Erscheinen von V4.1 Pro werden Anfragen für das aktuelle Pro-Modell daher an V4.1-Flash weitergeleitet und zum günstigeren Flash-Tarif abgerechnet.
Das Modell bietet zudem native Unterstützung für multimodale Inhalte, wodurch die neue Architektur nicht mehr ausschließlich auf die Textverarbeitung fokussiert ist. Dies ist ein wichtiger Schritt für DeepSeek, das damit in anspruchsvolleren agentenbasierten und visuellen Aufgaben direkter mit Systemen von OpenAI, Google und Anthropic konkurrieren will.
V4.1-Flash beinhaltet auch eine neue API-Preisgestaltung. Außerhalb der Spitzenzeiten kostet eine Million eingegebener Token ohne Caching etwa 1 Yuan (0,13 €), während eine Million ausgegebener Token 4 Yuan (0,42 €) kostet. Zu Spitzenzeiten verdoppeln sich die Preise.
DeepSeek bereitet außerdem einen Börsengang am Shanghaier STAR Market vor.


















