DeepSeek V4.1-Flash è più piccolo, più veloce e supera già le prestazioni del modello Pro.
DeepSeek prosegue con il suo ritmo di sviluppo serrato. Ha presentato il modello DeepSeek-V4.1-Flash, il più piccolo della sua nuova famiglia di architetture, che punta non solo a un prezzo inferiore, ma anche a una maggiore velocità e prestazioni migliori.
DeepSeek afferma che la nuova architettura è progettata per un'esecuzione più rapida dei modelli, una maggiore produttività e una scalabilità più semplice verso sistemi molto più grandi. La versione 4.1-Flash offre una prima anteprima della tecnologia che probabilmente sarà alla base dei futuri modelli più complessi dell'azienda.
Ancora più interessante è il confronto con l'attuale DeepSeek-V4 Pro. Secondo i loro dati, la versione V4.1-Flash ha superato la versione Pro in termini di prestazioni, velocità, costo e tempo totale di esecuzione. In attesa dell'arrivo della V4.1 Pro, le richieste destinate all'attuale modello Pro verranno quindi reindirizzate alla V4.1-Flash e fatturate con la tariffa inferiore della versione Flash.
Il modello introduce anche il supporto nativo per i contenuti multimodali, il che significa che la nuova architettura non è più focalizzata esclusivamente sull'elaborazione del testo. Questo è un passo importante per DeepSeek, che mira a competere più direttamente con i sistemi di OpenAI, Google e Anthropic in attività visive e basate su agenti più complesse.
La versione 4.1 di Flash introduce anche nuove tariffe API. Nelle ore non di punta, un milione di token di input senza caching costerà circa 1 yuan (0,13 €), mentre un milione di token di output costerà 4 yuan (0,42 €). Nelle ore di punta, i prezzi raddoppieranno.
DeepSeek si sta inoltre preparando per un'offerta pubblica iniziale di azioni sul mercato STAR di Shanghai.




















