DeepSeek V4.1-Flash es más pequeño, más rápido y ya supera en rendimiento al modelo Pro.
DeepSeek mantiene su ritmo de desarrollo acelerado. Han presentado el modelo DeepSeek-V4.1-Flash, el más pequeño de su nueva familia de arquitectura, que no solo se centra en un precio más bajo, sino también en una mayor velocidad y un mejor rendimiento.
DeepSeek afirma que la nueva arquitectura está diseñada para una ejecución de modelos más rápida, un mayor rendimiento y una escalabilidad más sencilla a sistemas mucho más grandes. La versión 4.1-Flash ofrece un primer vistazo a la tecnología que probablemente sustentará los futuros modelos de mayor tamaño de la compañía.
Aún más interesante es la comparación con la versión actual de DeepSeek-V4 Pro. Según sus datos, la versión 4.1-Flash ha superado a la versión Pro en rendimiento, velocidad, coste y tiempo total de ejecución. Por lo tanto, hasta la llegada de la versión 4.1 Pro, las solicitudes destinadas al modelo Pro actual se redirigirán a la versión 4.1-Flash y se facturarán con la tarifa reducida de la versión Flash.
El modelo también ofrece soporte nativo para contenido multimodal, lo que significa que la nueva arquitectura ya no se centra únicamente en el procesamiento de texto. Este es un paso importante para DeepSeek, que busca competir más directamente con los sistemas de OpenAI, Google y Anthropic en tareas visuales y basadas en agentes más exigentes.
La versión 4.1 de Flash también incluye nuevos precios para la API. Durante las horas de menor actividad, un millón de tokens de entrada sin almacenamiento en caché costará aproximadamente 1 yuan (0,13 €), mientras que un millón de tokens de salida costará 4 yuanes (0,42 €). Durante las horas punta, los precios se duplicarán.
DeepSeek también se está preparando para una oferta pública inicial de acciones en el mercado STAR de Shanghái.



















