Actualidad IA generativa

DeepSeek V4.1-Flash supera a su modelo Pro usando menos memoria y baja el precio

DeepSeek
10 septiembre 2026

Qué han lanzado

DeepSeek ha lanzado V4.1-Flash, un modelo multimodal con una nueva arquitectura más rápida y eficiente.

Qué cambia

Consume mucha menos memoria para la caché, reduce los costes de API y sustituirá temporalmente a V4-Pro en las solicitudes existentes.

DeepSeek lanza un modelo multimodal más rápido y económico que activa solo una parte de sus 552.000 millones de parámetros y sustituirá temporalmente a V4-Pro.

DeepSeek ha lanzado V4.1-Flash, el primer modelo de menor tamaño de su nueva familia de arquitectura y con comprensión visual nativa. Está disponible en la API mediante el identificador deepseek-flash.

El modelo utiliza una arquitectura causal de codificador y decodificador con 552.000 millones de parámetros totales, pero activa 8.000 millones al procesar la entrada y 16.000 millones al generar la respuesta. DeepSeek afirma que este diseño mejora la velocidad y el rendimiento sin elevar en la misma proporción el coste de cálculo.

Según las pruebas publicadas por la compañía, V4.1-Flash supera a V4-Pro en rendimiento, coste, velocidad y tiempo total de ejecución. También incorpora capacidades multimodales de forma nativa, por lo que puede comprender texto e imágenes desde el mismo modelo.

La caché necesaria para mantener contexto consume una cuarta parte de la memoria HBM y una octava parte del almacenamiento SSD respecto a la generación anterior. Esta reducción busca abaratar especialmente los agentes y aplicaciones que reutilizan grandes cantidades de contexto.

DeepSeek ha retirado V4-Flash y V4-Flash-Vision-Exp, aunque sus nombres seguirán dirigiéndose temporalmente al nuevo modelo. Desde el 14 de septiembre, las solicitudes a V4-Pro también pasarán a V4.1-Flash y usarán sus tarifas hasta la llegada de V4.1-Pro.

El modelo se publica además con pesos abiertos y mantiene tarifas diferentes para horas punta y valle, con un descuento del 50 % fuera de las horas de mayor demanda. WorkBuddy, CodeBuddy y OpenCode ya ofrecen compatibilidad con esta versión.

Ver más