
V4.1-Flash de DeepSeek supera a su modelo insignia V4-Pro al reducir el KV cache 4x
DeepSeek lanzó V4.1-Flash, un MoE de 552B parámetros bajo licencia MIT que activa 8B parámetros para entrada y 16B para generación, y obtiene 74.2 en DeepSWE v1.1 frente a los 54.4 de V4-Flash. La verdadera señal es económica: su KV cache es 4x más pequeño que el de V4-Flash y 437x más pequeño que el de V1, reduciendo el HBM a una cuarta parte, y DeepSeek retirará V4-Pro al redirigir ese tráfico al modelo Flash más barato el 14 de septiembre. Aún queda por detrás de V4-Pro en benchmarks de conocimiento como SimpleQA-Verified, con 42.3 frente a 55.2, por lo que el compromiso prioriza costo y velocidad sobre recuperación profunda.
Fuente: deepseek.com ↗