03 · DeepSeek
DeepSeek aprieta coste e inferencia con V4.1-Flash y retira sus modelos anteriores

DeepSeek ha puesto en marcha DeepSeek-V4.1-Flash en su API con soporte multimodal nativo, un modelo pensado para mayor capacidad, inferencia más rápida y más rendimiento, que sustituye a V4-Flash y V4-Flash-Vision-Exp, ya retirados.
Por qué importa
La multimodalidad nativa de V4.1 Flash y su caché KV más pequeña abaratan las cargas que antes pedían dos integraciones y pueden arrastrar a los rivales a un pulso de precios. El enrutado automático del 14 de septiembre convierte, para quien siga en V4 Pro, no hacer nada en aceptar la nueva tarifa.
Los detalles
- DeepSeek-V4.1-Flash ya está disponible en la API de DeepSeek con soporte multimodal nativo.
- El modelo sustituye a V4-Flash y V4-Flash-Vision-Exp, que han sido retirados.
- Utiliza una arquitectura asimétrica que busca aportar más inteligencia a menor coste.
- Su caché KV más pequeña se traduce en mayores ahorros para los usuarios.
- Está diseñado para mayor capacidad, inferencia más rápida, más rendimiento y escalado a modelos mayores.