DeepSeek publicó V4 Flash 0731 como beta pública el 31 de julio. La compañía dijo que conservaba la arquitectura y el tamaño de la versión preliminar anterior e incorporaba una nueva fase posterior al entrenamiento. El lanzamiento estaba disponible mediante la API y no sustituyó el modelo Pro de DeepSeek en la aplicación de consumo, el servicio web ni la API.
El modelo admite una ventana de contexto de un millón de tokens y una salida máxima de 384.000 tokens, según la documentación de DeepSeek. También incluye Responses API y adaptaciones orientadas a Codex. Las especificaciones abren casos de uso con documentos largos y programación, pero aceptar un contexto muy grande no demuestra con qué eficacia se utiliza cada parte.
Los precios oficiales por millón de tokens eran de 0,0028 dólares para entrada encontrada en caché, 0,14 dólares para entrada sin coincidencia y 0,28 dólares para salida. La gran diferencia entre entrada almacenada y nueva convierte la forma de la carga en un factor central. Una tarifa destacada basada en coincidencias de caché no describe un trabajo que envía contexto nuevo en cada ocasión.
Los precios brutos por token tampoco incluyen latencia, tokens de razonamiento, reintentos, llamadas fallidas o calidad del resultado. Un modelo puede ser barato por token pero caro por respuesta aceptada si exige muchas correcciones. Las comparaciones con GPT, Claude, Gemini o Kimi deben usar las mismas entradas e informar del comportamiento de caché y los criterios de finalización.
Al tratarse de una beta, los identificadores del modelo y los precios pueden cambiar. Los desarrolladores deben confirmar la entrada activa en la API antes del despliegue y asociar cada registro de costes a una fecha. Una prueba reproducible de coste por tarea ofrecerá información más duradera que una tabla de lanzamiento que suponga que cada token se factura al precio más bajo.
Qué viene ahora
Se deben confirmar el modelo beta activo y su precio, y después medir el coste completo por tarea indicando caché, latencia, reintentos, uso de contexto y llamadas fallidas.
Fuentes
Este archivo retrospectivo sobre el lanzamiento se preparó el 3 de agosto de 2026 a partir de las actualizaciones, la página de precios y el repositorio del modelo de DeepSeek, con información de Axios como contexto de mercado. AI News of Today no realizó una prueba de coste ni calidad por API.
Siempre que es posible, enlazamos documentos originales y reportes de primera mano.