DeepSeek puso en producción su modelo V4 Pro, con una ventana de contexto de 1 millón de tokens, herramientas explícitas para agentes y un precio tres veces mayor que el nivel Flash. La nueva división de niveles deja clara la estrategia de la compañía para escalar tráfico de bajo costo y reservar capacidad para razonamiento pesado.
***
- DeepSeek-V4-Pro-0813 ya aparece en la página de precios con una ventana de contexto de 1.000.000 de tokens y salida máxima de 384.000 tokens.
- Pro cuesta 3 yuanes por millón de tokens en fallos de caché de entrada y 6 yuanes en salida, frente a 1 y 2 yuanes de Flash.
- Los límites de concurrencia son de 500 solicitudes para Pro y 2.500 para Flash, lo que define una oferta de dos vías.
DeepSeek lanzó oficialmente su modelo V4 Pro en disponibilidad general.
La compañía listó el producto como DeepSeek-V4-Pro-0813 en su página de precios, según informó Pandaily.
El nivel insignia incluye una ventana de contexto de 1.000.000 de tokens.
Además, permite una salida máxima de 384.000 tokens.
El lanzamiento combina el modo de pensamiento por defecto con un endpoint sin pensamiento para llamadas sensibles a la latencia.
Esta combinación apunta directo a desarrolladores que trabajan con bases de código largas y flujos de agentes de múltiples pasos.
DeepSeek es una firma de inteligencia artificial conocida por lanzar modelos de alto rendimiento a precios competitivos.
Su nueva línea V4 busca capturar tanto tráfico masivo de bajo costo como tareas de razonamiento intensivo.
Capacidades técnicas y herramientas para agentes
DeepSeek integró las capacidades que la mayoría de los desarrolladores de agentes esperan hoy.
Entre ellas figuran la salida JSON estructurada y las llamadas a herramientas.
La compañía también ofrece la API de Responses y compatibilidad con la API de Anthropic.
Eso permite a los equipos migrar sus integraciones sin grandes cambios.
Además, el modelo incluye soporte beta para la continuación de prefijo de conversación y para finalización FIM.
La finalización FIM queda restringida al modo sin pensamiento.
La ventana de contexto de 1.000.000 de tokens permite que una sola llamada ingiera y genere mucho más material que la generación anterior.
Esta capacidad resulta clave para corpus de documentos extensos y ejecuciones de agentes de múltiples pasos.
El endpoint sin pensamiento reduce la latencia cuando se requiere una respuesta rápida.
El modo de pensamiento por defecto reserva el razonamiento pesado para tareas complejas.
Estrategia de precios y límites de concurrencia
Los precios de DeepSeek V4 Pro reflejan una división deliberada de niveles.
Pro está fijado en 0,025 yuanes por millón de tokens para aciertos de caché.
Para fallos de caché en entrada, el costo es de 3 yuanes por millón de tokens.
La salida se cobra a 6 yuanes por millón de tokens.
El nivel Flash, en contraste, tiene un precio de 0,02 yuanes para aciertos de caché.
Sus costos de fallo de caché son de 1 yuan en entrada y 2 yuanes en salida.
Esta estructura deja a Pro en aproximadamente el triple del costo de Flash en entrada y salida con fallo de caché.
Los aciertos de caché presentan una diferencia menor.
Los límites de concurrencia refuerzan la división de producto.
Flash soporta 2.500 solicitudes concurrentes, mientras que Pro queda limitado a 500.
Esa proporción apunta a una estructura más clara para la familia V4.
Flash se posiciona para tráfico de alta frecuencia y alto rendimiento donde el costo domina.
Pro concentra capacidad en razonamiento más pesado, codificación de contexto largo y flujos de trabajo de agentes.
Allí el modelo tiene más margen para gastar recursos.
Compatibilidad con ecosistemas de APIs
A nivel de red, el servicio expone endpoints compatibles con OpenAI y Anthropic.
Los equipos que ya operan bajo cualquiera de esos estándares pueden cambiar sin reconfigurar su infraestructura.
La compatibilidad con la API de Anthropic es una ventaja para desarrolladores acostumbrados a ese ecosistema.
También reduce la fricción de adopción.
La API de Responses y las llamadas a herramientas amplían las opciones de integración.
Esto cubre flujos de agentes que requieren salida estructurada y acción sobre sistemas externos.
El soporte beta para continuación de prefijo permite mantener contexto entre llamadas sin repetir información.
Esta función resulta útil en conversaciones largas y tareas de autocompletado.
La finalización FIM restringida al modo sin pensamiento evita conflictos con el razonamiento por defecto.
DeepSeek delimitó así los casos de uso de cada modo.
Posicionamiento competitivo y división de la línea V4
El precio absoluto de Pro sigue siendo modesto según los estándares de los modelos frontera.
DeepSeek mantiene espacio para recuperar el costo del reciente anuncio de aumento de precios.
La compañía aún subcotiza a la mayoría de sus competidores en el extranjero.
Esto le permite competir sin sacrificar margen.
Con DeepSeek-V4-Pro-0813 ya disponible, la línea V4 es efectivamente una oferta de dos vías.
Por un lado, el nivel Flash de bajo costo y alta concurrencia para escalar.
Por otro, el nivel Pro de mayor especificación dirigido directamente a casos de uso de codificación y agentes.
La separación de precios y concurrencia define esa estrategia.
El lanzamiento también consolida a DeepSeek como un proveedor serio para desarrolladores de agentes.
Las herramientas explícitas y la amplia ventana de contexto refuerzan ese enfoque.
Pandaily destacó que la prima de precio de Pro sobre Flash responde a una segmentación deliberada de la oferta.
De esta forma, el proveedor chino amplía su cobertura sin diluir el rendimiento en ninguno de los dos extremos.
ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.
Suscríbete a nuestro boletín
Artículos Relacionados
Empresas
Grok 4.6: el nuevo modelo de xAI impulsa agentes de larga duración
Bitcoin
5 formas de ganar Bitcoin en 2026 sin comprarlo: desde caminar hasta entrenar a la IA
Bancos y Pagos
India quiere que la IA apruebe préstamos que los humanos rechazarían
Capital de Riesgo