DeepSeek, el laboratorio chino que sacudió el mercado de la IA a principios de 2025, acaba de lanzar oficialmente su modelo V4, y viene con novedades importantes tanto en capacidades como en modelo de precios.
Un millón de tokens de contexto
La característica técnica más destacada de DeepSeek V4 es su ventana de contexto de 1 millón de tokens en toda la gama. Esto lo coloca al nivel de Gemini en cuanto a manejo de documentos muy largos, código extenso o bases de conocimiento completas en una sola conversación.
La arquitectura sigue siendo de tipo Mixture-of-Experts: V4-Pro tiene 1,6 billones de parámetros totales pero solo activa 49.000 millones en cada inferencia, lo que mantiene la eficiencia. V4-Flash, la versión más ligera, tiene 284.000 millones totales con 13.000 millones activos.
Precios por horas punta - una novedad en el sector
DeepSeek introduce por primera vez precios diferenciados según la hora del día, un modelo más propio de la electricidad que del software:
- Horas punta (9:00-12:00 y 14:00-18:00 hora de Pekín): precio doble
- Horas valle (resto del día): precio base
Para usuarios europeos y americanos, esto puede suponer una ventaja: nuestras horas de trabajo coinciden con las horas valle de China, lo que podría resultar en costes menores.
Fin de los endpoints antiguos
Importante para desarrolladores: los endpoints deepseek-chat y deepseek-reasoner dejan de funcionar a partir del 24 de julio de 2026. Las integraciones existentes deben migrar a la nueva API de V4.
¿Por qué importa?
DeepSeek V4 mantiene la presión sobre OpenAI y Anthropic en el segmento de modelos de alto rendimiento a bajo coste. Sus modelos de código abierto (licencia MIT) son los de mejor rendimiento en esa categoría, y esta nueva versión mejora especialmente en razonamiento matemático, ejecución de agentes y generación de código.
Para startups y desarrolladores independientes, DeepSeek sigue siendo una de las opciones más económicas del mercado sin sacrificar calidad.