Meituan, la gigante china de delivery y tecnología, ha publicado en abierto LongCat-2.0, un modelo de lenguaje de 1,6 billones de parámetros con licencia MIT, especializado en programación agéntica: entender, generar y ejecutar código dentro de flujos de trabajo con agentes.

El dato más llamativo: sin una sola GPU de Nvidia

LongCat-2.0 es el primer modelo de más de un billón de parámetros entrenado y servido de principio a fin exclusivamente en chips fabricados en China, sin depender de ninguna GPU de Nvidia. El preentrenamiento cubrió más de 35 billones de tokens usando más de 50.000 aceleradores domésticos, sin necesidad de rollbacks ni picos irrecuperables de pérdida durante el proceso - un hito técnico relevante en un contexto de restricciones de exportación de chips avanzados hacia China.

Especificaciones técnicas

  • Arquitectura: Mixture-of-Experts (MoE), con 1,6 billones de parámetros totales y unos 48.000 millones activos por token
  • Ventana de contexto: 1 millón de tokens de forma nativa - suficiente para mantener una base de código completa en memoria en una sola petición
  • Licencia: MIT, totalmente abierta y sin restricciones para uso comercial

Rendimiento

Según los datos publicados por Meituan, LongCat-2.0 supera ligeramente a GPT-5.5 en el benchmark SWE-bench Pro (58,6 puntos), y la compañía afirma un rendimiento general comparable al de Gemini 3.1 Pro de Google.

Por qué importa

LongCat-2.0 se suma a una lista creciente de modelos abiertos chinos (Kimi K2.7, GLM-5.2, DeepSeek) que compiten de tú a tú con los modelos cerrados de referencia occidental, esta vez con un añadido estratégico: demuestra que es posible entrenar un modelo de frontera a escala de billón de parámetros sin depender del hardware de Nvidia. Para desarrolladores y empresas, la combinación de contexto masivo, buen rendimiento en programación y licencia MIT lo convierte en una alternativa seria y gratuita frente a modelos propietarios de pago para tareas de codificación agéntica.