Moonshot AI presentó Kimi K3 el 16 de julio. Ese mismo día abrió el acceso en web y móvil, Kimi Work, Kimi Code y la API. El 27 de julio publicó los pesos completos y el informe técnico. Las cifras llaman la atención: 2,8 billones de parámetros, un contexto de un millón de tokens y visión nativa.
Tres días después llegó una señal más interesante. El 19 de julio, Moonshot dijo que la demanda de las 48 horas anteriores había llevado su capacidad de GPU casi al límite. Pausó las nuevas suscripciones y mantuvo la prioridad para los clientes existentes. Que un modelo recién lanzado atraiga público es normal. Tener que limitar las nuevas altas demuestra que la capacidad para servir el modelo ya forma parte del producto.
DeepSeek impulsaba al mismo tiempo la familia V4 y Alibaba Cloud empezaba a ofrecer Qwen3.8-Max-Preview. La frase “DeepSeek es barato” ya no describe el mercado chino. Rendimiento, precio, licencia y distribución se están moviendo a la vez.
Por eso no me interesa decidir quién ganó un benchmark. La cuestión práctica es otra: si hoy dejamos fuera los modelos chinos de una selección seria, ¿estamos ignorando una parte relevante del mercado?
Las cifras de Kimi K3 impresionan, pero siguen siendo cifras del fabricante
K3 no activa sus 2,8 billones de parámetros en cada consulta. Su arquitectura MoE dirige cada token a 16 de 896 expertos. Busca ofrecer la capacidad de un modelo enorme sin asumir todo el coste de cálculo en cada paso.
Moonshot sostiene que K3 compite de cerca con modelos punteros en programación, navegación, automatización y trabajo de conocimiento. La empresa también cita Frontend Code Arena, una clasificación basada en preferencias humanas donde K3 quedó arriba tras su lanzamiento. Son señales útiles, pero todavía necesitan confirmación independiente.
Conviene detenerse aquí antes de repetir la clasificación. El gráfico de esta página pertenece a Moonshot. Según el modelo, se usaron Kimi Code, Claude Code o Codex; el esfuerzo de razonamiento y las condiciones de fallback tampoco fueron idénticos. El propio anuncio reconoce que K3, en términos generales, aún queda por detrás de Claude Fable 5 y GPT-5.6 Sol.
Esa concesión hace el documento más creíble. Permite ver dónde compite K3 sin convertir una tabla controlada por el proveedor en un veredicto de mercado. El titular “China ya tiene el mejor modelo” va más lejos de lo que permiten los datos.
El argumento fuerte de K3 es su amplitud. Reúne documentos largos, imágenes, herramientas de programación y un millón de tokens de contexto. Sus límites importan igual: la salida puede volverse inestable si no se conserva bien el historial de razonamiento o si se cambia de modelo a mitad de sesión. Moonshot también advierte que puede actuar con exceso de iniciativa y recomienda límites más claros en el system prompt o en AGENTS.md.
Que los pesos sean abiertos no significa que el uso sea gratis ni esté libre de condiciones
Moonshot publicó los pesos completos el 27 de julio. Los investigadores pueden examinarlos y los proveedores de inferencia pueden crear servicios sobre ellos. Eso no convierte K3 en software libre sin restricciones.
El modelo usa una licencia propia, Kimi K3 License. Permite investigación, desarrollo y muchos usos comerciales, pero los grandes proveedores de Model-as-a-Service deben negociar condiciones separadas. También existen obligaciones de atribución. “Los pesos son públicos” y “cualquier empresa puede hacer lo que quiera” no son equivalentes.
La infraestructura sigue teniendo coste. Servir un modelo de 2,8 billones de parámetros exige GPU, una pila de inferencia y personal capaz de mantenerla. Moonshot recomienda supernodes de al menos 64 aceleradores. Descargar los archivos no lo convierte en una opción barata de self-hosting para una empresa corriente.
La ventaja práctica de los pesos abiertos es otra: varios proveedores pueden ofrecer el mismo modelo y competir en precio, región, privacidad y disponibilidad.
DeepSeek cambia primero la conversación sobre el precio
El 4 de agosto, la tarifa oficial de DeepSeek V4-Pro era de 0,435 dólares por millón de tokens de entrada sin cache y 0,87 dólares por millón de tokens de salida. Kimi K3 cobraba 3 y 15 dólares, respectivamente. La diferencia es grande incluso entre modelos chinos.
El precio por token no es el coste total. Si un modelo consume más tokens, responde más despacio o exige más correcciones, el ahorro inicial desaparece. Aun así, en trabajos de gran volumen textual la distancia es demasiado amplia para ignorarla.
Los datos de OpenRouter apuntan en la misma dirección. Entre el 1 de enero y el 14 de junio, la plataforma procesó más de 450 billones de tokens. La cuota de DeepSeek dentro de ese volumen pasó de aproximadamente el 9% en enero al 18% a comienzos de junio. No es cuota de mercado mundial; es tráfico de tokens en una plataforma de routing. Sí sirve para observar hacia dónde mueven carga los desarrolladores cuando varios modelos están a una llamada de API.
Si tuviera que preparar el caso de negocio, empezaría aquí y no en tres puntos de benchmark. Entrada, salida, reintentos, latencia y tiempo de corrección humana pueden cambiar por completo el orden de la factura real.
Qwen3.8 necesita tiempo, no un veredicto precipitado
Qwen3.8-Max-Preview está disponible en el Token Plan de Alibaba Cloud Model Studio. La página oficial explica cómo acceder a la versión previa y cómo encaja en las herramientas de Alibaba, pero aún no ofrece suficiente detalle técnico verificable para compararlo de forma definitiva con K3 o DeepSeek.
La palabra Preview es importante. Al revisar las páginas oficiales el 4 de agosto, no encontré una model card final, pesos publicados, una licencia definitiva ni una evaluación independiente amplia. Colocarlo en una tabla cerrada de ganadores y perdedores junto a K3 y DeepSeek sería prematuro.
Lo primero que destaca es la distribución. Los clientes de Alibaba Cloud y Model Studio pueden probarlo sin rehacer su infraestructura. Eso no demuestra adopción, pero sí reduce el coste de evaluarlo. La calidad del modelo y el camino hasta el uso cotidiano son ventajas competitivas distintas.
La presión más inmediata sobre los laboratorios de EE. UU. es el precio
Las tarifas citadas permiten afirmar algo concreto: DeepSeek V4-Pro cuesta bastante menos que Kimi K3. Para compararlos con modelos estadounidenses habría que alinear precios de la misma fecha, reglas de caché y niveles de servicio. Aun sin generalizar, una diferencia de este tamaño hace más difícil justificar una prima basada solo en el benchmark.
Los datos de OpenRouter no representan la cuota mundial; describen el uso en una sola plataforma. Aun así, la familia DeepSeek pasó aproximadamente del 9 % al 18 % durante el periodo analizado. Es una señal suficiente de que algunos usuarios redistribuyen tráfico cuando precio y rendimiento encajan.
Los pesos abiertos también amplían las opciones de compra. En vez de depender de una sola API, un equipo puede comparar proveedores de inferencia por precio, región y política de datos, o alojar el modelo si el coste operativo lo justifica. La competencia deja de ser solo una tabla de benchmarks y pasa al coste total y a la continuidad del servicio.
Así haría hoy mi selección inicial
| Necesidad | Primer candidato | Condiciones que comprobaría |
|---|---|---|
| Mucho texto a bajo coste | DeepSeek V4-Pro | Longitud de salida, latencia, reintentos y región de tratamiento de datos |
| Contexto largo, imagen y código en un modelo | Kimi K3 | Compatibilidad con Kimi Code, no cambiar de modelo durante la sesión, licencia y capacidad |
| Una prueba rápida dentro de Alibaba Cloud | Qwen3.8-Max-Preview | Cambios de preview, precio final, model card y publicación de pesos |
| Datos de clientes o regulados | Elegir primero el proveedor | Región de almacenamiento, retención de logs, borrado y responsabilidad contractual |
Para procesar mucho texto con presupuesto ajustado, mediría primero DeepSeek. Si necesito unir contexto largo, imagen y programación, probaría K3 y convertiría las advertencias de Moonshot sobre el entorno de ejecución en criterios de aceptación. No fijaría Qwen3.8 como estándar hasta que termine la preview.
Mantendría al menos dos proveedores viables. Los precios y las reglas de acceso cambian rápido. Probaría con regularidad en dos o tres modelos los documentos y solicitudes que realmente recibe el equipo. Mediría el coste por tarea completada y el tiempo de corrección humana, no solo la precisión.
Hasta dónde ha llegado la IA china
Todavía es pronto para declarar una victoria china. La propia documentación de Kimi reconoce la distancia frente a los sistemas propietarios más fuertes. DeepSeek tiene un precio formidable, pero no ofrecerá la misma calidad y eficiencia en todos los trabajos. Qwen3.8 continúa en preview.
Lo que sí ha cambiado es la etiqueta de “alternativa barata”. La capacidad mejora, los precios son menores, aparecen pesos públicos y los grandes proveedores cloud amplían la distribución. Una selección formada solo por productos estadounidenses ya puede dejar fuera una parte material del mercado.
No lo planteo como una rivalidad nacional, sino como una decisión operativa. Incluiría modelos chinos en la lista inicial, pero separaría benchmarks del fabricante y pruebas independientes, pesos públicos y uso comercial sin límites, precio por token y coste de terminar el trabajo. El mayor avance de la IA china no es haber colocado un único modelo en el número uno. Es haber creado varias opciones que un comprador serio ya no puede ignorar.

Fuentes y referencias
- Kimi K3: Open Frontier Intelligence Moonshot AI
- Kimi K3 technical report Kimi Team / arXiv
- Kimi K3 License Moonshot AI / Hugging Face
- DeepSeek V4 Preview Release DeepSeek
- DeepSeek Models and Pricing DeepSeek
- Qwen3.8-Max-Preview availability Alibaba Cloud
- DeepSeek V4 Is Earning Agentic Token Share OpenRouter
- Moonshot pauses Kimi subscriptions amid hot demand Reuters