El último modelo de IA de China, Kimi K3’, desafía a sus grandes rivales estadounidenses

El último gran modelo de lenguaje (LLM) construido en China está impresionando a los científicos con su tamaño y capacidades. La semana pasada, Moonshot AI, con sede en Pekín, presentó ‘Kimi K3’, un potente modelo de lenguaje de razonamiento que puede manejar grandes extensiones de texto. Las pruebas realizadas por la propia empresa encontraron que K3 puede igualar o superar a los modelos rivales estadounidenses en tareas como la codificación y la manipulación de hojas de cálculo.

Desde DeepSeek, ningún modelo de inteligencia artificial chino había causado tanto revuelo. «Es un punto de inflexión,» dice Joel Pearson, un neurocientífico cognitivo en UNSW Sydney en Australia, quien estudia cómo la IA está afectando la vida de las personas. «La gente lo está llamando un ‘momento Sputnik'», añade.

Tres días después del lanzamiento del modelo, Moonshot AI dijo que había pausado las nuevas inscripciones para K3 porque la demanda había llevado su sistema cerca de los límites de su capacidad de procesamiento.

El lanzamiento del modelo, el 16 de julio, se produjo justo antes de la Conferencia Mundial de Inteligencia Artificial 2026 en Shanghái. La conferencia comenzó con el presidente chino Xi Jinping anunciando el inicio formal de una alianza global para crear una regulación que asegure que la IA sea segura y beneficie a las personas. «Desde la perspectiva de China, todos los países deberían adoptar un enfoque centrado en las personas y desarrollar la IA para el bien y para el beneficio de todos,» dijo Xi en la conferencia, añadiendo que la IA debería ser un motor para la «prosperidad compartida y la seguridad común».

El momento del lanzamiento de Kimi K3 es significativo, dice Mehwish Nasim, investigadora de IA en la Universidad de Australia Occidental en Perth. El modelo fue lanzado solo unas semanas después de Claude Fable 5 por la empresa estadounidense Anthropic, y días después de que OpenAI lanzara su último modelo GPT-5.6. «China está señalando su ambición no solo de construir sistemas de IA de vanguardia, sino también de ayudar a dar forma al ecosistema internacional de IA y su gobernanza,» dice ella.

El modelo de mayor peso abierto

K3 es de peso abierto, al igual que su predecesor Kimi K2 y los modelos DeepSeek, que fueron desarrollados por una empresa de Hangzhou del mismo nombre, lo que significa que sus componentes principales están disponibles públicamente y pueden ser descargados y modificados por investigadores de forma gratuita, mientras que la información sobre el entrenamiento del modelo es privada. También se puede acceder a él utilizando una ‘interfaz de programación de aplicaciones’, que permite a los software comunicarse, a un costo menor que los LLMs propietarios, como los de OpenAI, Google y Anthropic. Esos LLM son de peso cerrado, lo que significa que no se pueden descargar ni modificar.

Moonshot dice que los pesos, o parámetros, se publicarán el 27 de julio. Rahul Shome, un investigador de robótica e IA en la Universidad Nacional de Australia en Canberra, dice que ha habido un impulso por parte de consumidores, desarrolladores e investigadores para hacer que los modelos de IA sean de peso abierto. K3 es particularmente emocionante porque sería el modelo de pesos abiertos más grande, dice Shome, con 2.8 billones de parámetros y una memoria de trabajo de un millón de tokens (las unidades de texto utilizadas por los modelos de IA). Sin embargo, el modelo es demasiado grande para ejecutarse en dispositivos personales, por lo que probablemente requerirá una inversión significativa por parte de las instituciones para ejecutarlo, añade.

La gran memoria de trabajo de K3 significa que podría recordar el contenido de miles de líneas de código o un libro entero y reducir la probabilidad de producir información fabricada llamada alucinación, dice Niusha Shafiabady, investigadora de inteligencia computacional en la Universidad Católica Australiana en Sídney. Shafiabady dice que va a probar K3 por sí misma pidiéndole que resuma los hallazgos de la investigación.

Cerrar la brecha

El rendimiento y las capacidades de los modelos de pesos abiertos han estado históricamente por detrás de los de los modelos propietarios estadounidenses. Pero la brecha parece ser la más estrecha que jamás haya sido, dice Aaron Snoswell, investigador de responsabilidad de IA en el Laboratorio de IA Generativa de la Universidad de Tecnología de Queensland, Brisbane.

Pearson dice que los modelos de código abierto chinos están cambiando la forma en que los inversores y usuarios perciben el valor de los modelos de vanguardia estadounidenses. Google, Anthropic y OpenAI gastan miles de millones de dólares entrenando sus modelos en comparación con los presupuestos mucho más bajos de las empresas chinas. Además, los usuarios podrían perder el acceso a los modelos estadounidenses si el gobierno decide imponer restricciones, dice Pearson. El mes pasado, Anthropic desactivó temporalmente sus modelos más avanzados, Fable 5 y Mythos 5, para todos los usuarios después de que el gobierno de EE. UU. le ordenara suspender el acceso a los ciudadanos extranjeros. El acceso a Fable 5 se restauró este mes, pero Mythos 5 solo está disponible para organizaciones específicas de EE. UU.

Toby Walsh, un científico informático de la UNSW, dice que las empresas chinas de IA han podido construir modelos de IA de vanguardia a pesar de que Estados Unidos restringe el acceso de China a chips avanzados de IA, citando preocupaciones de seguridad nacional. «Uno sospecha que la necesidad aquí fue la madre de la invención,» añade.

Kimi K2.5 se hizo popular en China, en parte porque es bueno para ejecutar agentes de IA, cuyo uso ha explotado en el último año más o menos, dice William Guey, quien está estudiando modelos de IA en la Universidad de Tsinghua en Pekín. Estas herramientas autónomas pueden llevar a cabo acciones específicas como descargar artículos de investigación de Internet o escanear sitios web. K3 también está bien ajustado para ejecutar agentes de IA, añade Walsh, que es lo que a mucha gente le interesa.

Las empresas chinas de IA están apuntando a desarrolladores y consumidores estadounidenses para que utilicen LLMs chinos, dice Snoswell.

Pero queda por ver si habrá una adopción generalizada de K3 más allá de China, dice Nasim. La adopción probablemente dependerá de cómo las universidades y los gobiernos evalúen los riesgos de seguridad del modelo, añade, incluyendo cómo se almacenan y utilizan los datos de los usuarios por parte de la empresa, y si terceros pueden acceder a ellos.

Las propias políticas de China podrían limitar su uso fuera de sus fronteras. A principios de este mes, el gobierno del país supuestamente se reunió con las empresas chinas de IA Alibaba, Z.ai y ByteDance para discutir la posible restricción del acceso de los usuarios en el extranjero a los modelos de IA nacionales, según un informe de los medios.

Aun así, Walsh dice que K3 es una indicación de que los investigadores tendrán una selección diversa de modelos de peso abierto y propietarios para elegir. «Es una evidencia de que la IA no va a ser un mercado de ganador se lo lleva todo,» añade.

Rachel Fieldhouse y Mohana Basu

VIANature