OpenAI acusa a Moonshot de destilación: qué alega
OpenAI acusa a Moonshot AI, creadora de Kimi, de intentar copiar el razonamiento oculto de sus modelos. Qué alega, qué está probado y qué sigue sin probarse.
Basado en fuentes. Escrito a partir de los documentos, reportes y reseñas enlazados en el texto. The Ruling Desk no probó nada de esto en persona. Cómo trabajamos

OpenAI dice que operadores que vincula con Moonshot AI, la empresa china detrás de los modelos Kimi, montaron este verano una campaña coordinada para sacar el razonamiento oculto de sus modelos y usarlo para entrenar los suyos. OpenAI acusa a Moonshot en una publicación del 30 de septiembre de 2026. Esta acusación de destilación de OpenAI contra Moonshot viene de un competidor directo, ningún tribunal ni regulador la ha examinado y OpenAI no publicó pruebas técnicas sobre quién estuvo detrás. Esto es lo que alega OpenAI, lo que respalda el trabajo externo y lo que ha dicho Moonshot.
Puntos clave
- La acusación de OpenAI: la actividad empezó el 1 de julio de 2026, llegó a su pico el 24 y 25 de julio con 16,000 solicitudes de más de 4,000 usuarios y quedó desarticulada por completo el 28 de julio. OpenAI vincula un "núcleo" de los operadores con Moonshot AI.
- No fue un hackeo, según OpenAI: los operadores no rompieron su cifrado, no entraron a una base de datos ni llegaron a conversaciones guardadas de usuarios. Engañaron a sus modelos para que revelaran un razonamiento que normalmente está oculto.
- El método es real: investigadores independientes mostraron en agosto que este tipo de fuga de razonamiento funcionaba contra OpenAI, Anthropic y Google. Eso prueba que el hueco existía, no quién lo usó.
- La atribución no está probada: OpenAI no citó pruebas técnicas del vínculo con Moonshot, y ningún tribunal ni regulador ha determinado que Moonshot haya hecho algo.
- La versión de Moonshot: al 1 de octubre de 2026, no encontramos ninguna respuesta pública de Moonshot a la acusación de OpenAI.
¿De qué acusa OpenAI a Moonshot?
Todo lo de esta sección es la versión de OpenAI. Según el resumen de la publicación de The Hacker News, la actividad empezó el 1 de julio de 2026 con poco volumen y luego se disparó el 24 y 25 de julio a 16,000 solicitudes con un mismo patrón de extracción, enviadas por más de 4,000 usuarios. Al ampliar la búsqueda, OpenAI encontró el mismo patrón de prompts en más de 15,000 usuarios, y dice que había desarticulado la campaña por completo el 28 de julio.
OpenAI dice que "cree firmemente" que un núcleo de los operadores está asociado con Moonshot AI, como informó BankInfoSecurity. También dice que no está segura de que todas las cuentas fueran parte de un mismo esfuerzo coordinado. Eso importa: las cifras de 4,000 y 15,000 cuentan usuarios que enviaron un prompt parecido, no cuentas que OpenAI haya demostrado que son de Moonshot.
| Fecha (2026) | Lo que OpenAI dice que pasó |
|---|---|
| 1 de julio | Empieza la actividad de extracción, con poco volumen |
| 24 y 25 de julio | 16,000 solicitudes de más de 4,000 usuarios |
| Para el 28 de julio | Campaña desarticulada por completo; patrón relacionado en más de 15,000 usuarios |
| 30 de septiembre | OpenAI publica su versión |
Cómo se extrajo el razonamiento oculto
Los modelos de razonamiento resuelven un problema paso a paso antes de responder. OpenAI no muestra ese razonamiento en bruto a los usuarios; lo devuelve como un bloque cifrado para que el modelo pueda retomar donde se quedó. OpenAI dice que los operadores copiaron un bloque cifrado de una conversación, lo pegaron en otra y le pidieron al modelo de esa segunda conversación que lo descifrara y lo escribiera.
OpenAI dice que bloqueó las cuentas, cerró la vía que permitía reutilizar el razonamiento cifrado y añadió controles para respuestas en streaming que dejen ver el razonamiento. También endureció los controles de registro y compartió sus hallazgos con el Frontier Model Forum, un grupo de la industria, y con canales del gobierno. OpenAI dice que la actividad violó sus términos de servicio; The Register informa que OpenAI no dijo qué modelos fueron el blanco.
Qué significa la destilación adversarial, en palabras simples
Destilar significa entrenar un modelo "alumno" nuevo con las respuestas de un modelo "maestro" más fuerte. Es una técnica normal cuando una empresa lo hace con sus propios modelos. OpenAI la llama "destilación adversarial" cuando alguien lo hace a gran escala con el modelo de otra empresa, sin permiso.
El razonamiento paso a paso es el premio porque muestra cómo un modelo fuerte llega a una respuesta, no solo la respuesta. El argumento de OpenAI, citado por The Hacker News, es que un modelo entrenado con razonamiento extraído podría heredar la habilidad sin las salvaguardas. Caroline Zier, de OpenAI, le dijo a Bloomberg, según cita The Next Web, que lo que le preocupa a la empresa es la violación de sus términos de servicio, no los modelos abiertos ni la destilación legítima.
Qué está verificado de forma independiente y qué no
Verificado por trabajo externo: la vulnerabilidad era real. OpenAI dice que se enteró de ella por investigadores independientes que estaban escribiendo un artículo. Un artículo que coincide con esa descripción, publicado en arXiv el 10 de agosto de 2026, encontró que los bloques de razonamiento cifrado se podían intercambiar entre sesiones, usuarios y modelos de un mismo proveedor. Sus autores sacaron así razonamiento oculto de modelos de Anthropic, OpenAI y Google.
No verificado: que Moonshot estuviera detrás. The Hacker News señala que OpenAI no citó ninguna prueba técnica de la atribución. Ningún tribunal, regulador ni investigador independiente la ha confirmado.
Un segundo rival dice algo parecido. Anthropic, que también compite con Moonshot, hizo su propia acusación en su informe de amenazas del 10 de septiembre. Dice que Moonshot reenvió en silencio solicitudes de clientes de Kimi a Claude, casi 300,000 en un periodo de diez días a través de 5,380 cuentas fraudulentas, y que usó un truco de reutilización parecido con el razonamiento de Claude. Que dos empresas interesadas cuenten una historia similar vale la pena notarlo. Aun así, son dos acusaciones, no una conclusión. Cubrimos otro informe de Anthropic sobre un laboratorio chino en nuestra nota sobre las pruebas de exploits de GLM-5.3.
Qué ha dicho Moonshot
Al 1 de octubre de 2026, no encontramos ninguna declaración pública de Moonshot AI sobre la acusación de OpenAI. The Register le pidió comentarios a la empresa y no recibió respuesta inmediata.
Moonshot tampoco ha respondido directamente a la acusación de Anthropic sobre el reenvío. Un comunicado del 12 de septiembre, reportado por BeInCrypto, calificó de inventados los rumores en internet sobre su fundador y sus empleados y dijo que había acudido a la policía. Ese comunicado no abordó la acusación de reenvío a Claude.
Por qué importa si usas Kimi

Por ahora, nada cambia en cómo funciona Kimi. Las medidas de OpenAI aplican a cuentas en su propia plataforma, y su acusación trata sobre cómo Moonshot pudo haber entrenado sus modelos, no sobre los datos de los usuarios de Kimi. Si la acusación se sostiene, la pregunta que deja es si parte de la capacidad de Kimi se construyó con razonamiento copiado.
La pregunta de privacidad viene de la acusación aparte de Anthropic: dice que algunas solicitudes reenviadas contenían datos sensibles de clientes y que no sabe si Moonshot les avisó. Eso tampoco está probado. Aun así, si mandas datos de tu empresa a cualquier modelo alojado, Kimi incluido, lee los términos de datos del proveedor antes de hacerlo.
Qué sigue
Hay tres cosas que vigilar: una respuesta de Moonshot, cualquier prueba técnica que publiquen OpenAI u otros laboratorios, y acciones de gobiernos. Ten en cuenta también lo que está en juego en lo comercial. Los modelos de OpenAI son lo que les pide a los inversionistas que valoren en su nueva ronda de financiamiento reportada, lo que le da todos los motivos para defenderlos en público y a ti un motivo para leer sus acusaciones con cuidado.
En resumen
Cuando OpenAI acusa a Moonshot, afirma que operadores vinculados con la empresa usaron una vulnerabilidad real, documentada de forma independiente, para copiar el razonamiento oculto de sus modelos en julio. La vulnerabilidad está probada. El vínculo de la destilación con Moonshot es una afirmación de OpenAI, sin pruebas publicadas, y Moonshot no había respondido al 1 de octubre de 2026. Tómalo como una acusación seria de un rival, no como una conclusión.
Preguntas frecuentes
¿Qué es la destilación de modelos de IA?
Es entrenar un modelo con las respuestas de otro, para que el modelo más pequeño o más nuevo aprenda a imitar al más fuerte. Las empresas lo hacen de forma legítima con sus propios modelos. OpenAI se opone cuando se hace con sus modelos sin permiso, en contra de sus términos de servicio.
¿Moonshot hackeó a OpenAI?
No, según la propia versión de OpenAI. OpenAI dice que los operadores no rompieron su cifrado, no comprometieron una base de datos ni llegaron a conversaciones guardadas de usuarios. Dice que abusaron del acceso normal para que los modelos revelaran un razonamiento que debe permanecer oculto.
¿Moonshot AI le ha respondido a OpenAI?
Al 1 de octubre de 2026, no encontramos ninguna respuesta pública. The Register le pidió comentarios a Moonshot y no tuvo respuesta inmediata.
¿Es seguro seguir usando Kimi?
La acusación de OpenAI no dice que se hayan expuesto datos de usuarios de Kimi, y ningún regulador ha actuado contra Moonshot. La acusación aparte de Anthropic plantea una pregunta de privacidad sobre las solicitudes reenviadas, que no está probada. No pongas datos sensibles en ningún chatbot alojado a menos que hayas leído sus términos de datos.