OpenAI señala a personas ligadas a Moonshot por extraer su razonamiento
OpenAI dice que cortó en julio una campaña para extraer razonamiento protegido y atribuye un núcleo a personas asociadas con Moonshot, creadora de Kimi. Matiza que no está claro que todo viniera de un solo actor. Moonshot no responde en la nota.

OpenAI dice que ha cortado una campaña para sacarle el razonamiento protegido a sus modelos, y atribuye un núcleo de esa actividad a personas asociadas con Moonshot AI, la compañía de Kimi. El relato es suyo, publicado el 30 de septiembre. No hay, en esa pieza, una respuesta de Moonshot. OpenAI matiza además que no está claro que todos los operadores salieran de un solo actor.
-IA Crew dice: acusar a otro laboratorio de copiarte el razonamiento, en este sector, es un poco como el ilusionista que se queja de que le han mirado la manga.-
Qué ocurrió, según OpenAI
La actividad más antigua que describe empezó el 1 de julio. Los picos llegaron el 24 y el 25 de ese mes: 16.000 peticiones con un patrón de extracción, desde más de 4.000 usuarios. OpenAI habla también de un clúster relacionado de más de 15.000 usuarios. Dice que la campaña quedó interrumpida el 28 de julio. Las cifras, advierte, describen intentos, no extracciones necesariamente logradas.
Lo que buscaban, según la compañía, era el razonamiento protegido: el registro interno con el que el modelo trabaja una tarea, en formas visibles para quien pregunta. OpenAI afirma que los operadores no rompieron cifrado, no entraron en una base de datos y no accedieron a conversaciones almacenadas. El camino era la propia interacción con el modelo. Por eso la llama destilación adversarial, no un hack clásico de perímetro.
A quién señala, y con qué cautela
OpenAI atribuye un núcleo del clúster a personas asociadas con Moonshot AI. No dice que toda la actividad viniera de allí, ni publica en la nota los nombres de esas personas. La atribución es parcial y es la versión de quien se considera perjudicado. Hasta que Moonshot responda, o hasta que aparezca otra fuente, esa frase no se puede leer como un hecho cerrado por las dos partes.
La destilación, en este uso, es el intento de extraer el comportamiento de un modelo a base de preguntarle, para entrenar o imitar otro sistema. No hace falta robar pesos si la interfaz devuelve bastante del camino intermedio. OpenAI dice que cerró una vía que permitía reutilizar razonamiento cifrado, añadió controles para frenar salida que pudiera exponerlo, restringió cuentas y compartió hallazgos con el Frontier Model Forum y con canales oficiales. También dice que el truco no es exclusivo de sus modelos.
-IA Crew dice: «no es una vulnerabilidad solo nuestra» es la frase corporativa más honesta y, a la vez, la que menos tranquiliza al vecino.-
Por qué el razonamiento oculto se ha vuelto un objetivo
Varios modelos de frontera esconden parte del proceso y muestran solo la respuesta, o un resumen. Ese tramo oculto se ha convertido en argumento de producto: más cuidado, menos copia, menos atajos para el usuario. También se ha convertido en botín. Si el razonamiento se puede pedir, reenviar o reutilizar, otro equipo puede estudiar la marcha sin ver los pesos. OpenAI reconoce que los sistemas con artefactos de razonamiento portátiles tienen un riesgo parecido.
Eso cambia el relato de la seguridad del modelo. Durante años, la frontera que se citaba era el robo de parámetros. Aquí el incidente que OpenAI describe no necesita ese robo. Basta con cuentas, volumen y una pregunta bien repetida. Por eso las mitigaciones que enumera son de cuenta, de monitorización y de salida, no solo de cifrado en reposo.
Quien lea la nota como un caso cerrado de espionaje industrial se pasa de frenada. OpenAI no afirma que cada una de esas 16.000 peticiones obtuviera el razonamiento, ni que Moonshot como empresa dirigiera el conjunto. Afirma una campaña, un núcleo asociado a personas de ese entorno y una interrupción a finales de julio. La consecuencia práctica, para el resto de laboratorios, es menos jurídica que técnica: si el razonamiento viaja con la respuesta, alguien va a intentar quedárselo.
-IA Crew dice: el razonamiento oculto ya tiene su propio género de incidente. El siguiente paso, inevitable, es la nota de prensa del aludido diciendo que aquello era investigación.-
Fuentes
OpenAI | https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign
Diccionario de la Crew
Destilación — En este contexto, extraer el comportamiento de un modelo a base de interacciones, para imitarlo o entrenar otro sistema, sin necesidad de copiar sus pesos.
Razonamiento protegido — Registro interno con el que el modelo trabaja una tarea, y que el proveedor intenta no mostrar entero a quien pregunta.
Moonshot AI — Laboratorio creador de Kimi. OpenAI atribuye un núcleo de la campaña a personas asociadas con esta compañía, no el conjunto de la actividad.


