OpenAI atribuye a Moonshot AI una campaña para extraer razonamiento
OpenAI afirmó que interrumpió una operación coordinada para extraer razonamiento protegido de sus modelos y atribuyó a personas vinculadas con Moonshot AI un grupo central de la actividad.
La empresa describió la práctica como destilación adversaria: usar las respuestas o el razonamiento de un modelo para entrenar o mejorar otro, sin repetir la inversión en su desarrollo.
OpenAI dijo que la actividad empezó el 1 de julio y alcanzó 16.000 solicitudes de más de 4.000 usuarios en dos días, el 24 y 25 de julio.
¿Cómo se llevó a cabo la operación?
Según OpenAI, los operadores copiaban datos de razonamiento cifrados de una conversación y pedían al modelo descifrarlos y transcribirlos en otra; la compañía calificó el método de novedoso.
La actividad sospechosa abarcó más de 15.000 usuarios y, según OpenAI, quedó completamente interrumpida el 28 de julio.
OpenAI sostuvo que no se vulneraron su cifrado, sus bases de datos ni las conversaciones almacenadas: los operadores manipularon las interacciones para hacer visible el razonamiento protegido.
¿Qué se sabe sobre la atribución?
OpenAI dijo que no está claro si toda la actividad corresponde a un solo actor; atribuyó el grupo central a personas asociadas con Moonshot AI, creadora del modelo Kimi.
La publicación de OpenAI no expuso pruebas técnicas ni el razonamiento que sustentan esa atribución; Moonshot no respondió de inmediato a una solicitud de comentarios.
La compañía compartió sus hallazgos con otros desarrolladores mediante el Frontier Model Forum y con canales gubernamentales de intercambio de información; advirtió de riesgos para la seguridad y la seguridad nacional.