OpenAI ha acusado públicamente por primera vez a usuarios vinculados a Moonshot AI, la empresa china creadora del chatbot Kimi, de una campaña coordinada para extraer el razonamiento oculto de sus modelos.
Cómo lo hacían
Los modelos de razonamiento de OpenAI «piensan» antes de responder, pero ese razonamiento interno se guarda cifrado y no se muestra. Según OpenAI, los atacantes copiaban ese razonamiento cifrado de una conversación y, en otra, pedían al modelo que lo descifrara y lo transcribiera. Con esos textos se puede entrenar otro modelo para que imite al original: es lo que se llama destilación.
Las cifras
- Empezó el 1 de julio con poco volumen.
- Pico el 24 y 25 de julio: 16.000 peticiones desde más de 4.000 usuarios.
- Actividad relacionada en más de 15.000 cuentas.
- OpenAI la cortó el 28 de julio.
OpenAI asegura que no rompieron el cifrado ni accedieron a bases de datos o conversaciones de otros usuarios. Ha cerrado cuentas, endurecido la verificación de registro y compartido la información con otros laboratorios a través del Frontier Model Forum y con el Gobierno.
El contexto
«Nos preocupa la violación de nuestras condiciones de uso, no los modelos abiertos ni la destilación legítima», explica Caroline Zier, responsable de política de seguridad nacional en OpenAI. Anthropic hizo acusaciones parecidas el mes pasado y el Gobierno de EE. UU. ya señaló a seis empresas chinas por este tipo de prácticas; China lo niega.
Fuentes: The Next Web · Quartz · BankInfoSecurity
🎁 Llévate gratis 25 prompts listos para copiar
Suscríbete y recibe cada mañana las noticias de IA, en español y con fuentes.