OpenAI dice que detectó actividad desde el 1 de julio de 2026 y que el 24 y 25 de julio registró 16.000 solicitudes con un patrón de extracción. Las cifras de OpenAI cuentan intentos, no demuestran que se obtuviera razonamiento protegido.
Publicado porEditado con GPT-6 LunaImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What has OpenAI alleged about Moonshot AI’s attempts to extract hidden reasoning from GPT models, including the scale, timing, and limits of. Article summary: OpenAI says it disrupted a July 2026 campaign that tried to make GPT models reveal protected, hidden reasoning, and attributes a core cluster —not the entire campaign—to individuals associated with Moonshot AI.. Topic tags: general web, openai, llm, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
OpenAI afirma que interrumpió una campaña que buscaba hacer que sus modelos GPT revelaran razonamiento protegido, es decir, información interna que no aparece en las respuestas normales. La empresa sitúa el inicio de la actividad el 1 de julio de 2026 y atribuye a personas vinculadas con Moonshot AI un núcleo de la campaña, no todos los intentos observados.
La distinción importa: OpenAI no dice que se haya probado que Moonshot dirigiera cada solicitud, ni que los intentos hayan conseguido extraer ese contenido. La compañía señala que no pudo confirmar si todos los operadores actuaban bajo un mismo responsable.
El 24 y 25 de julio, OpenAI registró 16.000 solicitudes de más de 4.000 usuarios que seguían un patrón de extracción. Su investigación más amplia detectó indicios relacionados en más de 15.000 usuarios, y afirma que interrumpió el grupo de actividad para el 28 de julio. Esas cantidades representan intentos, no extracciones exitosas confirmadas.
Según el informe, una de las técnicas consistía en copiar razonamiento cifrado de una conversación y pedirle a un modelo, en otra conversación, que lo descifrara y transcribiera. OpenAI describe una manipulación de las interacciones con sus modelos; las fuentes disponibles no indican que los operadores rompieran el cifrado ni accedieran directamente a bases de datos o conversaciones almacenadas.
En un aviso conjunto publicado en septiembre, la NSA, CISA y el FBI nombraron a Moonshot entre seis empresas con sede en China a las que atribuyeron campañas de destilación contra modelos estadounidenses. Las agencias describen, en conjunto, miles de millones de tokens obtenidos mediante millones de intercambios desde al menos finales de 2024; esos totales no corresponden exclusivamente a Moonshot. También señalan que las solicitudes podían pasar por API directas, proveedores de nube y agregadores externos que ocultan metadatos.
La destilación es una técnica de entrenamiento en la que un modelo aprende de las respuestas de otro, más capaz. Puede utilizarse legítimamente; la controversia aquí se refiere a la extracción no autorizada de capacidades y al uso de vías que, según las agencias, eluden las condiciones de acceso.
Anthropic hizo una acusación aparte: dijo que Moonshot reenvió en silencio solicitudes de clientes a Claude, en vez de procesarlas con Kimi, y presentó las respuestas como propias. Anthropic afirmó que, en un periodo de diez días, se le enviaron casi 300.000 solicitudes, la mayoría dirigidas a su modelo Opus. Son acusaciones de Anthropic, no una constatación independiente de cada interacción.
A finales de septiembre se informó que empresas podían usar Kimi K3 dentro de Codex, la herramienta de programación de OpenAI, a través de Baseten, un proveedor estadounidense de inferencia. El uso se factura contra compromisos de gasto de OpenAI que esas empresas ya tienen, sin exigirles contratar a un proveedor nuevo. La cobertura presentó el acuerdo como la primera entrada de un modelo chino de código abierto en ese canal empresarial. 3
1
El contraste con las acusaciones resulta llamativo, pero no prueba que la integración de Codex facilitara la actividad denunciada por OpenAI. Son asuntos distintos y las fuentes disponibles no establecen una conexión entre ambos.
Las agencias estadounidenses instan a las empresas de IA a reforzar la detección y mitigación de campañas de destilación a escala industrial, y advierten que las solicitudes pueden llegar por múltiples canales, incluidos servicios de nube y agregadores que dificultan identificar su origen. El aviso respalda ese enfoque general; con la información disponible aquí no conviene presentar una lista exhaustiva de controles específicos como si estuviera verificada.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
OpenAI dice que detectó actividad desde el 1 de julio de 2026 y que el 24 y 25 de julio registró 16.000 solicitudes con un patrón de extracción.
OpenAI dice que detectó actividad desde el 1 de julio de 2026 y que el 24 y 25 de julio registró 16.000 solicitudes con un patrón de extracción. Las cifras de OpenAI cuentan intentos, no demuestran que se obtuviera razonamiento protegido.
Un aviso de agencias estadounidenses describe campañas de destilación atribuidas, en conjunto, a seis empresas chinas; Anthropic, por separado, acusa a Moonshot de reenviar solicitudes de usuarios a Claude sin avisarles.