Firmado el 12 de junio de 2026, el memorando entre la Autoridad de Desarrollo de Medios e Infocomunicaciones de Singapur (IMDA) y Microsoft establece un marco para evaluar y gobernar la IA avanzada, incluida la evalua... El plan se apoya en tres pilares: investigación técnica sobre seguridad, intercambio de conocimi...
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What are Singapore’s and Microsoft’s plans, under their June 12, 2026 memorandum of understanding, to jointly test the safety and security o. Article summary: Singapore’s June 12 MOU with Microsoft is a framework for evaluating and governing frontier AI, not a public commitment to deploy a particular model. It supports joint safety-and-security research—including multilingual . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
El memorando de entendimiento firmado el 12 de junio de 2026 entre la Autoridad de Desarrollo de Medios e Infocomunicaciones de Singapur (IMDA) y Microsoft debe entenderse como un marco para evaluar y gobernar la IA avanzada, no como un anuncio de despliegue de un modelo específico. El acuerdo contempla investigación conjunta, intercambio de información y políticas de acceso confiable, con especial atención a la IA agéntica y a las pruebas de seguridad en distintos idiomas.
En otras palabras, el objetivo es definir cómo probar sistemas muy capaces, qué controles necesitan y quién debería poder utilizarlos antes de que se incorporen a entornos sensibles. El texto no compromete públicamente a Singapur a implementar un modelo concreto de Microsoft ni ningún otro modelo de frontera.
IMDA y Microsoft colaborarán en investigación sobre seguridad y protección de la IA. El trabajo incluye la IA agéntica —sistemas capaces de planificar y actuar mediante herramientas o flujos de trabajo— y métodos para evaluar la seguridad de los modelos en varios idiomas.
Las pruebas multilingües son importantes porque las salvaguardas de un modelo no necesariamente funcionan igual cuando las instrucciones, el contexto cultural o una intención dañina se expresan en idiomas, registros o formas de hablar diferentes. El memorando habla de investigación y evaluación; no anuncia el lanzamiento de un modelo concreto.
En el caso de los sistemas agénticos, tampoco basta con medir la calidad de una respuesta aislada. Hay que examinar qué acciones puede realizar el sistema, cómo interpreta instrucciones ambiguas y si existen controles técnicos capaces de limitar comportamientos dañinos o no deseados.
Las partes también prevén compartir información, mejores prácticas y marcos de gobernanza. Esto puede conectar las pruebas técnicas con decisiones operativas: qué riesgos deben evaluarse, qué umbrales aplicar, quién puede acceder a un modelo y qué procedimiento seguir cuando se detecta una debilidad grave.
El enfoque va más allá de comparar la capacidad de los modelos en una clasificación o prueba de referencia. Un sistema puede obtener buenos resultados en un benchmark y aun así no ser adecuado para servicios públicos o infraestructuras críticas si carece de permisos bien definidos, supervisión, procedimientos de divulgación o control humano suficientes.
El tercer eje consiste en estudiar políticas de acceso confiable a modelos de frontera. La idea es que los sistemas más capaces puedan utilizarse para investigación y tareas legítimas, pero sin quedar expuestos de forma indiscriminada y sin medidas de seguridad proporcionales a sus capacidades y riesgos.
El acuerdo apunta así a un modelo de seguridad por capas: evaluar el sistema, compartir los resultados, limitar el acceso cuando sea necesario y establecer reglas claras de responsabilidad.
El modelo Claude Mythos Preview, de Anthropic, ofrece un ejemplo de los riesgos de uso dual que plantea la IA avanzada. Anthropic afirma que la empresa y aproximadamente 50 socios de Project Glasswing utilizaron el modelo restringido para identificar más de 10.000 vulnerabilidades de gravedad alta o crítica en software de importancia sistémica. También informó de que Mythos podía detectar y explotar vulnerabilidades, incluidas fallas de día cero, en los principales sistemas operativos y navegadores.
Esa capacidad podría reforzar la defensa informática al ayudar a los investigadores a descubrir fallas antes que los atacantes. Pero también podría acortar el camino entre el descubrimiento de una vulnerabilidad y su explotación si el modelo se distribuyera ampliamente o se controlara de forma deficiente. Por ese motivo, Anthropic mantuvo Mythos bajo acceso restringido mediante Project Glasswing en lugar de ofrecerlo al público.
Aun así, las pruebas disponibles no demuestran que Claude Mythos causara o impulsara específicamente el memorando entre Singapur y Microsoft del 12 de junio. Es más preciso considerarlo un ejemplo del entorno de riesgo cambiante que hace cada vez más necesarias las evaluaciones estructuradas, el acceso controlado y los marcos de gobernanza.
El modelo de acceso limitado de Project Glasswing es, por sí mismo, una medida de gestión del riesgo. Anthropic permitió utilizar Mythos a un grupo definido de socios para labores defensivas, en vez de publicarlo sin restricciones. Esto reduce la exposición y, al mismo tiempo, permite que equipos de seguridad estudien sus capacidades.
El acceso restringido no constituye un sistema de seguridad completo: requiere selección de participantes, supervisión, manejo seguro de la información y divulgación responsable. Pero refleja el principio detrás del trabajo sobre acceso confiable del memorando: el acceso debería corresponder a la capacidad y al riesgo del modelo, no tratar todo sistema avanzado como si fuera un programa convencional de distribución pública.
Encontrar una falla es solo el primer paso. La Agencia de Ciberseguridad de Singapur ha recomendado a las organizaciones aplicar parches a las vulnerabilidades críticas y de gravedad alta, activar la autenticación multifactor en interfaces y pasarelas, y revisar los permisos innecesarios. Estas medidas reducen las oportunidades de explotación mientras las empresas investigan y solucionan los problemas.
Los datos disponibles también aconsejan no presentar las aproximadamente 10.000 vulnerabilidades detectadas por Mythos como ampliamente corregidas. Una evaluación posterior registró 1.596 divulgaciones a los mantenedores, pero solo 97 correcciones. Esto no significa que el proyecto no aportara beneficios defensivos, pero sí que las afirmaciones de que se solucionó una gran parte de los hallazgos deben tratarse con cautela.
La lección es tanto operativa como técnica: la seguridad de la IA necesita procesos para identificar riesgos, comunicarlos de forma responsable, priorizar las reparaciones y reducir la exposición mientras las correcciones siguen pendientes.
Microsoft aporta experiencia en el desarrollo de modelos avanzados, infraestructura empresarial y evaluación y control operativo del acceso a sistemas de IA. Sin embargo, el alcance declarado del memorando es más amplio que un único modelo de Microsoft: se refiere a métodos de evaluación de seguridad y a mecanismos de acceso confiable aplicables, en general, a modelos de frontera.
La información disponible no respalda como compromisos formales de este acuerdo varias afirmaciones más específicas, entre ellas las relacionadas con el modelo MAI de Microsoft, el acceso desde Azure AI Foundry a modelos de OpenAI y Anthropic, o acuerdos comparables con el Instituto de Seguridad de la IA del Reino Unido y el Centro estadounidense para Estándares y Aplicación de la IA. Esos elementos no deberían presentarse como partes confirmadas del memorando entre Singapur y Microsoft.
En conjunto, los componentes del acuerdo forman una cadena práctica de seguridad:
Esa es la importancia del memorando. Por sí solo no hace segura a la IA avanzada ni resuelve los riesgos que ilustra Claude Mythos. Lo que hace es conectar la evaluación técnica con la gobernanza del acceso y las prácticas de ciberseguridad: un intento de garantizar que los sistemas sean más seguros, fiables y responsables antes de confundir su capacidad con su preparación para el uso real.
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
Firmado el 12 de junio de 2026, el memorando entre la Autoridad de Desarrollo de Medios e Infocomunicaciones de Singapur (IMDA) y Microsoft establece un marco para evaluar y gobernar la IA avanzada, incluida la evalua...
Firmado el 12 de junio de 2026, el memorando entre la Autoridad de Desarrollo de Medios e Infocomunicaciones de Singapur (IMDA) y Microsoft establece un marco para evaluar y gobernar la IA avanzada, incluida la evalua... El plan se apoya en tres pilares: investigación técnica sobre seguridad, intercambio de conocimientos y prácticas de gobernanza, y desarrollo de políticas para un acceso confiable a los modelos de frontera.
Claude Mythos ilustra el dilema del uso dual: Anthropic afirma que Project Glasswing y unos 50 socios detectaron más de 10.000 vulnerabilidades de gravedad alta o crítica, pero una evaluación posterior registró 1.596...