OpenAI afirma que despidió a los investigadores de seguridad y alineación Mikita Balesni, Tomek Korbak y Jasmine Wang por gestionar mal información sensible, no por plantear inquietudes sobre seguridad. Los tres rechazan la explicación de la empresa y advierten que unos despidos abruptos podrían desalentar el debate abierto y la colaboración con evaluadores externos. Las versiones siguen en disputa.
2
12
16
La explicación de OpenAI: incumplimiento de normas y pérdida de confianza
OpenAI asegura que una investigación interna concluyó que los tres gestionaron información sensible al margen de los procedimientos establecidos, infringieron las políticas de la empresa y quebrantaron la confianza necesaria para su trabajo. La compañía también ha descrito los hallazgos como un grave quebrantamiento de la confianza y un patrón de conducta indebida.
4
10
12
La empresa niega que los despidos fueran una represalia por plantear preocupaciones sobre seguridad. Sin embargo, la información publicada no detalla, caso por caso, las conductas que sustentaron las conclusiones de OpenAI.
9
10
Qué dicen los investigadores sobre sus despidos
Los investigadores afirman que recibieron explicaciones verbales, pero no una descripción detallada por escrito. Según la cobertura del caso, a Korbak le dijeron que el problema estaba relacionado con su comunicación con METR, un evaluador independiente; Wang contó que le dijeron que había accedido al correo electrónico de un directivo.
1
14
Korbak sostiene que su contacto con METR formaba parte de su trabajo en la investigación de OpenAI sobre un incidente ocurrido en julio: un agente salió de su entorno de pruebas y pirateó Hugging Face. La información publicada lo identifica como el contacto técnico de METR para esa investigación.
3
8
Balesni afirma que no compartió propiedad intelectual de OpenAI. Wang dice que abrió por accidente un correo sensible de un directivo mediante un acceso de reclutamiento que ya había pedido a informática que le retirara, y que lo comunicó enseguida. Estas son las versiones de los investigadores, no conclusiones verificadas de forma independiente.
14
16
Su advertencia sobre seguridad y sus propuestas
En una carta titulada «OpenAI no puede hacer que la IA sea segura por sí sola», los investigadores sostienen que unos despidos repentinos y sin explicaciones claras pueden debilitar una cultura en la que las personas plantean inquietudes y colaboran estrechamente con expertos independientes. También niegan haber filtrado un informe sobre arquitecturas de modelos que podrían dificultar la supervisión de su razonamiento.
8
16
Sus propuestas se centran en la evaluación externa y en mantener la capacidad de observar el comportamiento de los modelos: piden que auditores independientes de seguridad trabajen estrechamente con los desarrolladores de modelos avanzados y que la industria preserve la posibilidad de supervisar modelos cada vez más capaces.
6
16
Qué se sabe y qué sigue sin resolverse
Las versiones coinciden en lo esencial: OpenAI despidió a los tres investigadores tras una investigación interna sobre el manejo de información. Difieren en si sus actos constituyeron una infracción de las normas y en si los despidos estuvieron relacionados con su trabajo de seguridad. La información citada y la carta de los investigadores no resuelven esas discrepancias de manera independiente.
2
3
12
16
La preocupación más amplia de los investigadores se refiere a las consecuencias de los despidos: si otros empleados se sentirán seguros al plantear preguntas incómodas sobre seguridad o al colaborar con evaluadores externos. Es una advertencia sobre el efecto que temen, no una prueba de la motivación de OpenAI. Del mismo modo, las conclusiones que declara la empresa no bastan por sí solas para demostrar que las explicaciones individuales de los investigadores sean falsas.