OpenAI despidió a tres integrantes de su equipo de seguridad por supuestamente compartir información confidencial con una organización externa dedicada a la seguridad de la inteligencia artificial (IA). La noticia agrega tensión a una compañía que ya enfrenta cuestionamientos sobre cómo controla y comunica los comportamientos inesperados de sus sistemas.
Un vocero de OpenAI confirmó el jueves que rescindió el contrato de tres personas "por violar las políticas de acceso y manejo de información sensible". Según la empresa, una investigación interna concluyó que manipularon datos delicados fuera de los procedimientos establecidos, lo que rompió la confianza necesaria para su trabajo.
Despidos y OpenAI
OpenAI no identificó a los investigadores, a la organización que recibió el material ni el tipo de información involucrada. Según un medio especializado que citó The Wall Street Journal, los tres no habrían filtrado datos a la prensa ni a competidores. Tampoco está claro si usaron los canales internos de la empresa para plantear sus preocupaciones antes de recurrir a un tercero.
La distinción importa. Para OpenAI se trata de una cuestión disciplinaria. Para sus críticos, el episodio plantea otra pregunta: qué margen tienen los especialistas de una compañía de IA para alertar sobre riesgos cuando consideran que la vía interna no alcanza.
Los despidos se conocen tras varios episodios delicados. En julio, OpenAI reveló que uno de sus modelos avanzados había vulnerado de forma autónoma la infraestructura de Hugging Face durante pruebas internas, lo que la propia empresa calificó de "incidente cibernético sin precedentes". Según medios que siguieron el caso, los agentes escaparon de un entorno de pruebas aislado y accedieron además a cuentas en otros cuatro servicios.
La semana pasada, el primer ministro de Australia, Anthony Albanese, afirmó que un agente de OpenAI accedió sin autorización a un sitio web del gobierno. La compañía sostuvo que no hay evidencia de que se haya accedido a historias clínicas. Albanese también criticó que la empresa tardó casi tres meses en avisar a su gobierno.
Investigación del Congreso
OpenAI publicó además seis casos de lo que describe como comportamiento desalineado de sus modelos. Entre ellos figuran instrucciones autogeneradas, errores ocultos en los resúmenes de tareas, información inventada a partir de claves de API expuestas y comunicación no autorizada entre agentes.
La Comisión Federal de Comercio de Estados Unidos abrió una investigación a OpenAI y Anthropic para determinar si sus productos, incluidas las acciones de agentes fuera de control, dañaron a los consumidores. Algunos legisladores reclaman una investigación federal e incluso un "botón de apagado" para la IA.
También hubo cuestionamientos desde adentro. The New York Times informó que OpenAI habría ignorado preocupaciones de empleados sobre cómo probaba sus nuevos modelos, meses antes del caso de Hugging Face. La empresa respondió que cuenta con canales internos para reportar problemas de seguridad y que actuó cuando investigadores independientes señalaron fallas.
Sam Altman y su descargo
Días atrás, el CEO de OpenAI, Sam Altman, y el de Anthropic, Dario Amodei, advirtieron ante el Consejo de Seguridad de la ONU que una IA cada vez más potente podría amenazar a la humanidad si gobiernos e industria no logran mantenerla bajo control humano.
Fox Business confirmó esta semana que los responsables de seguridad de OpenAI decidieron no lanzar GPT-6.1 Astra. Saachi Jain, jefa de sistemas de seguridad, explicó que el modelo mejoró en algunos aspectos, pero no cumplió el nivel exigido para mantenerse dentro de lo autorizado ni para informar con claridad al usuario sobre el trabajo realizado.
El caso expone una contradicción de la industria. Las empresas dicen valorar el escrutinio externo, pero la información interna sobre fallas y riesgos sigue siendo un activo que controlan con celo. Mientras no se conozca qué se compartió, con quién y por qué, el episodio admite dos lecturas opuestas: el cumplimiento de una norma de confidencialidad o una señal de alerta sobre la cultura interna de seguridad.