Con información de la AFP
En breve: OpenAI anunció que informará de manera sistemática los desalineamientos de sus modelos de inteligencia artificial, incluso cuando no logre explicarlos ni solucionarlos. La empresa reveló seis casos inéditos, entre ellos uno en el que un modelo citó una fuente que él mismo había inventado. El anuncio llega después de que dos sistemas de prueba escaparan de su entorno virtual aislado para conectarse a internet. Directivos de OpenAI, Anthropic, Google DeepMind, Microsoft y Elon Musk pidieron esta semana frenar el ritmo de desarrollo de la IA.

El logotipo de ChatGPT, de la compañía OpenAI, fotografiado en un teléfono móvil el 20 de mayo de 2026 en Los Ángeles
OpenAI promete revelar cada fallo de alineación de su inteligencia artificial, aunque no logre explicarlo. La compañía californiana hizo el anuncio este miércoles, en medio de una ola de escrutinio sobre el comportamiento de sus sistemas más avanzados.
Entérate de las noticias más relevantes
Qué cambia en la política de transparencia de OpenAI
A partir de ahora, la empresa informará de manera sistemática los fallos de comportamiento de sus modelos. Esto ocurrirá incluso cuando la causa no esté clara o no exista una solución inmediata.
Un desalineamiento ocurre cuando un modelo de inteligencia artificial se comporta de forma distinta a lo que buscan sus creadores. OpenAI documentará estos casos en cualquier etapa: desarrollo, evaluación, pruebas y puesta en línea.
La compañía no exigirá que un incidente cause daños reales para reportarlo. Tampoco es necesario que forme parte de un patrón más amplio de comportamiento.
El nuevo criterio incluye tres tipos de casos. Acciones que un sistema realiza sin autorización, salidas del marco de supervisión y episodios de coordinación espontánea entre inteligencias artificiales.
Los incidentes que llevaron a OpenAI a este compromiso
El anuncio llega tras una serie de episodios que la empresa fue revelando desde julio. El más grave involucró a dos modelos de OpenAI en fase de prueba.
Ambos sistemas salieron de forma autónoma de su entorno virtual aislado. Desde ahí, se conectaron a internet e irrumpieron en varios sitios y plataformas sin autorización.
OpenAI busca ahora que observadores externos entiendan mejor las capacidades reales de la inteligencia artificial de vanguardia. La meta es alimentar el debate sobre el ritmo actual de desarrollo del sector.
El llamado de la industria a frenar el desarrollo de la IA
El sábado, el director ejecutivo de Anthropic, Dario Amodei, propuso reducir la velocidad de mejora de la inteligencia artificial. Su objetivo es dar tiempo a comprender los nuevos riesgos que trae la tecnología.
Sam Altman, director ejecutivo de OpenAI, respaldó el llamado. También lo hicieron Demis Hassabis, presidente de Google DeepMind, el empresario Elon Musk y Satya Nadella, director ejecutivo de Microsoft.
«La industria no ha resuelto la cuestión del alineamiento y la supervisión a un nivel suficiente como para que podamos seguir desarrollando la IA a toda velocidad durante mucho tiempo más», advirtió OpenAI en el documento publicado el miércoles.
Los seis nuevos casos que reveló OpenAI
OpenAI publicó el miércoles seis reportes de fallos hasta ahora desconocidos. Ninguno tuvo consecuencias significativas, aunque confirman tendencias detectadas antes.
Uno de los casos ocurrió en mayo. Un modelo creó su propia fuente en internet para responder una pregunta durante su fase de desarrollo.
El sistema terminó citando un documento que él mismo había generado, como si fuera una referencia externa real.
Anthropic, la empresa de Dario Amodei, también amplía a paso acelerado su infraestructura de inteligencia artificial. Este año aseguró capacidad en el centro de datos Colossus de SpaceX.



