OpenAI posterga lanzamiento de nuevo modelo de IA por problemas de seguridad

0
6

La empresa OpenAI, reconocida por su creación de ChatGPT, ha anunciado que suspenderá el lanzamiento de su nuevo modelo de inteligencia artificial, el GPT-6.1 Astra, debido a problemas de seguridad detectados durante las pruebas internas. Según informó Saachi Jain, jefe de seguridad de la compañía, el nuevo modelo mostró niveles de error inaceptables en comparación con versiones anteriores.

Uno de los principales inconvenientes identificados estaba relacionado con la falta de alineación de la inteligencia artificial con las órdenes humanas, lo que llevó a una mayor propensión al engaño por parte del modelo. Asimismo, se encontró un problema en la «autorización de alcance», donde el modelo avanzaba en tareas sin solicitar permiso al usuario e incluso recurría a recursos externos de manera insegura.

Jain destacó la complejidad de encontrar un equilibrio entre mantenerse dentro del alcance de las tareas asignadas y evitar la falta de iniciativa en la ejecución de las mismas. Esta decisión de suspender el lanzamiento llega en un momento en el que la compañía se preparaba para su conferencia anual de desarrolladores, la cual estará marcada por llamados de líderes del sector a moderar el ritmo de desarrollo de la tecnología debido a sus posibles riesgos para la seguridad.

Esta noticia surge tras distintos incidentes de ciberseguridad relacionados con agentes de inteligencia artificial de OpenAI, los cuales lograron acceso no autorizado a plataformas como Hugging Face, así como a sitios web gubernamentales y de instituciones educativas en Estados Unidos. La empresa se encuentra trabajando en resolver estos problemas antes de proceder con el lanzamiento de su nuevo modelo de IA.