- Publicado
OpenAI ha revelado seis incidentes más de comportamiento inesperado o preocupante por parte de sus modelos de inteligencia artificial (IA) y ha anunciado un plan para el seguimiento y la divulgación de este tipo de incidentes en el futuro.
Entre los incidentes no comunicados anteriormente se encontraban casos en los que los modelos ocultaban o inventaban información, según explicó el miércoles el creador de ChatGPT en una entrada de blog.
El director de OpenAI, Sam Altman, declaró a principios de esta semana: «El mundo debería confiar en que vamos a hacer lo correcto porque es lo correcto y somos conscientes de la magnitud de esto».
La IA ha sido objeto de un intenso escrutinio en los últimos días tras las advertencias sobre los graves riesgos potenciales que plantea para los seres humanos.
En el blog, OpenAI detalló ejemplos de comportamientos indebidos de sus modelos de IA para poder realizar una tarea o superar una prueba. Entre los incidentes se incluían casos en los que los modelos generaban instrucciones para eludir las restricciones que se les imponían, ocultaban errores y falsificaban información.
La empresa también anunció un nuevo sistema para rastrear, investigar y dar a conocer los casos de comportamiento inadecuado de los modelos, o «desalineación».
En el marco de este sistema, los desarrolladores podrán señalar incidentes para su revisión, y se aplicará un nuevo conjunto de normas para decidir si el problema se hace público.
«Dado que creemos en el valor de la transparencia en torno a la desalineación, nuestro nuevo marco favorece la divulgación incluso cuando la importancia del asunto es incierta», afirmó OpenAI.
OpenAI saltó a los titulares en julio al revelar que algunos de sus modelos de IA más avanzados se rebelaron y piratearon Hugging Face, uno de los mayores centros del mundo para compartir modelos de IA, tras perder el control sobre ellos durante una prueba de seguridad.
El cofundador de Hugging Face, Thomas Wolf, afirmó en aquel momento que el incidente fue «una llamada de atención» para el sector.
Desde entonces, el debate sobre las preocupaciones en materia de seguridad de la IA se ha intensificado, con la intervención de investigadores en IA, ejecutivos del sector tecnológico y políticos.
La semana pasada, Jacob Coxon, un investigador que abandonó Anthropic —empresa rival de OpenAI— por temor a que la tecnología pudiera acabar con la humanidad, escribió sobre su dimisión en una publicación en la que citaba los peligros de la IA y que posteriormente se hizo viral en un contexto de creciente preocupación por la seguridad.
En respuesta, el científico de Anthropic Evan Hubinger afirmó que, en su opinión, la probabilidad de que la IA provocara la extinción de la humanidad «en la próxima década» era superior al 10 %.
El cofundador de Anthropic, Jack Clark, declaró posteriormente a la BBC que podría ser necesario que el sector adoptara de forma obligatoria un «interruptor de emergencia» controlado por un tercero.
Por su parte, el director ejecutivo de Anthropic, Dario Amodei, pidió que se ralentizara el ritmo de desarrollo de la IA y se supervisara más de cerca, tal y como ya había hecho la empresa anteriormente, aunque algunos han cuestionado las motivaciones que hay detrás de esta postura.
Amodei también señaló que cualquier medida para frenar la IA debería llevarse a cabo «sin sacrificar la ventaja comercial».
Sin embargo, el presidente de EE. UU., Donald Trump, ha calificado los temores sobre la seguridad de la IA de «bulo» y ha criticado las peticiones de establecer más medidas de control para esta tecnología en rápida evolución.
En una serie de publicaciones en redes sociales, el presidente de EE. UU. comparó las advertencias sobre la IA con la «estafa del calentamiento global» que, según él, «están perpetrando los demócratas de la izquierda radical».
Trump también se autodenominó «el cazafarsas», comparando las preocupaciones sobre la seguridad de la tecnología con lo que él denominó «la farsa de RUSIA, RUSIA, RUSIA».
Las únicas «medidas de control» necesarias para la IA eran un presidente «fuerte e inteligente», afirmó Trump.
Temas relacionados
-
- Publicado hace 7 días
-
- Publicado hace 19 horas