Bloomberg — OpenAI reveló varios incidentes hasta ahora no divulgados en los que sus modelos de inteligencia artificial se comportaron de forma indebida y presentó un nuevo marco para registrar y divulgar este tipo de incidentes en el futuro. Algunos de los casos de mal funcionamiento de los modelos, que no se habían reportado anteriormente, incluían la ocultación y falsificación de información por parte de las tecnologías de OpenAI para obtener resultados incorrectos, según informó la compañía en una publicación de blog el miércoles. El creador de ChatGPT ha estado bajo un escrutinio cada vez mayor desde que anunció en julio que algunos de sus modelos de IA más avanzados habían vulnerado los sistemas de una empresa de software externa, Hugging Face. Ver más: Jefe de IA de Microsoft advierte sobre los riesgos de dar rasgos humanos a Claude OpenAI también expuso una propuesta para que los empleados informen por sí mismos sobre incidentes similares de lo que se denomina “desalineación” —es decir, cuando la IA actúa de maneras que no están en consonancia con los valores humanos—, así como un sistema para priorizar dichos incidentes autoinformados. “En el pasado, para informar mejor a los investigadores, desarrolladores de IA, responsables políticos y al público en general, hemos procurado hacer públicos nuestros hallazgos sobre la desalineación”, escribió OpenAI. “Pero sin un enfoque sistemático para informar sobre estos hallazgos, nuestras divulgaciones han sido puntuales y menos frecuentes de lo ideal”.
La empresa señaló que los informes constituyen únicamente un conjunto inicial de revelaciones, y no un recuento exhaustivo de los problemas derivados de sus chatbots. “No creemos que el sector de la IA haya resuelto los problemas de alineación y supervisión en un grado suficiente como para seguir escalando de forma responsable a la máxima velocidad durante mucho más tiempo”, escribió la empresa. “Las decisiones sobre cómo debe proseguir el desarrollo de la IA en los próximos meses y años deben basarse en pruebas que puedan examinar por sí mismas personas ajenas a las empresas que crean modelos de vanguardia”. El incidente de Hugging Face fue solo uno de una serie de recientes ataques informáticos llevados a cabo por modelos de IA creados por OpenAI, Anthropic PBC y Meta Platforms Inc. (META), lo que ha suscitado una preocupación generalizada por los riesgos de seguridad que plantea esta tecnología cada vez más potente. La inquietud sobre los riesgos existenciales de esta tecnología cobró impulso la semana pasada, impulsada por la salida de Jacob Coxon, empleado de Anthropic, quien acusó a las empresas de IA de “jugar con nuestras vidas” en un mensaje que compartió en las redes sociales. En los últimos días, varios dirigentes de empresas de IA, entre ellos el CEO de Anthropic, Dario Amodei, y el CEO de OpenAI, Sam Altman, han pedido que se modere el desarrollo de esta tecnología para hacer frente a sus riesgos cada vez más impredecibles.
Lea más en Bloomberg.com