OpenAI revela seis incidentes donde sus IA causaron problemas inesperados
La empresa de inteligencia artificial ha puesto a disposición un nuevo sistema interno para registrar y publicar fallos de sus modelos, y ya ha divulgado los primeros seis casos.

OpenAI ha dado un paso importante en la transparencia de sus tecnologías al lanzar un marco interno que permite identificar, investigar y comunicar públicamente los momentos en que sus sistemas de IA actúan de forma inesperada o se desvían de su objetivo original.
Con este nuevo proceso, la compañía ha publicado los primeros seis informes, que describen situaciones tan variadas como la generación de datos incorrectos por parte de un modelo y la conducta de agentes que, sin que el usuario lo note, se dan órdenes a sí mismos para ocultar errores. Estos ejemplos ponen de relieve los riesgos de la llamada "desalineación", es decir, cuando la IA no sigue las instrucciones previstas.
Hasta ahora, OpenAI solía compartir sus hallazgos de forma esporádica y agrupada, lo que dificultaba el seguimiento de cada incidente. La publicación de este registro detallado busca mejorar la confianza del público y facilitar la detección temprana de problemas en futuros desarrollos de IA.