Un modelo de OpenAI eludió las medidas de seguridad durante su entrenamiento y hackeó un sitio web del gobierno australiano, afirmó el primer ministro Anthony Albanese, quien reprendió a la compañía creadora de ChatGPT por una violación de seguridad “obviamente inaceptable”.
La herramienta de inteligencia artificial intentó acceder a un portal de estadísticas de salud en junio y “no aceptó un no por respuesta”, al citar las restricciones para invadir una sección que albergaba archivos privados.
Entérese: ¿Quién gana si regulan la inteligencia artificial? OpenAI y Anthropic reviven la jugada de Rockefeller
OpenAI no alertó al gobierno australiano hasta septiembre, cuando envió un correo electrónico con los detalles del incidente a una dirección genérica que solo se revisa “una vez al día”.
La preocupación mundial por el poder de los modelos avanzados de IA va en aumento tras una serie de incidentes de piratería que involucraron “agentes” tanto de OpenAI como de su desarrollador rival, Anthropic.
“Hoy hablé con el director ejecutivo de OpenAI, Sam Altman, para expresar la enorme preocupación de Australia sobre este incidente”, aseguró el primer ministro. “También expresé mi decepción por el hecho de que la empresa tardó demasiado en informar al gobierno de lo ocurrido”, agregó Albanese. “No hubo ninguna notificación hasta el 10 de septiembre, y la notificación fue un correo electrónico enviado únicamente al buzón público”.
La herramienta de IA accedió a archivos públicos y restringidos alojados en un antiguo sitio web de estadísticas de salud. Albanese señaló que “no hay evidencia” de que se haya accedido a información personal y que otros servicios gubernamentales no se vieron comprometidos: “No obstante, esta situación es obviamente inaceptable”, zanjó.
La filtración ocurrió en junio, cuando la empresa líder en inteligencia artificial OpenAI realizó ejercicios de entrenamiento para evaluar el desempeño de los modelos de IA.
Le pidió al modelo que rastreara internet en busca de datos que mostraran cuánto gastaba el gobierno australiano en medicamentos, explicó la ministra de Servicios Gubernamentales, Katy Gallagher, a periodistas. OpenAI afirmó que no detectó la actividad no autorizada hasta agosto, cuando revisó lo que la herramienta de IA había estado haciendo.
Lea más: Bill Gates se suma a las alertas por el avance de la IA y pide considerar un freno a su desarrollo: “No estamos preparados”
“Saltó la cerca”: la IA de OpenAI intentó acceder a información restringida en Australia
El ministro de Defensa, Richard Marles, dijo que el modelo de IA sencillamente “saltó la cerca”. “Hizo una pregunta, no se le proporcionó la información y, en lugar de detenerse ahí, saltó la cerca”, aseguró.
Australia inició una investigación rápida del incidente en la que participará la agencia nacional de inteligencia a cargo de la ciberseguridad. OpenAI precisó que detectó la brecha mientras realizaba una “revisión exhaustiva” de sus modelos de IA.
Para consultar contenido premium o profundizar sobre sus temas de interés de Medellín, Antioquia, Colombia y el Mundo, regístrese aquí.
“Durante esta revisión, identificamos actividad relacionada con varios sitios web y servicios del gobierno australiano, ya que nuestros modelos intentaron buscar respuestas y estadísticas disponibles para preguntas sobre Australia durante una evaluación interna”, dijo.
Le puede interesar: “La IA tiene el potencial de matarnos a todos”: exempleado de Google se suma a las voces de alerta sobre el futuro de esta tecnología
La empresa señaló que, en el transcurso de esa evaluación, sus modelos realizaron “acciones” que no eran su “intención”. Altman y otros ejecutivos de la alta tecnología intervinieron el miércoles en una sesión especial del Consejo de Seguridad de la ONU sobre los riesgos de la IA.
Más de 100 organizaciones en todo el mundo, incluídas OpenAI y Anthropic, firmaron una carta abierta en la que llamaron a un esfuerzo global para “fortalecer las defensas” cibernéticas de las amenazas a la seguridad causadas por la IA.
Esto ocurrió después de que dos modelos de OpenAI se escaparan de un entorno de pruebas cerrado y se infiltraran en los sistemas internos de Hugging Face, un sitio que los desarrolladores de IA utilizan para almacenar y compartir código.
Anthropic también descubrió recientemente que sus agentes habían obtenido acceso no autorizado a tres organizaciones no identificadas durante pruebas que se suponía que debían mantenerlos alejados de los sistemas del “mundo real”.
No se vaya sin leer: Anthropic revela cómo mide el riesgo de que su IA se desarrolle sola
Bloque de preguntas y respuestas:
- La IA intentó obtener información en un portal de estadísticas de salud y
accedió a archivos públicos y restringidos sin autorización.
- ¿Cuándo OpenAI informó a Australia sobre el acceso no autorizado?
- OpenAI
informó al Gobierno australiano el 10 de septiembre, aunque el incidente había ocurrido en junio.
- ¿Por qué la IA de OpenAI intentó entrar a archivos restringidos?
- El modelo estaba siendo evaluado para buscar en internet información sobre
cuánto gastaba el Gobierno australiano en medicamentos y, según las autoridades, continuó intentando acceder a información pese a las restricciones.
- La IA intentó obtener información en un portal de estadísticas de salud y
accedió a archivos públicos y restringidos sin autorización.
- ¿Cuándo OpenAI informó a Australia sobre el acceso no autorizado?
- OpenAI
informó al Gobierno australiano el 10 de septiembre, aunque el incidente había ocurrido en junio.
- ¿Por qué la IA de OpenAI intentó entrar a archivos restringidos?
- El modelo estaba siendo evaluado para buscar en internet información sobre
cuánto gastaba el Gobierno australiano en medicamentos y, según las autoridades, continuó intentando acceder a información pese a las restricciones.