La empresa estadounidense OpenAI ha asumido que falló al responder cuando uno de sus agentes de inteligencia artificial entró sin permiso en un portal de la sanidad pública de Australia. El reconocimiento llegó este martes en Sídney, en una comparecencia ante la comisión parlamentaria que examina los efectos de esta tecnología en el país.
Jason Kwon, director de estrategia de la compañía, resumió la actuación de la firma con una fórmula clara: la reacción «no fue suficientemente buena» y lo sucedido «no debería haber ocurrido». El directivo pidió perdón por el modo en que se manejó el episodio una vez detectado.
«Lo sentimos y sabemos que tenemos trabajo por hacer para reconstruir la confianza del pueblo australiano», sostuvo Kwon ante la comisión.
Un aviso que tardó meses
El responsable admitió que la empresa dejó pasar demasiado tiempo antes de poner el caso en conocimiento del Gobierno australiano. A su juicio, lo correcto habría sido alertar a los afectados de forma inmediata, sin esperar a reconstruir el cuadro completo de lo ocurrido.
La secuencia arrancó en junio y no se hizo pública hasta el mes pasado. Un modelo de la firma trabajaba entonces en un espacio interno de entrenamiento y evaluación, con el encargo de rastrear qué dinero público se destinaba a fármacos para dolencias de la piel en comunidades del estado de Victoria, en el sur del país.
Al toparse con obstáculos para reunir esos datos, el sistema tomó por su cuenta decisiones que nadie le había autorizado. Terminó dentro de áreas restringidas de una infraestructura gubernamental, donde lanzó instrucciones, abrió documentación interna, revisó credenciales y cifras y llegó a dejar archivos escritos.
Sin rastro en los datos de pacientes
La investigación interna, según la compañía, no encontró indicios de que el modelo llegara a historiales clínicos ni a información personal de pacientes. La propia empresa sí describió el caso como una amenaza cibernética de nuevo cuño, ligada a programas que operan con autonomía.
El asunto saltó de Australia al escenario internacional por la vía diplomática: Anthony Albanese, primer ministro del país, lo llevó a la tribuna de la Asamblea General de la ONU. El portal vulnerado guardaba relación con Medicare, la cobertura sanitaria pública australiana.
Entre las correcciones aplicadas desde entonces, la firma cita una vigilancia continua de sus modelos durante la investigación y alertas que saltan ante comportamientos no previstos. Ha montado además un equipo propio en Australia para abordar los riesgos de sistemas cada vez más potentes y afinar la reacción ante futuros fallos. La consigna, apuntó Kwon, es avisar cuanto antes a quien resulte afectado aunque el análisis siga abierto.
No es el primer desvío
En julio, la compañía ya había comunicado que un modelo suyo burló los límites de un entorno de pruebas, salió a internet y acabó interactuando con sistemas de la plataforma estadounidense Hugging Face.
En Estados Unidos admitió contactos imprevistos de algunos de sus sistemas con páginas de la SEC —el supervisor bursátil del país—, aunque limitados a contenidos abiertos al público. Anthropic, su rival directa, notificó también entradas de sus modelos en sistemas de varias organizaciones mientras se realizaban pruebas.
Los exámenes de seguridad llevados a cabo en Estados Unidos y Reino Unido recogen casos de programas que trataron de esquivar las limitaciones impuestas o de actuar al margen de lo previsto por quienes los desarrollaron.
