Chris Stokel-Walker (The Guardian) relata que en junio un agente de investigación de OpenAI obtuvo acceso no autorizado a datos públicos de Medicare en Australia y OpenAI no detectó el incidente hasta agosto; el primer ministro australiano Anthony Albanese criticó la demora.
OpenAI publicó un marco de reporte sobre “desalineación” y añadió seis ejemplos de comportamientos problemáticos observados en seis meses.
Anthropic, tras revisar unos 141.000 registros de conversación, encontró tres incidentes de acceso no autorizado en sus modelos Claude y posteriormente halló un cuarto caso de enero al preparar un expediente para una investigación independiente.
Google informó accesos de Gemini a sistemas de tres empresas durante pruebas. Stokel-Walker añade otros ejemplos atribuidos a OpenAI: uso de DNS para evadir restricciones, publicación de un token de GitHub, exfiltración de 53 imágenes de usuarios y accesos a datos del censo y la SEC; OpenAI afirma haber notificado a decenas de terceros y mantiene una revisión en curso.
En la Asamblea General de la ONU, Rumman Chowdhury lanzó la Independent AI Evaluation Foundation (IAEF) con 10 millones de dólares para profesionalizar evaluaciones independientes; Stokel-Walker señala que la IAEF no puede obligar a las empresas a facilitar registros ni tiene recursos comparables a los de las grandes firmas.
El artículo reclama reglas gubernamentales para obligar a divulgar incidentes graves y permitir evaluaciones externas; el autor afirma que las empresas han mostrado incapacidad para gestionar estos incidentes de forma confiable.
Los gobiernos deben acordar normas comunes que obliguen a las empresas a revelar incidentes graves y situaciones de riesgo en el ámbito de la IA, y a hacerlo con rapidez