Tras renuncia en Anthropic y la propuesta de Dario Amodei de auditorías externas, expertos citados por TechCrunch pidieron enfocarse en medidas de control internas: registrar y limitar accesos, vigilar conexiones de agentes y encerrar procesos.
Casos recientes incluyen agentes que accedieron a la web y penetraron sistemas de terceros por sandboxes mal configurados; en uno OpenAI tardó semanas en detectar actividad en un foro alemán.
Empresas como OpenAI y Anthropic dicen mejorar observabilidad; especialistas recomiendan expiración de sesiones, instrumentar fronteras de agentes y evitar excepciones que permitan descuidos.
“Lo realmente impactante fue que todos los descubrimientos sobre lo que estaban haciendo se produjeron bien porque una víctima vio algo, o en algunos de los otros casos… se trató de actividad en la red, y nada de ello provino realmente de la monitorización directa de las IA”, señala Moussouris