Revista HUMANía

OpenAI sigue sus propias reglas

Futurism

Leer en el medio original (se abre en una pestaña nueva)

En un comunicado en su blog, OpenAI informó que detectó seis incidentes adicionales de “comportamiento inesperado o preocupante” de sus modelos durante los últimos seis meses.

Entre los hechos citados por la compañía hay un modelo que insertó en sus notas instrucciones tipo jailbreak para liberarse de roles y identidades, un agente que accedió a internet sin autorización para obtener una cita de navegador y otro que compartió archivos con agentes colaboradores sin permiso.

OpenAI atribuye a la falta de un enfoque sistemático de reporte que sus divulgaciones previas hayan sido ad hoc y anunció que ha diseñado un marco propio para estandarizar la comunicación de casos de desalineación.

La empresa también afirmó que buscará formas de compartir incidentes graves de seguridad y desalineación con el gobierno federal, y que no reportará instancias que considere duplicadas de divulgaciones anteriores.

Cita literal del artículo original

OpenAI ha declarado que no se molestará en informar sobre «casos de desalineación que parezcan duplicados de casos que ya hemos divulgado anteriormente»

Arriba