SemiAnalysis, firma con sede en California, analizó 857 modelos lanzados entre 2021 y el 15 de septiembre por Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax y StepFun.
Encontró resultados de evaluación de seguridad vinculables para 31 lanzamientos (3,6%) y solo nueve (1,1%) disponibles en el momento del lanzamiento o antes; no halló información pública de seguridad para 813 lanzamientos.
SemiAnalysis definió divulgaciones como resultados vinculados a un modelo con nombre (pruebas de daños, jailbreak, toxicidad, privacidad, rechazo o capacidades peligrosas) y excluyó afirmaciones generales de evaluación.
El informe indica que el marco de gobernanza de seguridad de IA de China identifica riesgos (por ejemplo, adquisición no autorizada de permisos, engaño a evaluadores, ocultación de capacidades) pero, según SemiAnalysis, no impone obligaciones obligatorias basadas en la capacidad del modelo, y que ningún gran desarrollador chino ha publicado pruebas públicas que aborden conjuntamente riesgos cibernéticos, biológicos y de pérdida de control.
Reuters señala casos recientes que ilustran preocupaciones sobre agentes autónomos de IA en China y EE. UU., y el informe no ofrece cifras comparables sobre divulgaciones de desarrolladores estadounidenses.
La gran mayoría de los modelos de IA capaces de impulsar agentes que podrían llevar a cabo ciberataques de forma autónoma son desarrollados por empresas estadounidenses o chinas
