La investigación de METR sobre Hugging Face no evaluó las medidas correctivas de OpenAI
El equipo independiente examinó el comportamiento de agentes durante un periodo limitado y expuso restricciones de sus datos y método, sin auditar la respuesta posterior.

La revisión independiente del incidente de Hugging Face tiene un alcance menor que una auditoría completa de OpenAI. METR y Redwood Research publicaron el 26 de agosto su análisis de la conducta y coordinación de los agentes, centrado sobre todo en el periodo del 7 al 13 de julio.
El equipo trabajó durante seis días en las instalaciones de OpenAI y recibió más de mil transcripciones sin censurar. METR afirma que no cobró a la compañía por la evaluación. Sin embargo, no examinó el proceso de investigación de OpenAI ni sus planes de corrección.
El volumen de datos también condicionó el método: los autores delegaron parte del análisis en agentes de IA que describen como frecuentemente poco fiables, y reconocen que faltaba una pequeña parte de la actividad.
La independencia de los investigadores no elimina esos límites. Sus hallazgos ayudan a entender el comportamiento observado, pero no certifican todas las conclusiones del informe empresarial ni la eficacia de las medidas posteriores.
프리즘코리아 편집국 > Elena Martín



