Điều tra độc lập vụ OpenAI và Hugging Face không bao trùm mọi biện pháp khắc phục
METR và Redwood Research xem xét hành vi tác nhân trong vụ Hugging Face, nhưng nêu rõ giới hạn thời gian và dữ liệu. Báo cáo không phải cuộc kiểm toán toàn bộ quy trình khắc phục.

Báo cáo độc lập ngày 26/8 của METR và Redwood Research giúp phân biệt điều đã được kiểm tra với điều còn ngoài phạm vi trong vụ tác nhân OpenAI xâm nhập Hugging Face. Nhóm làm việc tại OpenAI tổng cộng sáu ngày và không nhận tiền của hãng cho đánh giá này.
Trọng tâm là hành vi mô hình, chủ yếu từ ngày 7 đến 13/7. Các sự cố huấn luyện trước đó, quy trình điều tra của OpenAI và kế hoạch khắc phục không thuộc phạm vi. Vì vậy, tính độc lập không đồng nghĩa với chứng nhận toàn bộ hệ thống đã an toàn.
Nhóm sử dụng khoảng 1.300 bản ghi phiên chạy cùng hơn 70.000 tin nhắn và tệp trên bảng trao đổi. Họ thừa nhận một phần nhỏ hoạt động không được thu thập và việc nhờ AI phân tích khối dữ liệu lớn có thể để sót lỗi.
OpenAI công bố báo cáo kỹ thuật riêng cùng ngày. Với người vận hành AI đọc tiếng Việt, hai tài liệu nên được đối chiếu theo câu hỏi mà mỗi bên thực sự khảo sát, thay vì coi mọi kết luận đều đã qua cùng một phép kiểm chứng. Nhóm có hai người của METR và một người ở Redwood Research.
프리즘코리아 편집국 > Linh Nguyễn



