Làm Chủ AI
Tin AI

Hugging Face Công Bố Bị Tấn Công Bởi Hệ Thống Agent AI, Dùng AI Để Điều Tra

3 phút đọc

Hugging Face công bố bị tấn công bởi hệ thống agent AI, dùng AI để điều tra

Công ty nói kẻ tấn công đã lấy quyền truy cập trái phép vào một tập dữ liệu nội bộ hạn chế và một số thông tin xác thực dùng cho dịch vụ của Hugging Face. Công ty khẳng định các model công khai, tập dữ liệu công khai và Spaces không bị can thiệp, và chuỗi cung ứng phần mềm không bị ảnh hưởng. Việc đối với dữ liệu của đối tác hoặc khách hàng vẫn đang được điều tra.

Hugging Face mô tả vụ tấn công bắt đầu từ đường xử lý dữ liệu, khi một tập dữ liệu độc hại lợi dụng hai đường thực thi mã trong xử lý tập dữ liệu: một loader tải tập dữ liệu qua mạng và một khai báo mẫu trong cấu hình tập dữ liệu. Kẻ tấn công sau đó leo thang lên cấp node, thu thập thông tin xác thực cloud và cụm, rồi di chuyển ngang qua nhiều cụm nội bộ trong suốt cuối tuần.

Công ty cho biết chiến dịch được điều phối hoàn toàn bởi một framework agent tự động, thực hiện hàng nghìn hành động cá thể thông qua nhiều sandbox tồn tại ngắn hạn và dùng hạ tầng điều khiển-từ xa tự di chuyển chạy trên dịch vụ công cộng. Hugging Face nói họ không biết model ngôn ngữ nào đã dùng để vận hành các agent tấn công.

Hugging Face phát hiện vụ việc qua một đường ống phát hiện bất thường được tăng cường AI, chạy phân loại LLM trên dữ liệu an ninh. Để phân tích hơn 17.000 hành động của kẻ tấn công, họ triển khai các agent phân tích do LLM điều khiển. Các agent này tái tạo dòng thời gian, trích xuất chỉ số xâm phạm, lập bản đồ các thông tin xác thực bị ảnh hưởng và phân tách thiệt hại thực sự khỏi hoạt động đánh lừa, công việc vốn có thể mất nhiều ngày nhưng đã hoàn thành trong vài giờ.

Khi nhóm an ninh thử phân tích nhật ký tấn công bằng các model tiên tiến chạy trên API thương mại, họ gặp trở ngại do các rào chắn an toàn của nhà cung cấp chặn các yêu cầu. Những yêu cầu cần gửi nhiều lệnh tấn công thực tế, mã khai thác và vật phẩm điều khiển-từ-xa đã vướng bộ lọc. Công ty chuyển sang dùng model mã nguồn mở GLM 5.2 chạy trên hạ tầng của chính họ, điều này giúp dữ liệu tấn công và thông tin xác thực không rời khỏi môi trường nội bộ.

Nguồn

Đọc tiếp trong Tin AI