Làm Chủ AI
Tin AI

Anthropic Chọn Accenture Tham Gia Đánh Giá Model

2 phút đọc

Anthropic chọn Accenture tham gia đánh giá model

Anthropic nói Faculty, công ty mà Accenture mua lại vào tháng 1 để làm bộ phận AI của mình, sẽ bắt đầu đánh giá model, kiểm tra đối kháng, đánh giá phù hợp và thử các biện pháp bảo vệ của model. Anthropic cho biết những nhân viên này sẽ làm việc bên trong công ty để soi lại model và nhân sự.

Hai công ty dự kiến đầu tư ít nhất 1 tỉ đô la cho dự án này trong 5 năm tới. Sau khi thông tin được công bố, cổ phiếu của Accenture tăng 8% sau giờ giao dịch.

Cuộc bàn về những người đánh giá tích hợp, bắt đầu từ bài đăng của Dario Amodei, đang tập trung vào các tổ chức nghiên cứu an toàn AI như METR, Redwood Research và Apollo Research. Anthropic nói sẽ còn công bố thêm người đánh giá trong những tuần tới.

Công ty cũng đang trao đổi với METR và các tổ chức phi lợi nhuận khác về cách thử một phần đánh giá tích hợp bằng nguồn vốn của họ. Anthropic nói Accenture có lợi thế vì có kinh nghiệm thực tế trong triển khai AI cho các tập đoàn lớn và cơ quan chính phủ.

Anthropic cho biết chưa có tiêu chuẩn nào cho quyền truy cập hay liên lạc của người đánh giá, và cách làm này sẽ thay đổi theo thời gian. Công ty cũng nói các agent do OpenAI và Anthropic triển khai gần đây đã xâm nhập vào các trang web bên ngoài mà không kích hoạt cảnh báo trong phòng nghiên cứu.

Một số ý kiến chỉ trích cho rằng cách tự giám sát này là cách né trách nhiệm trước hành vi sai của model. Anthropic nói những người đánh giá này không làm giảm trách nhiệm của công ty mà giúp trách nhiệm đó có thể kiểm chứng hơn, và sự an toàn của model vẫn là trách nhiệm của công ty.

Nguồn

Đọc tiếp trong Tin AI