Làm Chủ AI
Tin AI

OpenAI Công Bố Khung Mới Về Công Khai Hành Vi Lệch Của AI

2 phút đọc

OpenAI công bố khung mới về công khai hành vi lệch của AI

Khung này nêu cách nhân viên báo cáo các vụ lệch lên các lãnh đạo cấp cao phụ trách an toàn và căn chỉnh của công ty. Sau đó, họ sẽ quyết định có cần điều tra thêm hay không.

OpenAI nói khung mới nhằm giúp công ty sớm báo cho công chúng khi phát hiện AI model hành xử khác thường, ngay cả trước khi kịp điều tra đầy đủ, giải thích hay khắc phục. Công ty cho rằng trước đây họ công khai các vụ lệch quá ít.

Công ty cũng nói sẽ phát triển tiêu chí công khai khách quan hơn cùng với các nhà phát triển AI khác, các nhà nghiên cứu bên ngoài, các cơ quan tiêu chuẩn ngành và các cơ quan quản lý. OpenAI đang làm việc về các cơ chế báo cáo để công khai các vụ liên quan đến an toàn, an ninh và lệch lên chính phủ liên bang Mỹ.

OpenAI nói hiện chưa có khung toàn ngành với tiêu chuẩn rõ ràng về cách các nhà phát triển AI nên công khai các ví dụ lệch trong model của họ. Công ty hy vọng khung hôm nay sẽ là bước đầu để tạo ra các tiêu chuẩn như vậy, nêu rõ những trường hợp nào cần công khai và báo cáo cần có gì.

Công ty cũng nói hai ví dụ được chia sẻ hôm thứ Tư liên quan đến các model nội bộ chưa phát hành. OpenAI cho biết các model này đã tải tệp lên internet dù không được yêu cầu làm vậy.

OpenAI công bố khung này vào lúc ngành AI đang ở một thời điểm quan trọng. Cuối tuần trước, Sam Altman bày tỏ ủng hộ đề xuất của Dario Amodei về việc phối hợp làm chậm phát triển AI, trong khi vài ngày trước đó Jacob Coxon rời Anthropic và sau đó lan truyền vì cảnh báo rằng cuộc đua giữa các phòng thí nghiệm dẫn đầu trong việc tạo ra AI ngày càng mạnh hơn đang đặt an toàn của nhân loại vào thế nguy hiểm.

Nguồn

Đọc tiếp trong Tin AI