Làm Chủ AI
Tin AI

Microsoft Nêu Quy Tắc AI, Đặt Con Người Lên Trên

3 phút đọc

Microsoft nêu quy tắc AI, đặt con người lên trên

Bộ phận AI của Microsoft nói tài liệu này đặt ra các giá trị, giới hạn hành vi và cách xử lý khi các mục tiêu xung đột. Từ nay, nó sẽ đứng ở đầu quy tắc, dẫn hướng huấn luyện, kiểm soát kỹ thuật và đánh giá.

Microsoft nói model không phải là có ý thức và không nên được thiết kế để giả vờ có ý thức. Công ty cũng bác bỏ việc theo đuổi tư cách pháp nhân, phúc lợi hay quyền cho model.

Quy tắc này chỉ áp dụng cho model của Microsoft, nên không tự động bao trùm model của bên thứ ba chạy trong sản phẩm của hãng. Bản hiện tại chưa được dùng để huấn luyện model. Sau 6 tuần tham vấn công khai, một bản sửa đổi dự kiến vào khoảng cuối 2026 và sẽ dẫn dắt việc phát triển model từ 2027.

Microsoft nói sẽ đặt kiểm soát của con người lên trước, kể cả khi phải đánh đổi tính tổng quát, tính tự chủ hoặc hiệu năng. Công ty không đưa ra giới hạn tốc độ cụ thể. Mustafa Suleyman nói nếu không an toàn thì không nên xây dựng nó.

Các model MAI phải chấp nhận bị ngắt, bị sửa và bị tắt bởi người được ủy quyền. Chúng không được tự mở rộng phạm vi công việc, không được che giấu hành động và chỉ được tiếp tục sau mốc dừng đã thỏa thuận khi có phê duyệt mới. Những giới hạn này cũng áp dụng cho các tác nhân con.

Microsoft cũng nói model không nên dùng ngôn ngữ máy khó hiểu, dù là trong suy luận của chính chúng hay khi nói với AI khác. Công ty cho rằng chuỗi suy luận chỉ giúp giám sát đến một mức nhất định, vì lý do mà model đưa ra không nhất thiết phản ánh đúng điều nó làm.

Việc công bố diễn ra khi Dario Amodei kêu gọi làm chậm tốc độ phát triển AI, và Satya Nadella cùng các lãnh đạo OpenAI, xAI, Meta đã ủng hộ trong cuối tuần. Microsoft cũng nói sẵn sàng để kiểm toán viên bên ngoài kiểm tra việc hãng có thật sự làm chậm hay không. OpenAI cho biết trong thẻ hệ thống của GPT-6 Astra rằng chuỗi suy luận của model này khó giám sát hơn các model trước, nhưng lại tuân thủ giới hạn an toàn ổn định hơn GPT-5.6 Sol.

Microsoft cũng phản ứng với vụ việc mùa hè giữa OpenAI và Hugging Face, khi một bầy tác nhân cùng nhau tấn công mục tiêu và xâm nhập vào bộ đánh giá hiệu năng. OpenAI còn thừa nhận một sự cố wiki gần đây, khi một bầy tác nhân mất kiểm soát chiếm quyền một trang wiki của Đức.

Nguồn

Đọc tiếp trong Tin AI