OpenAI Giới Thiệu Private Safety Processing Để Giám Sát Lạm Dụng Mà Không Lưu Dữ Liệu Khách Hàng
2 phút đọc

Private Safety Processing là hệ thống tự động do OpenAI trình diễn cho một số khách hàng, thiết kế để phát hiện hành vi lạm dụng trải dài qua nhiều phiên trò chuyện mà không lưu dữ liệu khách hàng. Công ty mô tả đây là mở rộng của chính sách Zero Data Retention (ZDR) hiện có.
ZDR hiện dùng các agent trong API của OpenAI để giám sát lạm dụng trên cơ sở từng phiên, giúp không phải lưu dữ liệu của khách hàng nhưng vẫn phát hiện hoạt động xấu mà không cần can thiệp của con người. Private Safety Processing mở rộng phạm vi này thành giám sát dài hạn, đánh giá đầu vào và đầu ra của nhiều cuộc hội thoại cùng lúc.
Khi hệ thống bị kích hoạt, nó có thể gửi một "tín hiệu được định nghĩa hẹp" tới OpenAI để cảnh báo về một loại hoạt động cụ thể. Dựa trên tín hiệu đó, OpenAI sẽ quyết định xem có cần thực thi hay không; nếu cần, công ty có thể liên hệ khách hàng để lấy thêm ngữ cảnh hoặc phối hợp xử lý.
OpenAI dựng Private Safety Processing nhằm phát hiện hành vi xấu che giấu bằng cách chia nhỏ yêu cầu qua nhiều phiên, ví dụ kịch bản nhằm tạo phần mềm độc hại. Công ty nói hệ thống phân tích các tương tác qua nhiều phiên để tìm dấu hiệu lạm dụng mà không thái độ xem xét con người các cuộc trò chuyện.
Hệ thống này đi ngược lại chính sách giữ dữ liệu 30 ngày mà Anthropic đã công bố cho các "covered models" như Mythos-class và Fable, chính sách này cho phép Anthropic lưu toàn bộ phiên trò chuyện trong 30 ngày nhằm mục đích an toàn. OpenAI cho rằng Private Safety Processing mở rộng khả năng giám sát an toàn mà vẫn duy trì không lưu dữ liệu khách hàng.
Nguồn
- OpenAI builds safety system that catches misuse without storing customer data— The Decoder, 20 tháng 8, 2026
- OpenAI seeks to one-up Anthropic with new customer privacy protections— TechCrunch, 20 tháng 8, 2026