Chính sách mở rộng có trách nhiệm (RSP) là chính sách quản lý rủi ro tự nguyện quy định rằng các công ty phát triển AI sẽ không tiến hành phát triển và phát hành mà không có các biện pháp an toàn bổ sung khi khả năng của mô hình đạt đến một mức rủi ro nhất định.
Chính sách mở rộng có trách nhiệm (RSP) là một phương pháp quản trị an toàn AI tự nguyện do Anthropic đề xuất vào năm 2023 và các khuôn khổ tương tự được cho là sẽ được OpenAI, Google DeepMind và các tổ chức khác áp dụng. Khả năng nguy hiểm của các mô hình (chẳng hạn như hỗ trợ tấn công mạng và nguy cơ chuyển hướng sang vũ khí sinh học) được phân loại thành "mức độ an toàn AI" theo từng cấp và nếu vượt quá ngưỡng, việc phát hành hoặc học tập sẽ không được tiến hành cho đến khi có các biện pháp an toàn bổ sung và đánh giá của đội đỏ. Trong thực tế hoạt động tính đến năm 2026, người ta đã chỉ ra rằng các tiêu chí đánh giá rất trừu tượng và khó xác minh từ bên ngoài, đồng thời tiêu chuẩn của mỗi công ty là khác nhau và khó so sánh. Khi chọn nhà cung cấp AI cho lĩnh vực này, các điểm thực tế cần xem xét không chỉ bao gồm sự hiện diện hay vắng mặt của RSP mà còn cả hồ sơ theo dõi về việc chấp nhận các đánh giá của bên thứ ba và tần suất cập nhật báo cáo an toàn. Vì việc tăng cường các biện pháp an toàn cũng có thể ảnh hưởng đến tốc độ phản hồi và cơ cấu chi phí của mô hình, nên cần lưu ý rằng chi phí kiểm tra an toàn có thể được chuyển sang phí sử dụng.