ReviewAI
Xếp hạngDanh mụcKhám pháTạp chíSo sánhMiễn phíTừ điển

Cam kết an toàn của Frontier AI

Cam kết An toàn AI của Frontier là một khuôn khổ thỏa thuận tự nguyện để phát triển an toàn AI mà các công ty AI tiên tiến như OpenAI, Anthropic và Google hứa hẹn với các chính phủ trên toàn thế giới.

Cam kết An toàn AI Biên giới là một khuôn khổ tự quản lý được ký kết bởi các chính phủ và công ty AI từ hơn 20 quốc gia, bao gồm Hoa Kỳ, EU và Nhật Bản, bắt đầu từ Hội nghị Thượng đỉnh An toàn AI Bletchley Park năm 2023 ở Anh. Hơn 15 công ty lớn, bao gồm OpenAI, Anthropic, Google DeepMind, Microsoft và Meta, đã ký thỏa thuận và thỏa thuận này bao gồm bốn trụ cột: 1) đội đỏ (đánh giá năng lực) trước khi phát hành, 2) chính phủ chia sẻ kết quả đánh giá an toàn, 3) triển khai hình mờ trên nội dung do AI tạo sinh và 4) xác minh của bên thứ ba về các khả năng nguy hiểm như vũ khí sinh học và hỗ trợ tấn công mạng.

Tính đến năm 2026, cạm bẫy lớn nhất trong hoạt động thực tế là “cam kết chỉ trở thành bề ngoài”. Các công ty được phép xác định các tiêu chuẩn riêng của họ để kiểm tra an toàn và việc kiểm tra của bên thứ ba chưa được thực hiện bắt buộc. Từ quan điểm của các nhà phát triển AI trong lĩnh vực này, có những trường hợp chi phí tuân thủ danh mục rủi ro cao (Điều 6) của Đạo luật AI của EU lên tới vài triệu yên Nhật mỗi năm đối với các công ty vừa và nhỏ. Xét về các xu hướng của Nhật Bản được ReviewAI theo dõi, Bộ Kinh tế, Thương mại và Công nghiệp đang xây dựng các hướng dẫn tự nguyện cho các công ty trong nước vào năm 2026 và việc áp dụng theo từng giai đoạn phù hợp với các cam kết Mỹ-Anh dự kiến ​​sẽ trở thành xu hướng chủ đạo. Khi xem xét việc triển khai, thông lệ tiêu chuẩn trong lĩnh vực này trước tiên là thu hẹp các điều khoản cam kết nào sẽ ảnh hưởng trực tiếp đến quá trình phát triển của công ty bạn.

Thuật ngữ liên quan