Bộ lọc an toàn tạo hình ảnh là cơ chế trong đó dịch vụ tạo hình ảnh AI tự động phát hiện và chặn đầu ra không phù hợp như biểu hiện bạo lực, biểu hiện tình dục và vi phạm bản quyền.
Bộ lọc an toàn tạo hình ảnh là một chức năng trong đó AI tạo hình ảnh như Stable Diffusion và Midjourney phát hiện và chặn hoặc làm mờ đầu ra bị nghi ngờ là bạo lực, biểu hiện tình dục, lạm dụng người thật hoặc vi phạm bản quyền. Cấu hình hai giai đoạn bao gồm bộ lọc đầu vào ở phía nhắc và bộ lọc đầu ra xác định hình ảnh được tạo là tiêu chuẩn ngành. Trong hoạt động thực tế kể từ năm 2026, `` phát hiện quá mức '', trong đó bộ lọc loại bỏ nhầm các hình ảnh y tế vô hại và các bức ảnh có tông màu da, được biết đến rộng rãi như một vấn đề trong hiện trường và đối với mục đích sử dụng của công ty, tỷ lệ dương tính giả và tốc độ phản hồi hỗ trợ sẽ trở thành các yếu tố chi phí đáng kể. Mặt khác, nếu bạn sử dụng mô hình nước ngoài với bộ lọc thoải mái, nguy cơ tạo ra không phù hợp sẽ tăng lên, do đó, khi chọn công cụ của công ty, thông lệ tiêu chuẩn là so sánh xem liệu cường độ của bộ lọc có thể được điều chỉnh hay không và liệu nhật ký kiểm duyệt có được để lại cho mục đích kiểm tra hay không. Các công ty Nhật Bản có xu hướng chọn các bộ lọc dựa trên việc họ có đầu mối liên hệ để xử lý các phát hiện sai khi sử dụng người thật hoặc nhãn hiệu hay không.