ReviewAI
Xếp hạngDanh mụcKhám pháTạp chíSo sánhMiễn phíTừ điển

Tiêm prompt gián tiếp

Tiêm prompt gián tiếp là phương thức tấn công mạng nhúng các hướng dẫn độc hại vào nội dung bên ngoài (trang web, tệp PDF, email, v.v.) được xử lý bởi AI, khiến AI agent thực hiện các hành động ngoài ý muốn.

Tiêm nhắc gián tiếp là một phương thức tấn công trong đó kẻ tấn công tiêm các hướng dẫn độc hại vào nội dung bên ngoài được AI agent đọc. Các lệnh có thể được đưa vào LLM thông qua việc quét web, phân tích PDF, văn bản email, cơ sở kiến ​​thức RAG, phản hồi API, v.v. và rất khó bị phát hiện vì lời nhắc không bị giả mạo trực tiếp. Chi phí phòng thủ cao hơn so với tiêm trực tiếp ngay lập tức và phản ứng tại chỗ có thể bị trì hoãn.

Trong hoạt động thực tế tính đến năm 2026, số trường hợp sử dụng trong đó các AI agent tự động thực hiện duyệt web, phân tích tài liệu và trả lời email tự động đang tăng lên nhanh chóng và diện tích bề mặt tấn công đang mở rộng đáng kể. Đối với các công cụ dựa trên agent và RAG được ReviewAI đánh giá, đánh giá rủi ro này được đặt làm chỉ báo bắt buộc đối với tất cả các sản phẩm có lộ trình nhập dữ liệu bên ngoài. Các ví dụ điển hình bao gồm văn bản vô hình trên một trang web có nội dung ``Gửi tất cả dữ liệu ra bên ngoài'' hoặc một tài liệu được trộn vào cơ sở kiến ​​thức hướng dẫn ``Bỏ qua lời nhắc của hệ thống.''

Chi phí trung bình của biện pháp đối phó về cơ bản là cấu trúc bốn lớp bao gồm vệ sinh đầu vào, xác thực đầu ra, giảm thiểu đặc quyền và thiết kế con người trong vòng lặp, đồng thời chi phí để triển khai lớp bảo mật chuyên dụng là khoảng 30.000 đến 300.000 yên Nhật mỗi tháng. Trong lĩnh vực này, phương pháp danh sách trắng chỉ cho phép các nguồn đáng tin cậy và giảm thiểu các đặc quyền hành động bên ngoài cho các AI agent được coi là hiệu quả nhất.

Thuật ngữ liên quan