ReviewAI
Xếp hạngDanh mụcKhám pháTạp chíSo sánhMiễn phíTừ điển

Cướp agent

Tấn công agent là một phương thức tấn công trong đó AI agent bị tấn công bởi các hướng dẫn độc hại được nhúng trong nội dung bên ngoài và buộc phải thực hiện các hành động ngoài ý muốn.

Đánh cắp agent là một phương thức tấn công trong đó khi AI agent xử lý một trang web, email, tài liệu, v.v., các hướng dẫn độc hại (tội prompt) ẩn trong đó sẽ khiến agent hành xử theo cách đi chệch khỏi mục đích ban đầu của nó. Không giống như chatbot, các AI agent thực hiện các hành động gây hại thực tế, chẳng hạn như chạy công cụ, thao tác với tệp và gọi API, sẽ dễ bị thiệt hại hơn. Trong lĩnh vực này vào năm 2026, các mục tiêu tấn công sẽ nhanh chóng mở rộng do sự lan rộng của cấu hình đa agent kết nối nhiều máy chủ MCP. Trong các trường hợp hoạt động thực tế được ReviewAI thu thập, các trường hợp đã được xác nhận trong đó các AI agent xử lý email tự động gửi dữ liệu cho các bên bên ngoài bằng cách sử dụng các hướng dẫn HTML độc hại ẩn. Chi phí trung bình của các biện pháp đối phó ước tính từ hàng chục nghìn đến hàng trăm nghìn yên Nhật mỗi tháng để thực hiện các bước vệ sinh đầu vào, phân tách đặc quyền và phê duyệt người dùng. Thiết kế không tin cậy và nguyên tắc đặc quyền tối thiểu cho các AI agent là nền tảng cho việc phòng thủ.

Thuật ngữ liên quan