Kiểm tra thâm nhập LLM là một chẩn đoán bảo mật sử dụng các phương pháp như chèn nhanh và bẻ khóa để thực hiện các cuộc tấn công giả trên các hệ thống kết hợp các mô hình ngôn ngữ quy mô lớn nhằm xác định các lỗ hổng.
Thử nghiệm thâm nhập LLM là phương pháp mô phỏng các tình huống tấn công như tiêm nhắc, rò rỉ thông tin bí mật từ đầu ra, gọi công cụ không phù hợp và bẻ khóa, đồng thời tham khảo các tiêu chuẩn ngành như OWASP Top 10 cho Ứng dụng LLM, để xác minh cấu trúc bảo vệ của ứng dụng LLM. Không giống như chẩn đoán ứng dụng web thông thường, đầu vào bằng ngôn ngữ tự nhiên, do đó các kiểu tấn công gần như vô hạn và một nhược điểm trong hoạt động thực tế là rất dễ bỏ qua một chẩn đoán duy nhất. Kể từ năm 2026, với sự gia tăng các sản phẩm có RAG và phối hợp agent, tâm lý thị trường sẽ thay đổi lớn tùy thuộc vào việc phạm vi chẩn đoán có bao gồm các đặc quyền thực thi công cụ và phối hợp API hay không, đồng thời phạm vi sẽ bao gồm từ chẩn đoán đơn giản đến các cuộc tập trận toàn diện của đội đỏ. Khi đưa ra lựa chọn trong lĩnh vực này, điều quan trọng là phải phân loại phạm vi sử dụng LLM của công ty bạn (sử dụng nội bộ hoặc cho người dùng cuối), sau đó chọn công ty chẩn đoán bằng cách xem xét sự cân bằng giữa phạm vi và chi phí.