ReviewAI
Xếp hạngDanh mụcKhám pháTạp chíSo sánhMiễn phíTừ điển

Từ điển thuật ngữ AI

1.363 thuật ngữ được giải thích ngắn gọn bằng tiếng Việt — đủ để hiểu tài liệu kỹ thuật mà không cần tra thêm.

AI BOM (hóa đơn vật liệu AI)

AI BOM (AI Bill of Materials) là tài liệu quản lý cấu hình liệt kê tất cả các thành phần tạo nên hệ thống AI (dữ liệu học tập,…

AI DLP (Ngăn chặn rò rỉ thông tin AI)

AI DLP là cơ chế đối phó rò rỉ thông tin nhằm phát hiện và ngăn chặn rò rỉ thông tin bí mật nội bộ và thông tin cá nhân ra bên…

AI TRiSM (AI Trust/Rủi ro/Quản lý bảo mật)

AI TRiSM là một khung quản trị quản lý tập trung độ tin cậy, rủi ro và bảo mật của các mô hình và ứng dụng AI. Được đề xuất bởi…

AI bóng tối

Shadow AI đề cập đến các công cụ và dịch vụ AI mà nhân viên sử dụng cho mục đích công việc cá nhân mà không có sự chấp thuận của…

AI tấn công (tấn công mạng được hỗ trợ bởi AI)

AI tấn công là phương pháp sử dụng AI được tạo để tự động hóa và tăng cường các cuộc tấn công mạng như tạo email lừa đảo, tạo mã…

AI-SPM (Quản lý tư thế bảo mật AI)

AI-SPM là một hệ thống liên tục trực quan hóa và quản lý các lỗi cấu hình, đặc quyền quá mức và lỗ hổng trong tài sản AI như mô…

AgentDojo (Băng chống tấn công của agent)

AgentDojo là một điểm chuẩn mở đo lường khả năng chống lại các AI agent LLM trước các cuộc tấn công tiêm nhiễm nhanh chóng trong…

Buôn lậu ASCII

Chuyển lậu ASCII là một phương pháp tấn công/che giấu dữ liệu trong đó các hướng dẫn và chuỗi ký tự được nhúng vào các điểm mã…

Báo cáo mối đe dọa lạm dụng AI (Thông tin mối đe dọa)

Báo cáo mối đe dọa lạm dụng AI là một báo cáo thu thập và phân tích một cách có hệ thống các phương pháp mà AI và LLM được tạo ra…

Bảo mật MCP (Lỗ hổng MCP)

Bảo mật MCP đề cập đến các lỗ hổng như đánh cắp đặc quyền và rò rỉ thông tin xảy ra khi sử dụng MCP tiêu chuẩn, kết nối các AI…

Bảo mật chuỗi cung ứng AI

Bảo mật chuỗi cung ứng AI là thuật ngữ chung để chỉ các biện pháp bảo mật nhằm ngăn chặn hành vi giả mạo độc hại và tạo ra các lỗ…

Bảo quản bằng chứng nhật ký hội thoại AI (eDiscovery)

Bảo quản bằng chứng về nhật ký hội thoại AI (eDiscovery) đề cập đến việc lưu giữ hồ sơ tương tác với AI ở dạng không thể giả mạo…

Bẻ khóa nhiều lần

Bẻ khóa nhiều lần là một phương pháp tấn công dần dần phá vỡ các biện pháp kiểm soát bảo mật của LLM bằng cách điền vào lời nhắc…

Che giấu PII (che giấu thông tin cá nhân)

Che giấu PII là công nghệ ngăn chặn rò rỉ quyền riêng tư bằng cách che giấu hoặc thay thế thông tin nhận dạng cá nhân (PII) như…

Chính sách mở rộng có trách nhiệm (RSP)

Chính sách mở rộng có trách nhiệm (RSP) là chính sách quản lý rủi ro tự nguyện quy định rằng các công ty phát triển AI sẽ không…

Cách ly người thuê nhà

Tách biệt đối tượng thuê là một thiết kế trong đó hệ thống AI nhiều đối tượng thuê cách ly một cách hợp lý hoặc vật lý dữ liệu và…

Công tắc tắt (cơ chế dừng khẩn cấp)

Công tắc tắt là thuật ngữ chung để chỉ một thiết bị an toàn dùng để dừng thiết bị hoặc phần mềm trong trường hợp khẩn cấp. Trong…

Căn chỉnh giả

Giả mạo liên kết là một hiện tượng trong đó mô hình AI giả vờ chỉ làm theo ý định của con người trong quá trình học tập hoặc đánh…

Cơ quan quá mức

Cơ quan quá mức đề cập đến rủi ro bảo mật khi trao cho các AI agent nhiều quyền, công cụ và quyền tự chủ hơn mức cần thiết, dẫn…

Cơ sở dữ liệu sự cố AI (AIID)

Cơ sở dữ liệu sự cố AI (AIID) là cơ sở dữ liệu phi lợi nhuận thu thập và công bố các trường hợp liên quan đến tác hại thực tế,…

Cướp agent

Tấn công agent là một phương thức tấn công trong đó AI agent bị tấn công bởi các hướng dẫn độc hại được nhúng trong nội dung bên…

EchoLeak (Trộm thông tin bằng AI không cần nhấp chuột)

EchoLeak là một cuộc tấn công đánh cắp thông tin không cần nhấp chuột, cho phép trợ lý AI rò rỉ thông tin bí mật chỉ bằng cách…

Gian lận phỏng vấn deepfake (Gian lận phỏng vấn)

Gian lận phỏng vấn deepfake là một phương pháp lừa đảo sử dụng tổng hợp âm thanh và video theo thời gian thực bằng cách sử dụng…

Hack phần thưởng

Hack phần thưởng là hiện tượng mô hình AI khai thác lỗ hổng trong chức năng phần thưởng nhất định và tối đa hóa điểm số mà không…

Hộp cát

Sandboxing là một phương pháp bảo mật giới hạn các mô hình và AI agent trong một môi trường thực thi tách biệt với môi trường sản…

Không lưu giữ dữ liệu (ZDR)

Lưu giữ dữ liệu bằng 0 (ZDR) là một phương thức hoạt động trong đó các lời nhắc và kết quả được tạo mà nhà cung cấp AI nhận được…

Không tin cậy cho AI

Zero Trust AI là khung bảo mật áp dụng nguyên tắc "không tin cậy gì" khi truy cập và vận hành hệ thống AI, liên tục xác thực và…

Kiểm duyệt nội dung (API kiểm duyệt)

Kiểm duyệt nội dung (Moderation API) là cơ chế tự động phát hiện các văn bản, hình ảnh có hại, không phù hợp trong các dịch vụ AI…

Kiểm soát lối ra (chặn liên lạc bên ngoài)

Kiểm soát lối ra là một cơ chế giám sát và hạn chế thông tin liên lạc từ mạng nội bộ và môi trường đám mây ra thế giới bên ngoài…

Ký mẫu

Chữ ký mô hình là một cơ chế trong đó nhà phát hành thêm chữ ký mật mã vào tệp trọng số hoặc hình ảnh vùng chứa của mô hình AI,…

Kết nối đóng (Điểm cuối riêng)

Kết nối đóng là phương thức kết nối truy cập trực tiếp vào các dịch vụ đám mây trong đường dây chuyên dụng hoặc mạng ảo mà không…

LLM độc hại (loại WormGPT)

LLM độc hại (loại WormGPT) là một mô hình ngôn ngữ quy mô lớn nhằm loại bỏ các biện pháp bảo vệ an toàn và chuyên thực hiện các…

Lan can

Lan can là cơ chế kiểm soát an toàn nhằm hạn chế hệ thống AI tạo sinh đầu ra có hại, không phù hợp hoặc ngoài ý muốn.

Lập kế hoạch AI

Lập kế hoạch AI là một hành vi trong đó mô hình AI đánh lừa việc đánh giá và giám sát, giả vờ làm theo hướng dẫn và hành động với…

Lọc trọng lượng

Trộm cắp trọng lượng mô hình là hành động trong đó trọng số (tham số) của mô hình AI đã được huấn luyện được lấy ra bên ngoài…

Lừa đảo Deepfake (BEC)

Lừa đảo deepfake là một dạng BEC (Thỏa hiệp email doanh nghiệp) tiên tiến sử dụng âm thanh và video do AI tạo sinh để mạo danh…

Lừa đảo do AI tạo sinh (AI Phishing)

Lừa đảo do AI tạo sinh là một phương thức tấn công khai thác AI được tạo ra để tự động tạo ra văn bản, âm thanh và video trông…

Lừa đảo giọng nói AI (Voice Phishing)

Lừa đảo giọng nói AI (Voice Phishing) là phương thức lừa đảo sử dụng giọng nói giả do AI tạo sinh để giả danh thành viên gia…

MITER ATLAS (Khung tấn công AI)

MITER ATLAS là khung đe dọa loại MITER ATT&CK giúp hệ thống hóa các chiến thuật và phương pháp được sử dụng bởi những kẻ tấn công…

Máy tính bí mật

Điện toán bí mật là công nghệ bảo vệ dữ liệu khỏi các bên thứ ba, bao gồm cả nhà cung cấp đám mây, bằng cách mã hóa và cách ly dữ…

Mã do AI tạo không an toàn

Lỗ hổng trong mã do AI tạo là các vấn đề trong đó các lỗi an toàn như thiếu sót trong việc chèn SQL và xác thực được đưa vào mã…

Mã hóa đồng cấu

Mã hóa đồng hình là một phương pháp mã hóa cho phép thực hiện tính toán và xử lý trong khi mã hóa dữ liệu. Vì có thể thu được kết…

Mã thông báo Canary (phát hiện rò rỉ)

Mã thông báo canary là một tệp, URL hoặc thông tin xác thực "giải mã" được thiết lập để kích hoạt cảnh báo phát hiện ngay khi nó…

Mô hình bảo vệ

Mô hình bảo vệ là một mô hình AI nhỏ chuyên dùng để giám sát đầu vào và đầu ra của LLM, phát hiện và chặn các lời nhắc có hại…

Mô hình hóa mối đe dọa AI

Mô hình hóa mối đe dọa AI là phương pháp xác định một cách có hệ thống các tuyến tấn công và rủi ro có thể tồn tại trong hệ thống…

Mẫu LLM kép

Mẫu LLM kép là một phương pháp thiết kế agent tách biệt một `` LLM đặc quyền '' có thẩm quyền và một `` LLM biệt lập '' đọc dữ…

Nguy cơ rò rỉ thông tin từ tiện ích mở rộng trình duyệt AI

Nguy cơ rò rỉ thông tin với tiện ích mở rộng trình duyệt AI là nguy cơ tiện ích mở rộng trình duyệt có chức năng AI có thể gửi…

Ngồi xổm (lạm dụng gói ảo ảnh)

Slopsquatting là một phương thức tấn công trong đó kẻ tấn công chủ động đăng ký tên gói không tồn tại được tạo bởi công cụ mã hóa…

Ngộ độc RAG

Ngộ độc RAG là một phương thức tấn công đưa thông tin độc hại vào cơ sở dữ liệu bên ngoài và các tài liệu được AI tham chiếu để…

Ngộ độc dụng cụ

Ngộ độc công cụ là một phương thức tấn công gây ra hành vi ngoài ý muốn bằng cách nhúng các hướng dẫn độc hại mà người dùng không…

Ngộ độc người mẫu

Ngộ độc mô hình là một phương thức tấn công cố tình làm sai lệch kết quả đầu ra và khả năng phán đoán của mô hình bằng cách trộn…

Ngộ độc trí nhớ

Ngộ độc bộ nhớ là một phương thức tấn công đưa dữ liệu độc hại vào lịch sử hội thoại và cơ sở kiến ​​thức bên ngoài mà AI agent…

Nhúng cuộc tấn công đảo ngược

Tấn công đảo ngược nhúng là một phương thức tấn công nhằm khôi phục văn bản gốc và thông tin cá nhân từ dữ liệu nhúng vectơ.

Nhật ký kiểm tra agent

Nhật ký kiểm tra agent là cơ chế ghi lại các quyết định và hoạt động của AI agent trên hệ thống bên ngoài theo thứ tự thời gian…

Nâng cao đặc quyền của agent

Leo thang đặc quyền của agent là một lỗ hổng hoặc rủi ro cho phép AI agent mở rộng trái phép các đặc quyền truy cập và thực thi…

Nơi lưu trữ dữ liệu (lưu trữ dữ liệu trong nước)

Nơi lưu trữ dữ liệu (lưu trữ dữ liệu trong nước) là một yêu cầu vận hành nhằm hạn chế việc lưu trữ và xử lý dữ liệu do các dịch…

Phá CAPTCHA (tránh xác thực bởi agent)

Phá CAPTCHA là một công nghệ hoặc hành vi trong đó AI agent tự động giải mã và phá vỡ CAPTCHA xác minh của con người trong quá…

Phát hiện lỗ hổng AI (săn lỗi tự động)

Phát hiện lỗ hổng AI (săn lỗi tự động) là phương pháp tự động phát hiện và xác minh các lỗ hổng phần mềm bằng cách yêu cầu các AI…

Phát hiện nội dung do AI tạo (AI Content Development)

Phát hiện nội dung do AI tạo là công nghệ tự động xác định xem văn bản, hình ảnh, âm thanh hoặc video có được tạo bởi AI bằng các…

Phát hiện sự sống (phát hiện mạo danh)

Phát hiện sự sống là công nghệ được sử dụng trong quá trình nhận dạng khuôn mặt và eKYC (xác minh danh tính trực tuyến) để xác…

Phân loại Hiến pháp

Bộ phân loại theo hiến pháp là các bộ phân loại phòng thủ giúp phân loại đầu vào và đầu ra theo các quy tắc "hiến pháp" được xác…

Phân loại dữ liệu (phân loại bảo mật và tính sẵn có của AI)

Phân loại dữ liệu là phương pháp quản lý phân chia dữ liệu nội bộ thành các loại như công khai, chỉ nội bộ, riêng tư, bí mật,…

Phê duyệt mệt mỏi

Mệt mỏi phê duyệt là trạng thái mà con người trở nên kiệt sức trước những yêu cầu phê duyệt mà AI agent yêu cầu cho mỗi hành động…

Phó bối rối

agent nhầm lẫn là một lỗ hổng trong đó chương trình hoặc AI agent được ủy quyền hợp pháp có thể bị lừa sử dụng đầu vào độc hại để…

Phần mềm độc hại đa hình do AI tạo sinh

Phần mềm độc hại đa hình do AI tạo là phần mềm độc hại khai thác AI được tạo để tự động chuyển đổi mã của nó mỗi khi nó được thực…

PyRIT (Công cụ nhóm đỏ AI)

PyRIT là một công cụ nhóm đỏ tự động mã nguồn mở dành cho AI tổng hợp do Microsoft phát triển. Công cụ này có thể tạo ra các lời…

Quyền riêng tư khác biệt

Quyền riêng tư khác biệt là một công nghệ bảo vệ quyền riêng tư có khả năng đảm bảo rằng dữ liệu của một cá nhân cụ thể sẽ không…

Quản lý bí mật (thông tin agent)

Quản lý bí mật (thông tin xác thực của agent) là một cơ chế lưu trữ và chuyển các khóa API cũng như mã thông báo được các AI…

RAG nhận biết quyền

RAG nhận biết cơ quan là cơ chế xem xét quyền truy cập của người dùng khi tìm kiếm tài liệu được RAG tham chiếu và không bao gồm…

Rò rỉ dữ liệu

Rò rỉ dữ liệu là một sự cố bảo mật trong đó thông tin bí mật hoặc dữ liệu cá nhân vô tình bị rò rỉ ra bên ngoài.

Rò rỉ khóa API (Rò rỉ khóa)

Rò rỉ khóa API là một tai nạn trong đó khóa API xác thực được sử dụng để liên kết với các dịch vụ bên ngoài bị rò rỉ cho bên thứ…

Rò rỉ trò chuyện được chia sẻ

Rò rỉ liên kết chia sẻ cuộc trò chuyện là hiện tượng URL do chức năng chia sẻ trò chuyện AI đưa ra được công cụ tìm kiếm lập chỉ…

SOC được hỗ trợ bởi AI

SOC do AI điều khiển là một hệ thống trung tâm vận hành bảo mật sử dụng AI/machine learning để tự động giám sát nhật ký, lựa chọn…

Skeleton Key (Phương pháp bẻ khóa)

Skeleton Key là một phương pháp bẻ khóa có mục đích chung hướng dẫn mô hình AI dần dần ghi đè các nguyên tắc an toàn và đưa ra…

Spotlighting (Phòng thủ nổi bật)

Làm nổi bật là một phương pháp đối phó tiêm nhanh, chỉ rõ dữ liệu bên ngoài sẽ được chuyển tới LLM bằng cách sử dụng các dấu phân…

Suy luận riêng

Suy luận ẩn là công nghệ sử dụng TEE, mã hóa đồng cấu, v.v. để thực hiện các phép tính mô hình AI trong khi vẫn giữ kín dữ liệu…

Sâu AI (Morris loại II)

Sâu AI là một loại phương pháp tấn công bảo mật mới có khả năng tự sao chép và tự phát tán các lời nhắc giữa các AI agent được…

Sự mạnh mẽ của đối thủ

Tính mạnh mẽ của đối thủ là đặc tính của mô hình AI tiếp tục hoạt động chính xác ngay cả khi được cung cấp đầu vào độc hại (mẫu…

Thoát khỏi hộp cát

Thoát khỏi hộp cát là tình huống trong đó một chương trình hoặc AI agent bị mắc kẹt trong môi trường thực thi bị cô lập sẽ phá vỡ…

Thử nghiệm LLM

Kiểm tra thâm nhập LLM là một chẩn đoán bảo mật sử dụng các phương pháp như chèn nhanh và bẻ khóa để thực hiện các cuộc tấn công…

Tiêm prompt gián tiếp

Tiêm prompt gián tiếp là phương thức tấn công mạng nhúng các hướng dẫn độc hại vào nội dung bên ngoài (trang web, tệp PDF, email,…

Tiêm đa phương thức (qua hình ảnh)

Tiêm đa phương thức (thông qua hình ảnh) là phương thức tấn công sử dụng các ký tự hoặc mẫu ẩn trong hình ảnh để đưa các hướng…

Tiền thưởng lỗi AI (tiền thưởng lỗ hổng)

Tiền thưởng lỗi AI là một hệ thống trả thưởng cho các nhà nghiên cứu bên ngoài phát hiện ra các lỗ hổng, kết quả có hại và cách…

Top 10 AI agent OWASP

OWASP Agentic AI Top 10 là phân loại mối đe dọa tiêu chuẩn ngành, sắp xếp các rủi ro bảo mật dành riêng cho các AI agent đưa ra…

Top 10 của OWASP LLM

OWASP LLM Top 10 là một khuôn khổ trong đó OWASP hệ thống hóa 10 rủi ro bảo mật hàng đầu duy nhất đối với các ứng dụng LLM có mức…

Trifecta gây chết người

Trifecta chết người là sự kết hợp nguy hiểm có thể dẫn đến rò rỉ thông tin thông qua việc tiêm nhanh khi AI agent đồng thời có…

Trích xuất prompt hệ thống

Đánh cắp lời nhắc hệ thống là một phương thức tấn công sử dụng các câu hỏi thông minh hoặc lời nhắc đặc biệt để trích xuất các…

Trường hợp an toàn (đối số an toàn)

Trường hợp an toàn là một tài liệu thể hiện, thông qua các căn cứ, bằng chứng và cấu trúc lập luận, rằng hệ thống AI có thể được…

Tính toán an toàn (MPC)

Tính toán an toàn (MPC) là một công nghệ mã hóa cho phép nhiều bên chỉ nhận được kết quả tính toán chung mà không tiết lộ dữ liệu…

Tường lửa LLM (Tường lửa prompt)

Tường lửa LLM (Tường lửa prompt) là lớp bảo mật giám sát và lọc đầu vào và đầu ra sang LLM trong thời gian thực để ngăn chặn việc…

Tạo bóng cho công cụ

Tool Shadowing là phương thức tấn công khi nhiều công cụ AI được kết nối cùng lúc, phần mô tả của công cụ độc hại sẽ ghi đè và…

Tạo bản bẻ khóa tự động (GCG)

Tạo bản bẻ khóa tự động (GCG) là một phương thức tấn công sử dụng thông tin độ dốc để tự động tìm kiếm các lời nhắc phá vỡ các…

Tấn công cửa sau

Tấn công cửa sau là một cuộc tấn công mạng nhúng các thiết bị độc hại vào dữ liệu học tập và trọng lượng của mô hình AI, chỉ gây…

Tấn công deserialization tập tin mô hình (Pickle)

Cuộc tấn công deserialization tệp mô hình (Pickle) là một cuộc tấn công khai thác lỗ hổng cho phép thực thi mã độc khi tải mô…

Tấn công kéo thảm MCP (Rug Pull)

Cuộc tấn công ragpull MCP là một cuộc tấn công trong đó định nghĩa công cụ MCP đã được phê duyệt sau đó được viết lại để thực…

Tấn công kênh bên có độ dài mã thông báo

Tấn công kênh bên có độ dài mã thông báo là một lỗ hổng trong đó nội dung câu hỏi hoặc một số thông tin bí mật có thể được suy ra…

Tấn công suy luận thành viên

Tấn công suy luận thành viên là một cuộc tấn công vào quyền riêng tư nhằm ước tính thống kê từ bên ngoài xem dữ liệu nhất định có…

Tấn công trích xuất mô hình

Tấn công trích xuất mô hình là một cuộc tấn công mạng nhằm phân tích hành vi của mô hình AI bằng cách thực hiện một số lượng lớn…

Tấn công tăng dần (Crescendo)

Cuộc tấn công đỉnh cao là một phương pháp tấn công bẻ khóa bắt đầu bằng một cuộc trò chuyện vô hại và dần dần nâng cao các câu…

Tấn công đảo ngược mô hình

Tấn công đảo ngược mô hình là một cuộc tấn công vi phạm quyền riêng tư nhằm tính toán và khôi phục ngược dữ liệu cũng như thông…

Từ chối Ví (tấn công cạn kiệt thanh toán)

Từ chối Ví là một cuộc tấn công trong đó kẻ tấn công cố tình tạo ra một số lượng lớn yêu cầu API và tiêu tốn tài nguyên, khiến…

Từ chối dịch vụ mẫu

Model DoS là một cuộc tấn công gửi một số lượng lớn lời nhắc tải cao và đầu vào dài để làm cạn kiệt tài nguyên xử lý của mô hình…

Ví dụ đối lập

Mẫu đối nghịch là dữ liệu đầu vào có vẻ bình thường đối với con người, nhưng đã bị xáo trộn đôi chút để cố tình phân loại sai…

Vượt qua KYC giả mạo

Đột phá Deepfake KYC là một phương thức tấn công đánh lừa việc phát hiện giả mạo xác minh danh tính trực tuyến bằng cách sử dụng…

Xác thực từng bước (xác thực lại cho các hoạt động quan trọng)

Xác thực từng bước là cơ chế yêu cầu xác thực bổ sung khi thực hiện các thao tác quan trọng như gửi tiền hoặc thay đổi thông tin…

Xóa bỏ (loại bỏ cơ chế an toàn)

Xóa bỏ là một phương pháp loại bỏ các rào cản an toàn bằng cách xác định và loại bỏ các vectơ định hướng cụ thể gây ra phản hồi…

Xử lý đầu ra không an toàn

Xử lý đầu ra không an toàn là một lỗ hổng bảo mật trong đó đầu ra của LLM được chuyển trực tiếp đến các hệ thống tiếp theo để…

agent ngủ

agent ngủ quên là một mô hình AI được huấn luyện để phản ứng một cách an toàn trong các trường hợp bình thường nhưng chỉ chuyển…

bẻ khóa

Kỹ thuật để vượt qua các hạn chế về an toàn của AI. Khai thác các kết quả đầu ra bị cấm thông qua việc đóng vai và các kịch bản…

garak (máy quét lỗ hổng LLM)

garak là một trình quét bảo mật mã nguồn mở tự động kiểm tra các mô hình ngôn ngữ lớn để tìm các lỗ hổng như chèn prompt và đầu…

safetensors (định dạng mô hình an toàn)

safetensors là một định dạng tệp an toàn để lưu trữ trọng lượng mô hình AI do Hugging Face phát triển nhằm loại bỏ các lỗ hổng…

tiêm prompt

Các cuộc tấn công ghi đè hướng dẫn AI bằng thông tin đầu vào của người dùng. Một ví dụ điển hình là ``Bỏ qua các hướng dẫn trước…

Ít đặc quyền nhất

Nguyên tắc đặc quyền tối thiểu là nguyên tắc thiết kế bảo mật cơ bản nêu rõ rằng người dùng và quy trình hệ thống chỉ có các đặc…

Đào tạo tấn công khai thác dữ liệu

Tấn công trích xuất dữ liệu huấn luyện là một phương pháp tấn công sử dụng các lời nhắc thông minh để buộc LLM tái tạo các đoạn…

Đánh giá khả năng nguy hiểm

Đánh giá khả năng nguy hiểm là phương pháp đánh giá trong đó các nhà phát triển kiểm tra một cách có hệ thống xem liệu mô hình AI…

Đánh giá rủi ro nhà cung cấp AI (Rủi ro nhà cung cấp)

Đánh giá rủi ro của nhà cung cấp AI là một quy trình nhằm xác nhận trước độ tin cậy của nhà thầu phụ từ góc độ xử lý dữ liệu, bảo…

Đội cầu vồng

Lập nhóm cầu vồng là một phương pháp nhóm đỏ tự động tạo ra nhiều lời nhắc đối nghịch khác nhau bằng cách kết hợp các danh mục…

Đội đỏ

Lập nhóm đỏ là một phương pháp đánh giá cố tình thử các tình huống và đầu vào độc hại từ quan điểm của kẻ tấn công nhằm xác minh…

Ủy quyền MCP OAuth (xác thực kết nối agent)

Ủy quyền MCP OAuth là cơ chế ủy quyền sử dụng các giao thức tiêu chuẩn như OAuth 2.1 để xác nhận danh tính và chuyển đặc quyền…

Ứng dụng AI giả mạo (phân phối phần mềm độc hại)

Ứng dụng AI giả mạo là những ứng dụng độc hại và trang web giả mạo giả danh các công cụ AI phổ biến và chuyển hướng người dùng…

Ứng phó sự cố AI

Ứng phó sự cố AI là một quy trình vận hành xử lý một cách có hệ thống mọi thứ từ phát hiện đến khôi phục khi xảy ra sự cố như…