Từ điển thuật ngữ AI
1.363 thuật ngữ được giải thích ngắn gọn bằng tiếng Việt — đủ để hiểu tài liệu kỹ thuật mà không cần tra thêm.
AGI (Trí tuệ tổng hợp nhân tạo)
Trí tuệ tổng hợp nhân tạo. AI có khả năng vượt qua khả năng của con người trong mọi nhiệm vụ trí tuệ. Vẫn chưa đạt được.
AI (trí tuệ nhân tạo)
Viết tắt của Trí tuệ nhân tạo. Đề cập đến tất cả các công nghệ tái tạo trí thông minh của con người trên máy tính.
Amazon Nova (mô hình nền tảng AWS)
Amazon Nova là dòng mô hình cơ bản (LLM) do AWS phát triển, hỗ trợ tạo văn bản, hình ảnh và video thông qua Bedrock.
BERT (bộ mã hóa hai chiều)
BERT là mô hình ngôn ngữ Transformer hai chiều được Google công bố vào năm 2018. Nó đọc ngữ cảnh cả xuôi và ngược, cải thiện độ…
BPE (mã hóa cặp byte)
BPE là một phương pháp phân đoạn văn bản LLM tích hợp nhiều lần các cặp ký tự và chuỗi con xuất hiện thường xuyên để tạo các đơn…
Bị lạc ở giữa
Lạc vào giữa là một hiện tượng trong đó khi một ngữ cảnh dài được đưa cho LLM, thông tin ở đầu và cuối có thể được tham chiếu…
Bộ mã hóa tự động thưa thớt (SAE)
Bộ mã hóa tự động thưa thớt (SAE) là một phương pháp mạng thần kinh phân tách vectơ kích hoạt bên trong LLM thành các đặc điểm…
Bộ mã hóa-giải mã
Bộ mã hóa/bộ giải mã là cấu trúc mạng thần kinh kết hợp bộ mã hóa chuyển đổi dữ liệu đầu vào thành biểu diễn nén bên trong và bộ…
ChatGPT
AI đàm thoại do OpenAI cung cấp. 3 gói với giá $0/$20/$200 mỗi tháng. Thị phần lớn nhất trên thế giới tính đến năm 2026.
Chinchilla tối ưu (tính toán lượng học tập tối ưu)
Tối ưu hóa Chinchilla là một khái niệm tối ưu hóa sự cân bằng phân phối giữa số lượng tham số và số lượng mã thông báo học tập để…
Chuẩn hóa lớp
Chuẩn hóa lớp là phương pháp chuẩn hóa điều chỉnh đầu ra của mỗi lớp của mạng thần kinh thành giá trị trung bình bằng 0 và phương…
Chú ý chìm
Mức độ chú ý là một hiện tượng trong cơ chế tự chú ý của Transformer trong đó trọng lượng chú ý tập trung vào một mã thông báo cụ…
Chỉnh sửa kiến thức mô hình (Model Editing)
Chỉnh sửa kiến thức mô hình là một công nghệ chỉ viết lại kiến thức thực tế cụ thể theo cách chính xác mà không cần học lại…
Claude
AI đàm thoại của Anthropic. Mạnh mẽ về khả năng xử lý văn bản dài và độ chính xác, Opus 4.7 hỗ trợ 1 triệu mã thông báo.
Dự đoán nhiều mã thông báo
Dự đoán nhiều mã thông báo là một phương pháp giúp tăng hiệu quả học tập và tốc độ tạo LLM bằng cách dự đoán không chỉ mã thông…
ERNIE (Bunshin Một Từ)
ERNIE là tên của một mô hình ngôn ngữ quy mô lớn được phát triển bởi Baidu ở Trung Quốc và một dịch vụ AI tương tác sử dụng nó.
GLM (Chifu Kiyogen)
GLM là một nhóm các mô hình ngôn ngữ quy mô lớn (LLM) được phát triển bởi Zhipu AI tại Trung Quốc. Chúng tôi đã phát triển các…
Gemini
AI đa phương thức do Google cung cấp. Tích hợp không gian làm việc và mức miễn phí hào phóng là điểm mạnh của chúng tôi.
Gemma (mô hình mở của Google)
Gemma là dòng LLM nhẹ, có trọng lượng mở do Google xuất bản. Được cấp giấy phép sử dụng thương mại.
Ghi nhớ
Học thuộc lòng là một hiện tượng trong đó một mô hình ngôn ngữ quy mô lớn ghi nhớ các câu và mẫu số của dữ liệu học tập mà không…
Giải mã tương phản
Giải mã tương phản là phương pháp giải mã loại trừ phân bố xác suất của mô hình không chuyên nghiệp quy mô nhỏ khỏi phân phối xác…
Grok
Grok là mô hình ngôn ngữ quy mô lớn được phát triển bởi công ty xAI của Elon Musk và tính năng lớn nhất của nó là quyền truy cập…
Hình phạt lặp lại
Hình phạt lặp lại là một tham số giải mã điều chỉnh đầu ra bằng cách giảm xác suất xuất hiện của các mã thông báo đã xuất hiện để…
Hướng dẫn làm theo
Khả năng tuân theo hướng dẫn là một chỉ số hiệu suất cho thấy mức độ chính xác mà LLM có thể tạo ra đầu ra phản ánh các hướng dẫn…
Hạn chế kiến thức
Điểm dừng kiến thức là ngày ngừng thu thập dữ liệu nghiên cứu LLM. Mô hình không thể biết điều gì đã xảy ra sau ngày này, đây…
Học tập trong bối cảnh
Học trong ngữ cảnh là một phương pháp suy luận giúp giải quyết các nhiệm vụ chỉ bằng cách sử dụng các ví dụ và hướng dẫn được đưa…
Hỗn hợp độ sâu
Hỗn hợp độ sâu là một phương pháp tự động xác định xem nên chuyển hay bỏ qua các phép tính cho từng mã thông báo trong mỗi lớp…
Khả năng giám sát CoT
Khả năng quan sát CoT đề cập đến đặc tính mà mô hình AI duy trì trạng thái trong đó con người và hệ thống giám sát có thể đọc…
Khả năng giải thích cơ học
Khả năng diễn giải cơ học là một phương pháp nghiên cứu cố gắng chia nhỏ cấu trúc bên trong của mạng lưới thần kinh thành các đơn…
Khả năng mới nổi
Khả năng mới nổi là hiện tượng các khả năng mới chưa từng thấy trong các mô hình quy mô nhỏ đột nhiên xuất hiện khi mô hình ngôn…
Khả năng tái tạo đầu ra (Tính quyết định)
Khả năng tái tạo đầu ra (tính xác định) là thuộc tính mà ngay cả khi bạn nhập cùng một tham số hạt giống số ngẫu nhiên và dấu…
Khấu hao mô hình
Việc ngừng sử dụng mô hình đề cập đến việc nhà cung cấp AI ngừng cung cấp một mô hình hoặc phiên bản API cụ thể và yêu cầu người…
Kimi (Moonshot)
Kimi (Moonshot) là dịch vụ trò chuyện AI dựa trên mô hình ngôn ngữ quy mô lớn (LLM) do Moonshot AI của Trung Quốc cung cấp.
Kiến thức tham số
Kiến thức tham số đề cập đến kiến thức được LLM nhúng trong các tham số (trọng số) thông qua quá trình học trước đó và đề cập…
Kích thước từ vựng
Kích thước từ vựng đề cập đến số lượng từ, từ phụ và ký hiệu (số lượng từ vựng) khác nhau mà mô hình ngôn ngữ quy mô lớn có thể…
Kết nối dư
Kết nối dư là một phương pháp thiết kế bổ sung đầu vào cũng như đầu ra của lớp mạng thần kinh để ổn định quá trình học tập mà…
Kỹ thuật bối cảnh
Kỹ thuật bối cảnh là phương pháp thiết kế và tối ưu hóa toàn bộ thông tin đầu vào như lời nhắc, kiến thức bên ngoài và lịch sử…
LLM (Mô hình ngôn ngữ quy mô lớn)
Viết tắt của Mô hình ngôn ngữ lớn. AI tạo câu đã học được từ một lượng lớn văn bản. Ví dụ điển hình là ChatGPT/Claude/Gemini.
LLM tiếng Nhật
LLM tiếng Nhật là mô hình ngôn ngữ quy mô lớn, được đào tạo chủ yếu trên dữ liệu văn bản tiếng Nhật và được tối ưu hóa về ngữ…
LLM đa ngôn ngữ
LLM đa ngôn ngữ là một mô hình ngôn ngữ quy mô lớn có thể hiểu và tạo văn bản bằng nhiều ngôn ngữ bằng một kiến trúc mô hình…
Llama (Meta)
Llama là một loạt các mô hình ngôn ngữ quy mô lớn, có trọng lượng mở được Meta phát triển và phát hành miễn phí. Đây là tùy chọn…
Lý do kết thúc
Lý do kết thúc là mục phản hồi cho biết nguyên nhân khiến API LLM ngừng tạo văn bản.
Lý luận lai
Mô hình lý luận kết hợp là một LLM có thể chuyển đổi linh hoạt giữa tư duy sâu (lý luận mở rộng) và các câu trả lời tức thì tốc…
Lý luận tiềm ẩn
Suy luận tiềm ẩn là phương pháp trong đó mô hình ngôn ngữ quy mô lớn thực hiện quá trình suy luận ở trạng thái ẩn bên trong…
Lấy mẫu Top-k
Lấy mẫu Top-k là một phương pháp giải mã trong đó khi LLM tạo mã thông báo tiếp theo, nó sẽ thu hẹp xuống k ứng cử viên có xác…
Lấy mẫu tối thiểu
Lấy mẫu tối thiểu là phương pháp lấy mẫu thu hẹp các ứng cử viên bằng cách xác định động giá trị ngưỡng dựa trên tỷ lệ tương đối…
MiniMax
MiniMax là dòng mô hình ngôn ngữ quy mô lớn (LLM) được phát triển bởi một công ty khởi nghiệp AI đến từ Thượng Hải, Trung Quốc.
Mistral
Mistral là một nhóm các mô hình ngôn ngữ quy mô lớn (LLM) được phát triển bởi Mistral AI của Pháp và được biết đến như một mô…
Mã hóa vị trí
Mã hóa vị trí là cơ chế gán thông tin thứ tự trong câu cho từng mã thông báo trong mô hình Transformer dưới dạng vectơ số. Nó…
Mã thông báo
Trình mã thông báo là một thuật toán chia văn bản thành các đơn vị nhỏ nhất (mã thông báo) mà LLM có thể xử lý. Tiếng Nhật có xu…
Mã thông báo hình ảnh
Mã thông báo hình ảnh là đơn vị xử lý tối thiểu mà AI đa phương thức phân chia nội bộ khi phân tích dữ liệu hình ảnh và được sử…
Mã thông báo lý luận
Mã thông báo suy luận là mã thông báo được sử dụng trong quá trình suy nghĩ (chuỗi sắp xếp) mà mô hình ngôn ngữ quy mô lớn tập…
Mô hình Omni
Omni-model là một AI có thể tích hợp và xử lý nhiều phương thức như văn bản, âm thanh, hình ảnh và video bằng một kiến trúc mô…
Mô hình biên giới
Frontier Model là mô hình ngôn ngữ AI quy mô lớn được phát triển bởi Anthropic, OpenAI và Google DeepMind, hiện có mức hiệu suất…
Mô hình cơ sở
Mô hình cơ sở là một LLM vừa được đào tạo trước trên một lượng lớn văn bản, trước khi thực hiện các điều chỉnh bổ sung cho việc…
Mô hình cấp độ byte (LM không có mã thông báo)
Mô hình cấp byte là mô hình ngôn ngữ xử lý văn bản dưới dạng chuỗi byte UTF-8 mà không chia nó thành mã thông báo từ phụ.
Mô hình không gian trạng thái (Mamba/SSM)
Mô hình không gian trạng thái (SSM) là một khung toán học để xử lý hiệu quả dữ liệu chuỗi thời gian/chuỗi bằng cách sử dụng đệ…
Mô hình ngôn ngữ khuếch tán (LLM khuếch tán)
Mô hình ngôn ngữ khuếch tán là LLM thế hệ mới áp dụng quy trình khuếch tán đã được chứng minh trong việc tạo hình ảnh sang tạo…
Mô hình ngôn ngữ đeo mặt nạ (Masked LM)
Mô hình ngôn ngữ đeo mặt nạ là một mô hình ngôn ngữ được huấn luyện bằng phương pháp học cố ý ẩn một số từ trong câu và dự đoán…
Mô hình ngữ cảnh dài
Mô hình ngữ cảnh dài là mô hình ngôn ngữ quy mô lớn có thể xử lý đầu vào từ hàng chục nghìn đến hàng triệu mã thông báo cùng một…
Mô hình nền móng
Mô hình nền tảng là mô hình AI có mục đích chung được đào tạo trước trên một lượng dữ liệu khổng lồ. Nó đề cập đến các mô hình…
Mô hình trọng lượng mở (Open Weight)
Mô hình trọng lượng mở là mô hình AI có trọng số mô hình đã đào tạo (tệp tham số) được công khai và bất kỳ ai cũng có thể tải…
Mô hình tự hồi quy
Mô hình tự hồi quy là mô hình ngôn ngữ cơ bản dự đoán tuần tự mã thông báo tiếp theo dựa trên chuỗi mã thông báo được tạo cho đến…
Mẫu trò chuyện
Mẫu trò chuyện là một cơ chế định dạng các tương tác giữa người dùng và AI theo vai trò, chẳng hạn như hệ thống/người dùng/trợ…
Người mẫu thế giới
Mô hình thế giới là một cấu trúc tri thức cho phép AI thể hiện nội bộ các quy luật vật lý, mối quan hệ nhân quả và các quy tắc xã…
Nhiệt độ (thông số nhiệt độ)
Nhiệt độ là tham số kiểm soát phân bố xác suất khi LLM chọn mã thông báo tiếp theo. Càng gần 0 thì đầu ra càng ổn định và nhất…
PLaMo (Mạng ưa thích LLM tiếng Nhật)
PLaMo là dòng mô hình ngôn ngữ quy mô lớn (LLM) trong nước được phát triển bởi Preferred Networks, có thế mạnh về xử lý ngôn ngữ…
Pha trộn ngôn ngữ
Trộn ngôn ngữ trong tư duy là hiện tượng LLM xuất ra một ngôn ngữ khác với ngôn ngữ đầu vào hoặc hỗn hợp nhiều ngôn ngữ trong quá…
Phi (Mô hình nhỏ của Microsoft)
Phi đề cập đến dòng Mô hình ngôn ngữ nhỏ (SLM) do Microsoft phát triển và được đặc trưng bởi khả năng thể hiện hiệu suất cao ngay…
Phiên bản mô hình cố định (Ghim mô hình)
Sửa phiên bản mô hình là một phương thức hoạt động sửa phiên bản của mô hình AI được API gọi thành một số cụ thể nhằm ngăn chặn…
Phương thức hợp nhất (Hợp nhất sớm/muộn)
Phương thức tổng hợp là công nghệ kết hợp và xử lý các loại dữ liệu khác nhau, chẳng hạn như văn bản, hình ảnh và âm thanh, trong…
Qwen (Ngàn câu hỏi)
Qwen là một loạt các mô hình ngôn ngữ quy mô lớn có trọng lượng mở được phát triển và xuất bản bởi Alibaba Cloud. Nó có hiệu suất…
SLM (Mô hình ngôn ngữ nhỏ)
SLM là một mô hình ngôn ngữ nhẹ, giữ số lượng tham số dưới hàng tỷ. Nó hoạt động với chi phí thấp hơn và độ trễ thấp hơn so với…
Sarashina (LLM tiếng Nhật từ SB Intuitions)
Sarashina là chuỗi mô hình ngôn ngữ quy mô lớn (LLM) chuyên về tiếng Nhật được phát triển bởi SB Intuitions, công ty con của…
Siêu liên kết
Siêu liên kết là một lĩnh vực nghiên cứu trong đó AI siêu thông minh, có khả năng cao hơn con người, được điều khiển và điều…
Suy nghĩ quá nhiều
Suy nghĩ quá mức là hiện tượng trong đó mô hình AI lãng phí mã thông báo và thời gian bằng cách lặp lại quá trình suy luận dài…
Suy nghĩ về ngân sách
Ngân sách suy nghĩ là giới hạn trên về số lượng mã thông báo suy luận nội bộ mà LLM có thể sử dụng trước khi đưa ra câu trả lời…
Suy nghĩ xen kẽ
Tư duy xen kẽ là một phương pháp tư duy trong đó mô hình AI xây dựng câu trả lời trong khi luân phiên thực hiện các bước suy luận…
Swallow (Học liên tục tiếng Nhật LLM)
Swallow là LLM mở được sản xuất trong nước nhằm cải thiện hiệu suất tiếng Nhật bằng cách thêm một lượng lớn văn bản tiếng Nhật…
SwiGLU (chức năng kích hoạt)
SwiGLU (chức năng kích hoạt) là một chức năng kích hoạt kết hợp chức năng Swish và GLU (cơ chế cổng) và được sử dụng để nâng cao…
Sycophancy
Sycophancy là xu hướng mô hình AI tuân theo ý kiến và mong đợi của người dùng, ưu tiên sự đồng ý hơn là sự thật khi phản hồi.
Số lượng thông số
Số lượng tham số là tổng số trọng số mà mạng nơ-ron như LLM thu được thông qua quá trình học và là chỉ số điển hình được sử dụng…
Sự sắp xếp có chủ ý
Căn chỉnh có chủ ý là một phương pháp căn chỉnh trong đó mô hình đưa ra chính sách an toàn một cách rõ ràng trước khi tạo ra câu…
Thu gọn mô hình
Sự sụp đổ mô hình là một hiện tượng trong đó tính đa dạng và độ chính xác của đầu ra của mô hình giảm dần khi nội dung do AI tạo…
Thông số hoạt động
Tham số hoạt động là các phần tham số của toàn bộ mô hình được sử dụng thực tế trong một phép tính suy luận và là chỉ số để đo…
Thông số mẫu
Đặc tả mô hình là đặc tả công khai quy định mục đích, quy tắc ứng xử và mức độ ưu tiên mà mô hình AI phải tuân theo theo cách…
Thế hệ AI
Công nghệ AI tạo sinh văn bản, hình ảnh, âm thanh và video mới. Nhân vật chính AI bùng nổ sau ChatGPT.
Top-p (lấy mẫu hạt nhân)
Top-p (lấy mẫu lõi) là phương pháp trong đó AI sử dụng lấy mẫu xác suất để chỉ chọn những ứng cử viên hàng đầu có xác suất tích…
Trôi dạt cá tính (trôi dạt nhân cách)
Sự trôi dạt cá nhân là một hiện tượng trong đó giọng điệu, cài đặt vai trò và chính sách phản hồi của AI agent dần dần lệch khỏi…
Tìm kiếm tia
Tìm kiếm chùm tia là một phương pháp giải mã nhằm tìm kiếm các chuỗi từ ứng cử viên trong khi vẫn giữ lại một số nhất định (độ…
Tính toán thời gian thử nghiệm
Tính toán thời gian thử nghiệm là một phương pháp cải thiện chất lượng đầu ra bằng cách đầu tư thêm tài nguyên tính toán vào giai…
Tóm tắt lý luận
Tóm tắt suy luận là chức năng tóm tắt và trình bày suy nghĩ bên trong (mã thông báo suy luận) mà mô hình AI thực hiện trong quá…
Từ chối quá mức
Từ chối quá mức là hiện tượng trong đó LLM xác định nhầm các câu hỏi và hướng dẫn an toàn là có hại và từ chối trả lời các câu…
VLM (mô hình ngôn ngữ hình ảnh)
VLM là mô hình ngôn ngữ hình ảnh có thể hiểu và xử lý đồng thời văn bản, hình ảnh và video. Nó cho phép tự động tạo mô tả hình…
Vector chỉ đạo
Vectơ chỉ đạo là công nghệ thêm vectơ theo một hướng cụ thể vào quá trình kích hoạt nội bộ của LLM để kiểm soát âm thanh đầu ra,…
Xoay bối cảnh
Lỗi bối cảnh là một hiện tượng trong đó khi lượng thông tin đầu vào vào cửa sổ ngữ cảnh LLM tăng lên, mô hình sẽ bỏ qua thông tin…
Xác suất ghi nhật ký (Logprobs)
Khả năng ghi nhật ký (Logprobs) là một giá trị số được biểu thị dưới dạng logarit tự nhiên của xác suất mà LLM gán cho từng ứng…
cửa sổ ngữ cảnh
Độ dài câu mà AI có thể xử lý cùng một lúc. Được biểu thị bằng số lượng mã thông báo (ví dụ: Claude Opus 4.7 là 1 triệu mã thông…
gpt-oss (Mô hình trọng lượng mở OpenAI)
gpt-oss là một mô hình ngôn ngữ có trọng lượng mở quy mô lớn do OpenAI phát hành và bạn có thể thoải mái tải xuống các trọng…
mã thông báo
Một nhóm nhân vật được xử lý bởi AI. Trong tiếng Nhật, 1 ký tự ≒ 1 mã thông báo; trong tiếng Anh, một từ ≒ 1 token. Nó cũng là…
mô hình suy luận
LLM suy nghĩ rất lâu và kỹ lưỡng trước khi trả lời. Tư duy OpenAI o1/GPT-5, Claude Opus 4.7, Tư duy Gemini, v.v.
tsuzumi (NTT tiếng Nhật LLM)
Tsuzumi là một LLM (Mô hình ngôn ngữ quy mô lớn) dành riêng cho Nhật Bản được NTT công bố vào năm 2024 và là mô hình được cung…
tìm kiếm sâu
DeepSeek là dòng LLM mã nguồn mở hiệu suất cao được phát triển bởi một công ty AI Trung Quốc. Đầu năm 2025, nó đã gây sốc cho…
Đầu truy xuất
Đầu tìm kiếm là một phần của đầu chú ý, đóng vai trò trích xuất có chọn lọc thông tin cần thiết từ ngữ cảnh dài trong LLM kiểu…
Đối thoại nhiều lượt (Multi-turn)
Hội thoại nhiều lượt là dạng hội thoại khác với hội thoại hỏi đáp một lần và tiếp tục nhiều lần trong khi vẫn giữ lại các tương…
Độ lệch logit
Sai lệch logit là một phương pháp kiểm soát cộng hoặc trừ một giá trị số cho xác suất tạo (logit) của mỗi ứng cử viên khi LLM…
đa phương thức
AI có thể xử lý văn bản + hình ảnh + âm thanh + video cùng một lúc. GPT-5 / Claude Opus 4.7 / Gemini đều được hỗ trợ.
Ảo giác
Một hiện tượng AI nói những lời nói dối tương tự. Thông tin không có trong dữ liệu huấn luyện được tạo ra bằng cách đoán.
Ảo giác đa phương thức (ảo giác đối tượng)
Ảo giác đa phương thức (ảo giác đối tượng) là hiện tượng trong đó mô hình AI xử lý hình ảnh và video bao gồm các đối tượng và…