ReviewAI
Xếp hạngDanh mụcKhám pháTạp chíSo sánhMiễn phíTừ điển

Từ điển thuật ngữ AI

1.363 thuật ngữ được giải thích ngắn gọn bằng tiếng Việt — đủ để hiểu tài liệu kỹ thuật mà không cần tra thêm.

API tìm kiếm cho LLM (API tìm kiếm)

API tìm kiếm cho LLM là một cơ chế trong đó mô hình ngôn ngữ quy mô lớn thu được thông tin mới nhất không có trong dữ liệu đào…

BGE-M3 (mô hình nhúng đa ngôn ngữ)

BGE-M3 là mô hình nhúng đa ngôn ngữ được phát triển bởi Viện Trí tuệ nhân tạo Jiyuan Bắc Kinh (BAAI), mô hình hóa văn bản bằng…

BM25 (thuật toán tìm kiếm từ khóa)

BM25 là một thuật toán truy xuất thông tin còn được gọi là Okapi BM25, là một phương pháp tiêu chuẩn ngành để tìm kiếm toàn văn…

Bộ giải mã kết hợp (FiD)

Fusion-in-Decoding là phương pháp triển khai RAG mã hóa nhiều tài liệu thu được thông qua tìm kiếm riêng lẻ, tích hợp chúng lại…

Bộ mã hóa chéo

Mã hóa chéo là phương pháp nhập các cặp câu hỏi và tài liệu ứng viên vào một mô hình duy nhất và tính trực tiếp điểm phù hợp.

Bộ đệm ngữ nghĩa

Bộ nhớ đệm ngữ nghĩa là một cơ chế trả về phản hồi mà không cần phải truy vấn lại LLM bằng cách vector hóa truy vấn và so sánh nó…

CAG (tạo phần mở rộng bộ đệm)

CAG (tạo tăng cường bộ đệm) là phương pháp lưu trữ trước kiến ​​thức cần thiết trong bộ đệm ngữ cảnh của LLM và tạo ra câu trả…

Chuyển văn bản sang SQL (Tạo SQL từ ngôn ngữ tự nhiên)

Text-to-SQL là công nghệ trong đó AI tự động chuyển đổi các câu hỏi được viết bằng ngôn ngữ tự nhiên thành truy vấn SQL dựa trên…

Chuỗi ghi chú

Chuỗi ghi chú là một phương pháp ngăn chặn ảo giác do các tài liệu không liên quan gây ra bằng cách yêu cầu mô hình tạo ghi chú…

Chống trùng lặp

Chống trùng lặp là quá trình phát hiện và loại bỏ các tài liệu/khối tài liệu giống hệt hoặc tương tự trong RAG hoặc cơ sở hạ tầng…

Chồng chéo đoạn

Chồng chéo khối là một phương pháp cố ý chồng lấp ranh giới giữa các khối liền kề để tránh mất thông tin khi chia tài liệu thành…

ColBERT (Tìm kiếm tương tác muộn)

ColBERT (Tìm kiếm tương tác muộn) là kiến ​​trúc tìm kiếm có độ chính xác cao giúp vector hóa các truy vấn và tài liệu theo đơn…

Cắt nhỏ

Chunking là công nghệ sử dụng hệ thống RAG để chia các tài liệu dài thành các đơn vị nhỏ hơn để dễ tìm kiếm và xử lý hơn. Đây là…

Dệt (vectơ DB)

Weaviate là một cơ sở dữ liệu vectơ nguồn mở cho phép bạn vector hóa văn bản và hình ảnh cũng như tìm kiếm những điểm tương đồng.…

Dữ liệu bảng RAG (Bảng RAG)

Dữ liệu dạng bảng RAG là một phương pháp RAG giúp tìm kiếm trong khi vẫn giữ nguyên cấu trúc hàng và cột của dữ liệu dạng bảng…

FLARE (đọc trước tìm kiếm tích cực)

FLARE (truy xuất chủ động đọc trước) là một phương pháp RAG xem trước những gì sẽ xảy ra tiếp theo trong quá trình tạo văn bản,…

Faiss (thư viện tìm kiếm vector)

Faiss là một thư viện mã nguồn mở được phát triển bởi Meta, giúp tìm kiếm nhanh chóng các vectơ tương tự từ một số lượng lớn…

Gán siêu dữ liệu tự động (Auto-metadata)

Bổ sung siêu dữ liệu tự động là công nghệ sử dụng AI để tự động trích xuất các thông tin bổ sung như tiêu đề, ngày tháng, danh…

HNSW (Tìm kiếm hàng xóm gần nhất)

HNSW là một thuật toán tìm kiếm lân cận gần nhất có cấu trúc đồ thị, nhanh chóng tìm kiếm các ứng cử viên tương tự về mặt ngữ…

HyDE (nhúng tài liệu giả định)

HyDE (nhúng tài liệu giả định) là phương pháp sử dụng LLM để tạo tài liệu trả lời giả định cho truy vấn và sử dụng vectơ nhúng đó…

IVF (Chỉ mục tệp đảo ngược)

IVF là phương pháp lập chỉ mục vectơ giúp tăng tốc độ tìm kiếm lân cận gần nhất bằng cách chia một lượng lớn dữ liệu vectơ thành…

Khai thác thông tin

Trích xuất thông tin là một công nghệ trích xuất các mục cụ thể như ngày, số tiền, tên và số điều khoản từ các văn bản phi cấu…

Khai thác tiêu cực cứng

Khai thác tiêu cực cứng là một phương pháp huấn luyện một mô hình nhúng bằng cách cố tình chọn các ví dụ tiêu cực sai một cách…

LightRAG (đồ thị nhẹ RAG)

LightRAG là phương pháp RAG (tạo tăng cường truy xuất) tự động xây dựng biểu đồ tri thức nhẹ từ văn bản và kết hợp tìm kiếm vectơ…

LlamaChỉ số

LlamaIndex là một khung dữ liệu nguồn mở để kết nối dữ liệu bên ngoài với LLM nhằm xây dựng các ứng dụng RAG (tạo tiện ích mở…

Loại agent RAG (Agentic RAG)

RAG dựa trên agent là sự phát triển của kiến ​​trúc RAG thông thường trong đó AI agent tự động tạo ra các truy vấn tìm kiếm, thu…

Làm mới kiến ​​thức (Data Freshness)

Làm mới kiến ​​thức là một khái niệm cho biết mức độ cập nhật và phù hợp của dữ liệu đào tạo của mô hình AI và thông tin được RAG…

Lượng tử hóa sản phẩm

Lượng tử hóa sản phẩm là phương pháp phân chia và lượng tử hóa các vectơ để giảm dung lượng lưu trữ nhúng và cho phép tìm kiếm…

Lập chỉ mục lại

Lập chỉ mục lại là quá trình tạo lại các vectơ và chỉ mục nhúng để phản ánh các bổ sung, cập nhật và xóa dữ liệu gốc trong chỉ…

Lọc siêu dữ liệu

Lọc siêu dữ liệu là phương pháp thu hẹp các tài liệu cần tìm kiếm bằng cách chỉ định thông tin thuộc tính như ngày, danh mục và…

Lớp ngữ nghĩa (nghĩa là lớp định nghĩa)

Lớp ngữ nghĩa là lớp trung gian tách cấu trúc của dữ liệu thô khỏi các định nghĩa ý nghĩa của các thuật ngữ và chỉ báo kinh doanh…

MMR (Mức độ liên quan cận biên tối đa)

MMR là phương pháp xếp hạng lại nhằm cân bằng mức độ liên quan đến truy vấn và sự tương đồng giữa các ứng viên khi chọn các khối…

Milvus (vector DB)

Milvus là một cơ sở dữ liệu vectơ mã nguồn mở cho phép tìm kiếm độ tương tự tốc độ cao đối với số lượng lớn các vectơ nhúng.

Mô hình nhúng tiếng Nhật (Ruri/JaColBERT)

Mô hình nhúng tiếng Nhật là mô hình nhúng được huấn luyện bằng dữ liệu tiếng Nhật để chuyển đổi nghĩa của các cụm từ và thuật ngữ…

Mở rộng truy vấn

Mở rộng truy vấn là công nghệ tự động bổ sung truy vấn tìm kiếm do người dùng nhập bằng từ đồng nghĩa, từ liên quan và cách diễn…

Ngưỡng tương tự

Ngưỡng tương tự là ngưỡng được sử dụng để loại trừ các tài liệu có điểm tương tự thấp hơn giá trị tham chiếu khỏi kết quả tìm…

Nhúng (nhúng vector)

Một công nghệ chuyển đổi văn bản và hình ảnh thành các vectơ số. Khái niệm cơ bản về tìm kiếm tương tự và RAG.

Nhúng Matryoshka (MRL)

Nhúng Matryoshka (MRL) là một phương pháp nhúng đã được đào tạo để lưu giữ thông tin ngữ nghĩa ngay cả khi chỉ trích xuất phần…

Nhúng lượng tử hóa nhị phân

Nhúng lượng tử hóa nhị phân là phương pháp nén vectơ chuyển đổi giá trị của từng chiều của vectơ nhúng thành 1 bit (0 hoặc 1).

Nhúng thứ nguyên

Số thứ nguyên được nhúng là số giá trị số (kích thước) mà một vectơ có khi văn bản hoặc hình ảnh được chuyển đổi thành vectơ.

Nhúng tinh chỉnh

Tinh chỉnh nhúng là phương pháp đào tạo bổ sung mô hình nhúng có mục đích chung bằng cách sử dụng dữ liệu nội bộ để tối ưu hóa độ…

Nhúng trôi

Nhúng trôi là hiện tượng trong đó sự phân bố của vectơ nhúng thay đổi theo thời gian hoặc khi mô hình được cập nhật, dẫn đến độ…

Nhúng đa phương thức

Nhúng đa phương thức là công nghệ chuyển đổi các loại dữ liệu khác nhau như văn bản, hình ảnh và âm thanh thành các biểu diễn số…

NotebookLM

NotebookLM là trợ lý nghiên cứu AI dựa trên RAG do Google cung cấp. Vì các câu trả lời chỉ được tạo ra bằng cách sử dụng các tài…

Nén theo ngữ cảnh

Truy xuất nén ngữ cảnh là phương pháp tìm kiếm loại bỏ các phần không liên quan đến câu hỏi khỏi tài liệu được RAG tìm kiếm, chỉ…

OCR (Nhận dạng ký tự quang học)

OCR (Nhận dạng ký tự quang học) là công nghệ chuyển đổi các ký tự có trong hình ảnh được quét và tệp PDF thành dữ liệu văn bản có…

Phiên bản tài liệu

Kiểm soát phiên bản tài liệu là một cơ chế theo dõi lịch sử sửa đổi của các tài liệu được tham chiếu trong RAG và cơ sở kiến…

Phát hiện cộng đồng

Phát hiện cộng đồng là phương pháp tự động tìm các nhóm nút (cụm) được kết nối chặt chẽ trong biểu đồ hoặc cấu trúc mạng.

Phân tách truy vấn

Phân tách truy vấn là một phương pháp RAG chia một câu hỏi hoặc truy vấn tìm kiếm phức tạp thành nhiều truy vấn con, tìm kiếm và…

Phân tích hình thái (MeCab / Sudachi)

Phân tích hình thái là một công nghệ xử lý ngôn ngữ tự nhiên giúp phân chia các câu, chẳng hạn như tiếng Nhật, trong đó các từ…

Phân tích tài liệu (phân tích cấu trúc PDF)

Phân tích cú pháp tài liệu (phân tích cấu trúc PDF) là một quá trình trích xuất thông tin cấu trúc như văn bản, bảng và hình ảnh…

Phân đoạn muộn

Phân đoạn muộn là một phương pháp nhúng trong đó toàn bộ tài liệu được chuyển qua mô hình nhúng hỗ trợ các ngữ cảnh dài, sau đó…

Phân đoạn ngữ nghĩa

Phân đoạn ngữ nghĩa là một phương pháp tiền xử lý giúp cải thiện độ chính xác của tìm kiếm RAG bằng cách chia tài liệu thành các…

Phân đoạn đề xuất

Phân đoạn đề xuất là một phương pháp cải thiện độ chính xác của tìm kiếm RAG bằng cách chia tài liệu thành ``đơn vị thực tế tối…

Qdrant (vectơ DB)

Qdrant là một cơ sở dữ liệu vectơ mã nguồn mở cho phép tìm kiếm độ tương tự tốc độ cao đối với văn bản và hình ảnh được vector…

RAFT (Điều chỉnh tinh chỉnh tăng cường tìm kiếm)

RAFT (Tinh chỉnh tăng cường truy xuất) là một phương pháp cho phép LLM học thêm khả năng xác định cơ sở cho câu trả lời đúng…

RAG (Tạo tiện ích mở rộng tìm kiếm)

RAG. Một hệ thống cho phép AI tìm kiếm tài liệu nội bộ và cơ sở dữ liệu bên ngoài trước khi đưa ra câu trả lời.

RAG khắc phục (CRAG)

RAG khắc phục là phương pháp đánh giá mức độ liên quan của kết quả tìm kiếm RAG và, nếu không đủ, sẽ sửa chúng bằng cách sử dụng…

RAG thích ứng

RAG thích ứng là phương pháp RAG thay đổi linh hoạt nhu cầu tìm kiếm và chiến lược tìm kiếm tùy thuộc vào độ khó và loại câu hỏi.

RAG đa phương thức

RAG đa phương thức là một phần mở rộng của RAG không chỉ bao gồm văn bản mà còn bao gồm hình ảnh, âm thanh, video, v.v. làm mục…

RAG-Fusion (Tìm kiếm tổng hợp RAG)

RAG-Fusion (tìm kiếm tổng hợp RAG) là phương pháp mở rộng RAG tự động tạo ra nhiều truy vấn tương tự từ một câu hỏi duy nhất và…

RAPTOR (Tìm kiếm tóm tắt phân cấp)

RAPTOR là một phương pháp RAG phân cụm đệ quy và tóm tắt các khối tài liệu để xây dựng cây phân cấp và cho phép tìm kiếm từ nhiều…

RRF (Hợp nhất xếp hạng đối ứng)

RRF (kết hợp xếp hạng đối ứng) là phương pháp tích hợp thứ hạng của nhiều kết quả tìm kiếm, chẳng hạn như tìm kiếm từ khóa và tìm…

SPLADE (tìm kiếm thưa thớt)

SPLADE là một phương pháp mở rộng vốn từ vựng của tài liệu và truy vấn, đồng thời dự đoán tầm quan trọng của chúng bằng mô hình…

Self-RAG (RAG tự phản chiếu)

Self-RAG là phương pháp RAG tự phản chiếu trong đó LLM đánh giá sự cần thiết của việc tìm kiếm và tính hợp lệ của các tài liệu…

Sơ đồ tri thức

Biểu đồ tri thức là cơ sở dữ liệu tri thức thể hiện các thực thể và mối quan hệ của chúng trong cấu trúc biểu đồ. Kết hợp với…

Thiết kế vắng mặt

Bỏ phiếu trắng là một phương pháp trong đó mô hình AI được thiết kế để giữ lại hoặc từ chối câu trả lời cho các câu hỏi không có…

Truy xuất cửa sổ câu

Tìm kiếm trong cửa sổ câu là một phương pháp RAG chia tài liệu thành các phần nhỏ của một câu, thực hiện tìm kiếm được nhúng, cải…

Truy xuất dày đặc

Tìm kiếm vectơ dày đặc là công nghệ chuyển đổi văn bản thành các vectơ dày đặc nhiều chiều bằng cách sử dụng mạng thần kinh và…

Truy xuất nhiều bước nhảy

Tìm kiếm nhiều bước là một kỹ thuật RAG duyệt qua nhiều tài liệu và sử dụng các kết quả tìm kiếm trước đó cho các truy vấn tiếp…

Truy xuất theo ngữ cảnh

Tìm kiếm theo ngữ cảnh là một phương pháp cải thiện độ chính xác của tìm kiếm trong RAG bằng cách bổ sung ngữ cảnh của các khối…

Truy xuất tài liệu dành cho phụ huynh

Tìm kiếm tài liệu gốc là phương pháp cải thiện độ chính xác của tìm kiếm bằng cách sử dụng các đoạn nhỏ trong RAG đồng thời cải…

Truy xuất đa ngôn ngữ

Tìm kiếm đa ngôn ngữ là phương pháp tìm kiếm trả về kết quả dựa trên sự giống nhau về ý nghĩa, ngay cả khi câu hỏi và tài liệu…

Trình kết nối dữ liệu

Trình kết nối dữ liệu là một cơ chế kết nối các nguồn dữ liệu bên ngoài như cơ sở dữ liệu nội bộ, SaaS và bộ lưu trữ tệp với các…

Tìm kiếm AI

Các tìm kiếm thế hệ mới như "Tổng quan về AI" và Perplexity, trong đó AI đưa ra câu trả lời ở đầu các tìm kiếm của Google.

Tìm kiếm kết hợp

Tìm kiếm kết hợp là phương pháp tìm kiếm kết hợp giữa so khớp từ khóa (tìm kiếm thưa thớt) và sự tương đồng về ngữ nghĩa (tìm…

Tìm kiếm ngữ nghĩa

Tìm kiếm ngữ nghĩa là một công nghệ tìm kiếm tài liệu dựa trên `` độ gần ngữ nghĩa '' thay vì kết quả khớp với chuỗi từ khóa.…

Tạo trích dẫn

Tạo trích dẫn là một cơ chế trong đó AI thế hệ xác định nguồn thông tin được tham chiếu khi tạo câu trả lời và chỉ rõ URL hoặc…

Từ điển đồng nghĩa

Từ điển đồng nghĩa là một danh sách song ngữ liên kết các truy vấn tìm kiếm với các từ diễn giải được viết khác nhau trong tài…

Xung đột kiến ​​thức

Xung đột kiến ​​thức là hiện tượng trong đó kiến ​​thức nội bộ mà LLM có được trong quá trình đào tạo về RAG (Tạo tăng cường truy…

Xếp hạng lại

Xếp hạng lại là công nghệ phục hồi các tài liệu ứng viên được tìm kiếm ban đầu bằng hệ thống RAG bằng mô hình chính xác hơn và…

bối rối

Công cụ tìm kiếm AI trả lời bằng trích dẫn. Thay thế tìm kiếm truyền thống trong công việc nghiên cứu.

cơ sở dữ liệu vector

Một DB chuyên dụng để tìm kiếm độ tương tự tốc độ cao của các phần nhúng (vectơ số). Đại diện bởi Pinecone / Qdrant / Weaviate.

nối đất

Nối đất là một kỹ thuật ngăn ngừa ảo giác bằng cách nối đất đầu ra của LLM với các nguồn thông tin cụ thể như tài liệu nội bộ và…

pgvector (Phần mở rộng vectơ Postgres)

pgvector là một phần mở rộng mã nguồn mở cho PostgreSQL bổ sung các cột vectơ và chức năng tìm kiếm lân cận gần nhất và được sử…

Đường ống dẫn vào

Đường dẫn nhập là một cơ chế thực hiện một loạt quy trình từ thu thập, chuyển đổi, phân chia, nhúng và lưu trữ để làm cho dữ liệu…

Định tuyến truy vấn

Định tuyến truy vấn là cơ chế phân tích nội dung câu hỏi của người dùng và tự động định tuyến câu hỏi đó đến tuyến xử lý phù hợp…

Độ phân giải thực thể

Phân giải thực thể là công nghệ xác định các thực thể giống hệt nhau (con người, công ty, sản phẩm, v.v.) tồn tại trong các nguồn…

Độ tương tự cosin

Độ tương tự cosine là chỉ số tương tự thể hiện mức độ gần gũi về mặt ngữ nghĩa của văn bản và hình ảnh dưới dạng giá trị từ 0 đến…

đồ thịRAG

GraphRAG là công nghệ tạo mở rộng tìm kiếm giúp trích xuất các câu trả lời chính xác hơn cho các câu hỏi xuyên suốt phức tạp bằng…