Đảo ngược văn bản là công nghệ cho phép AI tạo hình ảnh tìm hiểu các khái niệm, phong cách và con người mới từ một số hình ảnh tham chiếu và nhúng chúng dưới dạng mã thông báo văn bản.
Đảo ngược văn bản là một phương pháp được công bố bởi Weizmann et al. vào năm 2022, nhúng một khái niệm cụ thể dưới dạng mã thông báo văn bản mới (ví dụ: "<my-style>") từ khoảng 3 đến 5 hình ảnh tham chiếu vào một mô hình phổ biến, chẳng hạn như Stable Diffusion. Vì bản thân trọng số của mô hình không thay đổi và chỉ các vectơ nhúng được tối ưu hóa nên kích thước tệp cực kỳ nhỏ (vài KB) so với LoRA và DreamBooth.
Trong hoạt động thực tế vào năm 2026, sẽ có nhiều trường hợp độ chính xác của việc tái tạo khái niệm sẽ kém hơn LoRA và tại hiện trường, người ta đã xác định rằng ``Đảo ngược văn bản được sử dụng để tham chiếu phong cách và LoRA được sử dụng để tái tạo khuôn mặt/nhân vật.'' Chi phí học tập thấp, khoảng 30 đến 60 phút trên một GPU duy nhất và nó vẫn hiệu quả ở chỗ có thể dễ dàng thử bằng API của Stability AI hoặc ComfyUI trong môi trường cục bộ. Tuy nhiên, người ta nhận thấy rằng cần phải đào tạo lại mỗi khi kiến trúc mô hình tổng quát thay đổi và không thể sử dụng các phần nhúng hiện có khi chuyển từ hệ thống SDXL sang SD3. Từ quan điểm của ReviewAI, chúng tôi định vị nó như một phương pháp giới thiệu cho những ai muốn thử tái tạo logo thương hiệu hoặc nét minh họa cụ thể với chi phí thấp và nếu bạn đang tìm kiếm độ chính xác, chúng tôi khuyên bạn nên chuyển sang LoRA.