Video-to-video là công nghệ tạo video sử dụng AI để chuyển đổi kiểu, chất lượng hình ảnh, nền, v.v. của video đầu vào thành một video khác trong khi vẫn giữ nguyên chuyển động và bố cục.
Video-to-Video là công nghệ AI thế hệ lấy video hiện có làm đầu vào và chuyển đổi video đó thành một kiểu hình ảnh, nền và diện mạo nhân vật khác trong khi vẫn duy trì tính nhất quán về thời gian như chuyển động và bố cục. Nó được cho là một khái niệm đồng hành với Text-to-Video, tính năng tạo video từ văn bản. Việc sử dụng nó ngày càng mở rộng để chuyển đổi cảnh quay người thật đóng thành cảnh phim theo phong cách anime và biến cảnh quay chuyển động đơn giản thành cảnh quay chất lượng cao. Tuy nhiên, trong hoạt động thực tế kể từ năm 2026, vẫn còn những vấn đề về tính nhất quán theo thời gian như hiện tượng nhấp nháy giữa các khung hình và mất đường viền của chủ thể, đồng thời các video dài hơn với các chuyển động phức tạp hơn có xu hướng dễ bị hỏng hơn. Trong thực tế, người ta thường tạo các clip ngắn từ vài giây đến hàng chục giây rồi ghép chúng lại với nhau và chi phí tạo thường được tính theo giây hoặc trả theo mức sử dụng dựa trên thời lượng của video. Khi chọn một công cụ, điều quan trọng là phải kiểm tra trước độ phân giải tối đa và số giây có thể được hỗ trợ, độ chính xác của chuyển đổi kiểu cũng như phạm vi giấy phép sử dụng thương mại và sử dụng công cụ thích hợp theo mục đích.