Wan là mô hình AI tạo video mã nguồn mở được phát triển bởi Alibaba. Bạn có thể tạo video ngắn chất lượng cao từ văn bản và hình ảnh.
Wan là mô hình AI tạo video mã nguồn mở được phát triển bởi nhóm Tongyi của Alibaba. Wan2.1, được phát hành vào đầu năm 2025, hỗ trợ cả tác vụ chuyển văn bản thành video (T2V) và hình ảnh thành video (I2V), đồng thời ghi điểm bằng hoặc cao hơn cùng mức với Sora và Runway trong các điểm chuẩn công khai. Điểm khác biệt chính so với đối thủ cạnh tranh là nó có thể được sử dụng thương mại theo giấy phép Apache 2.0.
Trong đánh giá hoạt động thực tế của ban biên tập, nó đang thu hút sự chú ý vì là lựa chọn duy nhất có thể giảm chi phí API đám mây xuống 0 vì có thể thực hiện suy luận trên GPU cục bộ (tương đương A100). Tính đến năm 2026, giá thị trường qua đám mây sẽ vào khoảng 0,03 USD đến 0,10 USD mỗi phút được tạo ra, thấp hơn một nửa giá của Runway Gen-3 và Google Veo 2.
Đối với phương pháp lựa chọn tại hiện trường, ``Wan được sử dụng để tạo số lượng lớn các clip ngắn từ 5 đến 10 giây và Runway/Veo 2 được sử dụng cho các clip dài hơn'', phương pháp này đang được thiết lập. Cạm bẫy là tính nhất quán của chuyển động có xu hướng bị gián đoạn trong thời gian dài và độ chính xác của lời nhắc tiếng Nhật thấp hơn khoảng 20% so với tiếng Anh. Ví dụ: nó ngày càng được sử dụng để tạo biểu ngữ chuyển động cho các trang sản phẩm EC và clip cho quảng cáo SNS.