ReviewAI
Xếp hạngDanh mụcKhám pháTạp chíSo sánhMiễn phíTừ điển

OmniHuman (tạo video của con người)

OmniHuman là công nghệ AI kết hợp hình ảnh duy nhất của một người với dữ liệu tham chiếu về giọng nói và chuyển động để tạo ra video toàn thân tự nhiên bao gồm đồng bộ hóa miệng và cử chỉ.

OmniHuman được cho là một loại AI tạo video của con người kết hợp một hình ảnh tĩnh duy nhất với các đầu vào như tham chiếu âm thanh và chuyển động để tạo ra các video toàn thân tự nhiên bao gồm đồng bộ hóa miệng, cử chỉ và ánh mắt. Không giống như tạo video có mục đích chung như Sora và Runway, nó độc đáo ở chỗ nó bắt đầu từ hình ảnh của người thật và việc sử dụng nó trong lĩnh vực quảng cáo, video đào tạo, lồng tiếng đa ngôn ngữ, v.v. sẽ phổ biến kể từ năm 2026. Mặt khác, trong sử dụng thực tế, những cạm bẫy bao gồm video càng dài thì càng có nhiều khả năng bị mất tính nhất quán của bàn tay và nền, yêu cầu chỉnh sửa cho mỗi lần cắt và nguy cơ về quyền chân dung và đánh cắp danh tính nếu hình ảnh của mọi người được sử dụng mà không có sự đồng ý của người đó. Chi phí cho mục đích sử dụng thương mại thường được trả theo mức sử dụng dựa trên quy mô và độ phân giải sản xuất, đồng thời việc so sánh giá thị trường giữa các dịch vụ và lựa chọn dựa trên độ chính xác của việc hát nhép, khả năng tương thích với âm thanh tiếng Nhật và phạm vi điều khoản sử dụng thương mại được coi là thực tế.

Thuật ngữ liên quan