3D từ video là công nghệ sử dụng AI để ước tính độ sâu của chủ thể hoặc không gian từ cảnh video một mắt hoặc nhiều chế độ xem và tự động tạo mô hình 3D ba chiều.
Video-to-3D là công nghệ phân tích thông tin thị sai và chuyển động từ nhiều khung hình của video và tái tạo lại dữ liệu 3D ở các định dạng như đám mây điểm, lưới, NeRF (Trường bức xạ thần kinh) và phân tán Gaussian 3D, đồng thời được cho là một hình thức quang trắc nâng cao tập trung vào hình ảnh tĩnh. Nó ngày càng được áp dụng để tạo chế độ xem 360 độ cho các sản phẩm EC, nội dung xem trước 3D cho bất động sản và sản xuất tài sản cho trò chơi và XR. Trong hoạt động thực tế kể từ năm 2026, độ chính xác có thể giảm với các vật liệu phản chiếu/trong suốt và các đối tượng chuyển động nhanh, đồng thời người ta đã chỉ ra rằng lượng ánh sáng tại thời điểm chụp, hoạt động của máy ảnh và tốc độ quay của đối tượng sẽ ảnh hưởng đến độ chính xác của cảnh quay trên thực địa. Về mặt chi phí, các API đám mây loại thanh toán theo nhu cầu sử dụng là phổ biến và cần phải chọn dịch vụ dựa trên sự đánh đổi với độ phân giải đầu ra và thời gian xử lý.