Chỉ định khung bắt đầu và khung kết thúc là phương pháp cung cấp cho AI tạo video hai hình ảnh tĩnh, điểm bắt đầu và điểm kết thúc, đồng thời tự động nội suy chuyển động giữa chúng.
Chỉ định Khung hình đầu tiên là phương pháp trong đó hai hình ảnh tĩnh được nhập vào AI tạo video để làm điểm bắt đầu và điểm kết thúc, đồng thời AI tạo sinh chuyển động kết nối chúng. Đây được cho là một tính năng được áp dụng rộng rãi trong các mô hình tạo video lớn như Runway Gen-3 và Sora. So với việc chỉ tạo lời nhắc bằng văn bản, việc duy trì tính nhất quán trong bố cục và tư thế sẽ dễ dàng hơn và được cho là phù hợp với các ứng dụng thực tế như kết nối mặt trước và mặt sau của các vết cắt sản phẩm và tạo hoạt ảnh cho logo. Tuy nhiên, kể từ năm 2026, điều quan trọng cần lưu ý là nếu góc xem hoặc kích thước chủ thể của hai hình ảnh được chỉ định khác nhau đáng kể thì có thể xảy ra lỗi ở khung hình trung gian và độ phân giải được hỗ trợ cũng như giới hạn trên của số giây có thể được tạo ra sẽ khác nhau tùy theo kiểu máy. Nếu quá trình tạo không thành công, tín dụng sẽ bị tiêu hao mỗi khi thực hiện thử lại, do đó chi phí có xu hướng tăng khi thực hiện các điều chỉnh chi tiết hơn. Một phương pháp lựa chọn hiệu quả tại chỗ trước tiên là kiểm tra tính tương thích của bố cục với độ phân giải thấp và độ dài ngắn, sau đó tạo phiên bản cuối cùng ở độ phân giải thực tế.