FramePack là phương pháp trong đó AI tạo video nén các khung hình trong quá khứ để vừa với đầu vào có kích thước cố định khi tạo video dài, tăng số lượng khung hình đồng thời tiết kiệm bộ nhớ.
FramePack là công nghệ giúp giảm mức tiêu thụ bộ nhớ GPU bằng cách nén các khung hình đã được tạo trước đây và đóng gói chúng vào ngữ cảnh có kích thước cố định khi AI tạo video tạo ra một video dài. Nó đã được đề xuất vào năm 2024 và kể từ đó đã trở thành một trong những phương pháp được tham khảo trong ngành. Trong các mô hình khuếch tán video thông thường, bối cảnh tham chiếu của các khung hình trong quá khứ tăng tuyến tính khi độ dài tăng, khiến dễ hết bộ nhớ và giảm chất lượng hình ảnh theo thời gian (trôi), nhưng FramePack giảm bớt vấn đề này bằng thiết kế thay đổi tốc độ nén tùy thuộc vào tầm quan trọng của khung hình. Trong hoạt động thực tế kể từ năm 2026, người ta đã có thể tạo video dài bằng GPU sử dụng tại nhà, nhưng thời gian càng dài thì khả năng mất tính nhất quán của chuyển động càng cao và người ta cho rằng sự kết hợp giữa chỉnh sửa cắt và tái tạo một phần sau khi tạo được sử dụng rộng rãi trong lĩnh vực này. Về chi phí, khi vận hành GPU đám mây theo giờ, giá thị trường rất khác nhau tùy thuộc vào kiểu máy và độ phân giải, do đó, những người trong lĩnh vực này nên xác định sự cân bằng giữa chất lượng và chi phí bằng cách thực hiện các thử nghiệm quy mô nhỏ trước khi đưa vào sản xuất.