Репост из: Нейронавт | Нейросети в творчестве
FSVideo: Fast Speed Video Diffusion Model in a Highly-Compressed Latent Space
Быстрый видеогенератор без кода от ByteDance на базе Wan2.1-14B-I2V
Прикрутили видеоавтоэнкодер, который сильно сжимает данные (соотношение даунсэмплинга 64 × 64 × 4), но при этом сохраняет качество реконструкции
Генерирует видео в несколько шагов с повышением разрешения, что делает их более чёткими и реалистичными.
Спасибо @m_franz
#image2video
Быстрый видеогенератор без кода от ByteDance на базе Wan2.1-14B-I2V
Прикрутили видеоавтоэнкодер, который сильно сжимает данные (соотношение даунсэмплинга 64 × 64 × 4), но при этом сохраняет качество реконструкции
Генерирует видео в несколько шагов с повышением разрешения, что делает их более чёткими и реалистичными.
Спасибо @m_franz
#image2video