HiDream запустила видеогенератор O1-Video-1.0 с омнимодальным входом
HiDream выпустила видеомодель HiDream-O1-Video-1.0, которая принимает одновременно текст, изображения и видео и генерирует ролики 1080p длительностью 5–20 секунд. Главный акцент разработчиков — на сохранении временной и физической консистентности: объекты, персонажи и геометрия сцены остаются стабильными на протяжении видео. Модель продолжает архитектурную линию HiDream-O1 и использует Pixel-level Unified Transformer без отдельного VAE.
Веса и код пока недоступны, но предыдущая версия O1-Image была опенсорсена с поддержкой ComfyUI и Diffusers. API уже работает на hiharness.ai с поддержкой редактирования видео и использования reference-видео для извлечения признаков.
Источник: Метаверсище и ИИще
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.