OmniWeaving
в каталоге с 2026Революция в генерации видео: нейросеть научилась понимать логику и создавать сложные сцены по свободному описанию

OmniWeaving

Оцените первым
Бизнес-модель
Бесплатно

OmniWeaving - это open-source модель для генерации видео, которая умеет работать одновременно с текстом, изображениями и видео в любых комбинациях. Разработана командой Tencent Hunyuan на базе HunyuanVideo-1.5 и выделяется тем, что не просто создаёт ролики по промпту, а понимает сложные композиции и способна рассуждать о намерениях пользователя перед генерацией.

Архитектура построена на связке MLLM (мультимодальная языковая модель) + MMDiT (диффузионный трансформер) + VAE. MLLM разбирает входные данные - текст, картинки, видео - и преобразует их в семантическое пространство. VAE сжимает визуальную информацию в латентные представления, а MMDiT на основе этих данных генерирует финальное видео. Фишка в том, что MLLM здесь не просто кодировщик признаков, а активный «мыслитель»: модель сначала формулирует промежуточные рассуждения, уточняет намерение пользователя, а затем передаёт улучшенный промпт в генератор. Это помогает избежать семантической путаницы и создавать более точные результаты.

OmniWeaving поддерживает восемь задач: text-to-video, first-frame-to-video (анимация статичного изображения), key-frames-to-video (генерация между начальным и конечным кадрами), video-to-video editing (редактирование по инструкциям), reference-to-video (создание видео с одним референсным объектом), compositional multi-image-to-video (композиция из нескольких объектов), text-image-video-to-video (генерация на основе всех трёх типов входных данных) и reasoning-augmented generation (генерация с предварительным рассуждением о намерениях пользователя).

Код и веса модели выложены на GitHub, доступна инструкция по установке зависимостей, запуску инференса и обучению. В комплекте идёт IntelligentVBench - первый бенчмарк для оценки интеллектуальной унифицированной генерации видео, который позволяет проверить, насколько хорошо модель справляется с композицией и рассуждениями. Проект поддерживает Flash Attention, Flex-Block-Attention и SageAttention для ускорения работы и снижения потребления видеопамяти.

Похожие нейросети

Все нейросети →
Freemium

IngestAI

Загружаете корпоративные данные - получаете ИИ-помощника, который знает ваш бизнес и отвечает на вопросы сотрудников и клиентов. Никакой долгой настройки.

Обн. 23.05.2026
Freemium

Intangible

Сервис превращает текст в готовые 3D-сцены за пару секунд. Описываешь локацию словами - получаешь трёхмерную модель без навыков моделирования.

Обн. 06.06.2026
Бесплатно

Whisper

Нейросеть для распознавания речи с поддержкой 99 языков, которая одинаково точно работает с любыми акцентами и качеством аудио.

Обн. 17.05.2026
Freemium

Miro AI

Miro AI - это инструмент искусственного интеллекта, который повышает креативность, сотрудничество и разработку продукта с помощью генерации визуальных слов и изображений, кластеризации липких заметок, обратной связи и обучения на основе сообщества Miro.

Обн. 25.05.2026

Нейросеть OmniWeaving была впервые опубликована 15-04-2026 17:39:04 и вручную отредактирована 04-05-2026 17:21:51.

Каталог приложений Telegram Mini Apps

340+ проверенных мини-приложений: нейросети, утилиты, игры. Открываются прямо в мессенджере — без установки.

Открыть →

Поддержите Ailibri

Если наш каталог оказался полезным, вы можете оставить небольшой донат. Это поможет нам развивать проект.

♥ Поддержать

Будьте в курсе новых нейросетей — подпишитесь на наш Telegram-канал

Ежедневные обзоры свежих AI-инструментов, лайфхаки и инструкции прямо в вашем мессенджере.

Подписаться
Бесплатно · Нейросеть

Генерация изображений прямо в Telegram

3 бесплатные генерации в день через нейросеть nano banana — просто подпишись на канал @n_seti

Быстро Точно Качественно
Попробовать @gen_neurosila_bot

Нейросети и ИИ-инструменты

Все теги →
github241 text-to-text146 text-to-image117 tool50 image-to-image34 api33 каталог33 desktop-приложение22 языковая модель21 удалить фон20 python19 браузер19 курсы19 text-to-sound18 text-to-video16 создание чат-ботов16 voice-to-text16 замена лица15 генератор голоса14 анимация13
AILibri – главная страница
Ctrl / ⌘+K