Модель MiniMax H3: видео со звуком за одну генерацию, все ссылки и честные требования

Открытая видеомодель MiniMax H3 делает видео сразу со звуком, речью и попаданием в губы за одну генерацию. Внутри все ссылки: онлайн-версия без установки, официальный репозиторий, путь для запуска у себя и честный разбор того, какое железо для этого нужно на самом деле.

Читается за 8 минут. Первое видео получишь минут за десять, если пойдёшь онлайн-путём. Все ссылки проверила вручную 27 августа 2026 года, характеристики взяты из официальной карточки модели.

Если просто хочешь попробовать сегодня, открывай второй раздел, там онлайн-версия и ничего ставить не надо. Если хочешь у себя на компьютере, читай четвёртый и пятый разделы подряд: сначала честные требования к железу, потом порядок установки. Раздел про лицензию прочитай до того, как начнёшь снимать на этом коммерческие ролики.

Что это за модель и что она реально умеет

Факты ниже взяты из официальной карточки модели. Обзоры я тут не пересказываю.

  • Делает видео из текста, из картинки, из другого видео и по набору образцов.
  • Звук генерируется вместе с видео за один проход: стерео 32 кГц, речь с попаданием в губы, музыка и шумы сцены.
  • Длина ролика до 15 секунд, разрешение до 2K через отдельный режим перегенерации, по умолчанию короткая сторона 768 пикселей.
  • В режиме образцов принимает до 9 картинок, до 3 видеоклипов и до 3 звуковых дорожек, всего до 12 файлов.
  • Веса выложены открыто, скачать может любой.

Главное отличие от привычных видеогенераторов именно в звуке. Обычно видео и озвучку собирают в два шага и потом сводят, здесь речь рождается вместе с картинкой и поэтому губы попадают в слова сами.

Официальная страница моделиРепозиторий проекта

Попробовать сегодня, ничего не устанавливая

Самый короткий путь: та же модель работает в браузере.

  1. Открой веб-версию по ссылке ниже и войди.
  2. Возьми режим текст в видео и опиши сцену одним абзацем: место, кто в кадре, что делает, какой звук.
  3. Реплику пиши прямо в запросе и коротко, до одного предложения. Длинная реплика в пятнадцать секунд не помещается.
  4. Дождись результата и посмотри со звуком, весь смысл модели в нём.
Веб-версияДесктоп-версияДоступ по API для разработчика

Готовый запрос под первый ролик

Скопируй и подставь своё. Порядок частей тут важен: сцена, камера, герой, реплика, звук.

Промпт
Вертикальное видео, 9:16. Сцена: [где происходит, время суток, свет]. В кадре: [кто, во что одет, что делает]. Камера: [статичная / медленный наезд / проход сбоку], высота на уровне глаз. Герой говорит одну фразу по-русски: «[короткая фраза, до 12 слов]». Речь спокойная, губы попадают в слова. Звук сцены: [что слышно на фоне]. Музыка: [настроение или без музыки]. Без текста на экране, без логотипов, без субтитров.
Русская реплика получается заметно чище, когда в запросе она стоит отдельной строкой и одна. Две реплики подряд модель обычно смазывает.

Сколько железа нужно на самом деле

Здесь чаще всего и происходит разочарование, поэтому цифры честные.

В официальной инструкции запуск описан на четырёх видеокартах сразу. Это серверный сценарий, и на домашнем компьютере он не воспроизводится.

Обычные компьютеры вытягивают модель за счёт сжатых сборок, которые сделало сообщество. Сжатие уменьшает вес модели в несколько раз, поэтому она помещается в память бытовой видеокарты. Платой идёт скорость и часть качества.

  • 8 гигабайт видеопамяти: запускается на самых сжатых сборках, короткие ролики, ждать долго.
  • 12 или 16 гигабайт: рабочий вариант для домашних экспериментов.
  • 24 гигабайта и выше: близко к тому, что показывают в обзорах.
  • Мало видеопамяти и много обычной: часть модели выгружается в оперативную, скорость падает сильно, но результат получить можно.
Прежде чем скачивать десятки гигабайт, посмотри на своей карте объём видеопамяти. Если её 6 гигабайт или меньше, разумнее остаться на онлайн-версии.

Порядок установки у себя

Самый проходимый путь идёт через ComfyUI: там уже есть готовый шаблон именно под эту модель.

  1. Поставь ComfyUI по инструкции из репозитория.
  2. Открой официальный урок по этой модели, он написан командой ComfyUI и содержит готовые схемы под текст в видео и под образцы.
  3. Скачай сжатую сборку модели. Начни с самой лёгкой, которую тянет твоя карта, и повышай качество только после первого удачного ролика.
  4. Загрузи готовую схему из урока, подставь свой запрос и запусти.
  5. Первый прогон делай коротким. Так ты за несколько минут поймёшь, тянет машина или нет.
Официальный урок ComfyUI по этой моделиComfyUI, установкаСборки для ComfyUIСжатые сборки сообществаУскоренная сборка

Лицензия и ограничения: читать до того, как снимать на продажу

Открытые веса и полная свобода это разные вещи, и по этой модели разница существенная.

  • Модель выложена под собственной лицензией разработчика. Свободной лицензии тут нет. Ограничения по использованию в ней прописаны, и коммерческую работу стоит сверить с текстом.
  • В онлайн-версии работает автоматическая проверка запросов и материалов. Разработчик пишет об этом прямо в карточке модели: часть запросов блокируется, ошибки в обе стороны возможны.
  • Обещания полной свободы от фильтров, которые встречаются в обзорах, к официальному сервису отношения не имеют.
Текст лицензииОфициальные подсказки по написанию запросов

Куда это ставить в работе

Модель со звуком закрывает три задачи, на которые обычно уходит день.

  1. Короткая сцена-иллюстрация в ролик: пятнадцать секунд с готовым звуком вставляются в монтаж без озвучки отдельно.
  2. Говорящий кадр без съёмки, когда нужна одна фраза и не нужно твоё лицо.
  3. Массовая проверка идей: пять вариантов одной сцены за вечер, дальше снимаешь по-настоящему только то, что сработало.

Держи в голове границу: пятнадцать секунд это вставка. Ролик целиком из таких кусков собирается, и склейки в нём видно.

Короткая карта: какую модель брать под задачу

Второй частый вопрос под роликами про модели. Держу карту простой, по назначению.

  • Видео со звуком за одну генерацию: MiniMax H3, разбор выше. Открытая, можно поставить у себя.
  • Длинная работа с текстом, разбор документов, код: линейка Claude 5. Opus для тяжёлых задач, Sonnet для повседневных, Fable когда нужен объём и скорость.
  • Быстрые массовые мелочи, где важна цена: Haiku 4.5.
  • Открытая текстовая модель, которую можно держать у себя: линейка MiniMax M3, лежит там же на Hugging Face.

Правило выбора одно. Сначала берёшь самую сильную модель и получаешь рабочий результат, и только потом спускаешься вниз по цене, проверяя, где качество ещё держится. В обратную сторону это не работает: со слабой модели ты решишь, что задача нерешаемая.

Держать модель у себя имеет смысл в двух случаях: данные нельзя отдавать наружу, либо объём такой, что подписка выходит дороже железа. В остальных случаях облако дешевле и быстрее.

Чек-лист

Пройди по порядку, он экономит вечер.

  1. Первый ролик сделан в браузере, чтобы понять, нужна ли тебе установка вообще.
  2. Объём видеопамяти на своей карте посмотрен до скачивания.
  3. Запрос собран по шаблону из третьего раздела, реплика одна и короткая.
  4. Готовый ролик просмотрен со звуком. Без звука проверка бессмысленна.
  5. Текст лицензии открыт, если планируешь коммерческое использование.

Отдельно: Claude Fable 5, всё для старта в одном месте

Второй материал под этим же словом. Fable 5 это модель Anthropic из пятого семейства Claude, и ниже собрано ровно то, что нужно человеку в первый день: где она живёт, как её выбрать и на чём она сильна.

  • Семейство Claude 5 состоит из трёх моделей: Opus 5 самая тяжёлая, Sonnet 5 рабочая лошадка на каждый день, Fable 5 отдельная модель того же поколения.
  • Идентификатор для API и для настроек редактора: claude-fable-5.
  • Доступ идёт тремя дорогами: веб-версия Claude, интерфейс разработчика через API и Claude Code прямо в терминале.
  • В Claude Code модель переключается командой выбора модели, отдельная подписка под неё не нужна.

Первый день: три шага

  1. Зайди в свой аккаунт Claude и убедись, что модель видна в списке выбора. Её нет в списке, значит она пока не открыта твоему тарифу, это решается на стороне тарифа.
  2. Прогони на ней одну свою обычную задачу, ту, которую ты уже делал другой моделью. Сравнивать имеет смысл на знакомой работе, там ты сразу видишь разницу.
  3. Запиши разницу в двух словах: где ответ стал точнее и где дороже. Через неделю это единственный честный аргумент, оставаться на ней или нет.
https://docs.claude.com/en/docs/about-claude/models/overviewhttps://claude.ai/
Про историю с закрытием доступа: я разбираю здесь саму модель и работу с ней. Новостную часть держи отдельно, она меняется быстрее, чем любой гайд.

Читать дальше в блоге

Эту тему я разбираю подробно в статье рабочий список нейросетей для контента. Там же лежат остальные разборы про нейросети.

Следующий шаг
Хочешь так же, но под свой блог и продукт?

Я собрал систему, по которой обычный человек запускает блог с нуля и набирает аудиторию без съёмок, монтажа и команды. Внутри разбор, с которого стартовал сам.

Открыть разбор: с чего начать