Imbutus

Новости

04 Aug 2026, 15:00

MiniMaxDirector: таймлайн для H3

Я написал ноду для ComfyUI под MiniMax H3 и выложил её в открытый доступ: MiniMaxDirector. Вместо того чтобы запихивать целый фильм в одно поле промпта, вы раскладываете его по таймлайну — что происходит в кадре, как движется камера, что слышно — а нода собирает из этого тот самый структурированный промпт, который читает H3.

Что это даёт:

  • Три дорожки. Кадры, камера и звук, у каждого сегмента свой текст и свой отрезок.
  • Моменты склеек считаются сами, и модель получает точное время начала каждого кадра.
  • Только допустимые длительности. Клип подгоняется под длину, которую H3 принимает, — генерация не сорвётся из-за арифметики.
  • Прикрепите файл к сегменту, и он автоматически станет пронумерованным референсом в промпте: ничего не нужно вписывать руками.

На вашей GPU это уже установлено. Запустите бандл MiniMax H3 и откройте Docs → Media → MiniMax H3 → воркфлоу MiniMaxDirector; граф готов к запуску, ставить ничего не нужно.

На своей машине — нода лежит в реестре ComfyUI под именем minimax-director: ищется в ComfyUI Manager либо ставится командой comfy node install minimax-director. Исходники и баг-трекер: github.com/imbutus/ComfyUI-MiniMaxDirector. Лицензия MIT.

03 Aug 2026, 18:00

Разбор MiniMax H3

Для бандла MiniMax H3 на странице Docs появился разбор — на английском, русском и китайском, с субтитрами.

Видео проходит первый клип от начала до конца:

  • Где лежат воркфлоу и какой открыть первым.
  • Как писать звук в промпте — что описывать и что модель с этим делает.
  • Допустимые длительности — почему произвольная длина подгоняется и какие числа дают ровные секунды.
  • Как прикреплять референсы, чтобы персонаж не менялся от кадра к кадру.

Смотрите на YouTube или откройте Docs → Media → MiniMax H3.

03 Aug 2026, 15:00

MiniMax H3 доступен

На странице Media появился новый видеобандл: MiniMax H3 — омнимодальная модель, которая генерирует изображение и звук за один проход. Звук не накладывается потом, он рождается в той же генерации, что и видео.

Что стоит знать до первого клипа:

  • Звук — часть модели. Описывайте то, что слышно, так же, как то, что видно, и это будет сгенерировано вместе с кадром. Стерео, без отдельного этапа озвучки.
  • Референсы: изображения, аудио и видео. Прикрепите их и сошлитесь из промпта; модель использует их, чтобы удержать персонажа или общий вид от кадра к кадру.
  • Длительность не произвольная. H3 принимает длины по фиксированной решётке при 24 fps, поэтому воркфлоу подгоняет запрошенное к ближайшему допустимому значению. Ровными секундами получаются 8, 25 и 42.
  • Один промпт — несколько кадров. Модель читает список сцен с моментами склеек, так что одна генерация может содержать несколько кадров, а не один непрерывный дубль.

Откройте Media → Video → MiniMax H3, чтобы запустить.

28 Jul 2026, 11:28

Голосовые бандлы реорганизованы

У четырёх голосовых бандлов теперь по одной понятной задаче, общий набор имён воркфлоу и более быстрый старт.

  • Fish Audio S2 — выбор для дубляжа. Синтез речи и клонирование голоса на 80+ языках, а голос-в-SRT и SRT-в-голос сохраняют исходный тайминг.
  • CosyVoice 3 — выбор для смены голоса. Нативное преобразование сохраняет исходные слова, паузы и подачу и меняет только тембр, без промежуточной транскрипции.
  • Qwen3-TTS — полностью Qwen-бандл. Клонирование голоса по трёхсекундному образцу и дизайн голоса, и это единственный бандл с Qwen3-ASR в качестве второго движка распознавания.
  • WhisperX теперь используется для распознавания везде. На практике он точнее, а отказ от второго движка в остальных трёх бандлах убрал около 3,7 ГБ из каждого пода — голосовые поды готовы быстрее.
  • Два воркфлоу, которых раньше не было. common-align-script-to-srt теперь есть в каждом голосовом бандле: вставьте сценарий с пустой строкой между блоками, и он выровняет их по вашей озвучке в SRT. У CosyVoice 3 появился полноценный cosyvoice3-voice-clone.

Часть имён в папке _examples изменилась — ищите новые: *-tts-clone стал *-voice-clone, *-audio-to-srt стал common-audio-to-srt, а qwen3tts-change-voice стал qwen3tts-redub-voice: он расшифровывает и переозвучивает слова, а не преобразует голос, поэтому для сохранения подачи используйте CosyVoice 3.

На странице Docs теперь перечислены все бандлы с их моделями и все воркфлоу, которые они содержат, — с теми же пояснениями, что вы видите на холсте ComfyUI.

26 Jul 2026, 14:49

Видеоурок по Sulphur-2

Для бандла Sulphur-2 на странице Docs появился полный разбор — чуть меньше восьми минут, на английском, русском и китайском, с субтитрами.

Видео целиком проходит по воркфлоу LTX Director:

  • Изображение → видео — заставить человека на фото произнести нужный вам текст.
  • Изображение + аудио → видео — подать готовую озвучку, сделанную в Fish Audio S2, и человек на картинке произнесёт именно эту запись.
  • Продление клипа — поставить готовое видео в начало или конец таймлайна и дать модели сгенерировать недостающий кусок. Частоту кадров нужно выставить как у исходника, иначе результат поплывёт.
  • fp8 против bf16 — это разные модели, а не пресеты качества. fp8 — сжатая: легче по ресурсам, результат хуже.

Ещё в видео: почему стоит протестировать на коротком отрезке, прежде чем запускать полный рендер, почему разбивка промптов на короткие интервалы даёт более точную генерацию и как неверная длительность заставляет модель галлюцинировать. Сам голос можно заменить потом через CosyVoice3.

Откройте Docs → Media → Video tutorial, чтобы посмотреть.

26 Jul 2026, 08:32

SCAIL-2 готов к работе

SCAIL-2 прошёл полный круг тестирования и вышел из беты. Обе его задачи работают от начала до конца, а метка Beta с карточки бандла убрана.

  • Анимация персонажа — оживите своего персонажа движением из любого ролика. Фон генерируется заново, сцена исходного видео не сохраняется.
  • Замена персонажа — замените одного человека в готовом видео, сохранив исходную сцену, фон и всех остальных.
  • Два персонажа сразу — одно референсное фото с обоими, оживлённое роликом с двумя движущимися людьми.

Каждый воркфлоу теперь открывается пошаговой инструкцией прямо в ComfyUI: какие поля заполнить, как навести трекер на одного человека, если в кадре несколько, что проверить в превью масок до долгого рендера и как выйти за пределы стандартных пяти секунд.

Два момента перед стартом. Результат без звука — SCAIL-2 генерирует только изображение, поэтому звук добавляйте потом в видеоредакторе. И референс должен быть настоящей фотографией: для двух персонажей это один снимок, где они вместе, а не две склеенные картинки.

Видеоурок будет позже.

24 Jul 2026, 06:25

Свой таймаут авто-стопа

GPU останавливается после периода простоя, чтобы вы не платили за машину, о которой забыли. Раньше этот таймаут был одинаковым для всех. Теперь вы задаёте его сами.

  • Настройте таймауты LLM и Media отдельно на странице Settings.
  • Выберите любое значение от 5 минут — или полностью отключите авто-стоп для длительных задач.
  • Для Media активностью считается занятая очередь ComfyUI, поэтому многочасовой рендер удерживает под. Отсчёт начинается только когда очередь пуста.
  • Для LLM отсчёт идёт по вашей сессии, поэтому ваш таймаут никогда не затронет других.

При нулевом балансе GPU останавливается в любом случае, независимо от ваших настроек.

22 Jul 2026, 08:34

Ваше использование и расходы

Теперь вы можете точно видеть, сколько времени GPU вы использовали и сколько это стоило — прямо на странице Monitor.

  • Каждая сессия LLM и медиа (изображения / видео / голос) показана с её длительностью и ценой.
  • Строка итогов показывает ваши расходы за всё время, отдельно по LLM и медиа.

Откройте Monitor в верхнем меню, чтобы в любой момент посмотреть своё использование.

18 Jul 2026, 15:00

Готовые OSINT-сценарии

Теперь можно запускать готовые OSINT-запросы прямо в чате — не нужно помнить, какие инструменты использовать и в каком порядке.

Команды:

  • osint:email <адрес> — проверяет, на каких платформах зарегистрирован email, плюс поиск домена и MX-записей
  • osint:person <имя> — поиск публичных профилей и вероятных имён пользователей на разных платформах
  • osint:company <название> — определяет официальный домен компании по названию, затем анализирует инфраструктуру и организацию
  • osint:domain <домен> — whois, поиск поддоменов, DNS-записи
  • Отправьте просто osint, чтобы снова увидеть полный список

Каждый сценарий использует реальные инструменты (whois, dig, holehe, sherlock, theHarvester, crt.sh) на вашей арендованной машине Kali Linux — арендуйте её в разделе Virtual Machines, если у вас её ещё нет. Если машины нет, модель прямо сообщит об этом, а не будет гадать или что-то выдумывать.

18 Jul 2026, 15:00

Представляем страницу новостей

Эта страница — та самая, которую вы сейчас читаете. Короткие объявления о новых функциях и изменениях на английском, русском и китайском языках.

Всё просто: новые посты появляются здесь по мере публикации, сначала самые свежие.

Page 1