← Все статьи
Гайды

Инструменты контроля AI-видео: от глубины до автопайплайнов на MCP

14 июля 2026 4 мин чтения
✍️

Framethrower: карта глубины бесплатно

Framethrower превращает любое видео — реальное или сгенерированное — в карту глубины, которую затем можно использовать как управляющий референс для собственной генерации. Инструмент неожиданно доступен бесплатно; в том же классе стоит смотреть на LingBot-Depth 2.0 и DepthAnything.

tldraw как замена 3D-превизу

Если скармливать Seedance карты глубины или 3D-превиз из Blender кажется избыточно сложным, можно обойтись обычным скетчем в tldraw — простом вебовском редакторе рисования. При должной сноровке такой скетч работает как управляющий референс не хуже полноценного превиза, а порог входа заметно ниже.

Автопайплайн на MCP: от идеи до готового сравнения без единой ноды

Показательный пример того, куда движется автоматизация: связка Claude с MCP-коннектором к ComfyUI сама нашла в интернете нужный фрагмент видео, определила смены сцен и обрезала клип, запустила воркфлоу с Depth Anything V3 и OpenPose для референсного видео с движением, просмотрела кадры и заменила персонажа через генерацию изображений точно по текстовому описанию, написала промпты для Seedance 2.0 и запустила генерацию, а на выходе сама собрала итоговое сравнение из трёх панелей. Обычно именно препроцессинг и подбор промптов съедают большую часть времени работы над таким роликом — здесь это сделал агент, и ни одну ноду не пришлось открывать руками.

Pallaidium: опенсорсный 2D-в-3D пайплайн для Blender

Ещё один опенсорсный маршрут — вместо прямой карты глубины конвертировать изображение в 3D через связку из нескольких инструментов: превращение 2D в 3D, автоматическая настройка света через HDRI-купол, а затем генерация видео в LTX с озвучкой через Chatterbox. Пайплайн замороченный, зато захватывает освещение сцены и даёт более устойчивый управляющий контроль — вся сборка целиком опенсорсная, включая монтаж на базе Blender.

Stem Studio: разобрать звук с площадки на дорожки

Отдельный инструмент для постпродакшена — Stem Studio разделяет аудио (в том числе звук, вынутый из видео) на диалоги, музыку и шумовые эффекты, каждую дорожку отдельным WAV-файлом. Полезно, когда в руки попадает запись со всем звуком, смешанным в одну дорожку, а для монтажа AI-ролика нужны отдельные компоненты.

Что это значит для TTV

Общий тренд — управлять генерацией видео становится проще и дешевле: не обязательно строить полный 3D-пайплайн, скетча или карты глубины часто достаточно. Проверить готовый результат без сборки собственного пайплайна можно в генераторе TTV.

Попробуйте сами
Runway, Veo, Kling и Seedance — видео из текста или фото за 60 секунд.
✦ Начать
Ещё из блога
Индустрия
Netflix: генеративный ИИ уже в ~300 тайтлах и меняет экономику продакшена
На отчётном звонке за Q2 2026 Netflix заявил, что AI-воркфлоу использовались примерно в 300 тайтлах. Пример — 17 минут AI-кадров в сериале за половину стоимости и вдвое быстрее.
21 июля 2026 5 мин
Новости
SenseNova U1: открытая модель картинок с нативным 8K и версией под инфографику
Китайская open-source модель генерации изображений SenseNova U1 вышла в версии V3: нативное разрешение до 8K, сверхширокие и сверхвысокие кадры, редактирование и отдельная версия под тексты и инфографику. Есть GGUF под 10-12 ГБ VRAM.
21 июля 2026 4 мин
🚀 Новости
Lucy 2.5: реалтайм-композ и редактирование видео прямо в потоке
Decart обновил Lucy до версии 2.5 — редактирование видео в реальном времени: замена персонажей и фона, VFX и виртуальная примерка прямо на вебке или в трансляции с почти нулевой задержкой.
21 июля 2026 4 мин