← Все статьи
Гайды

Техники и инструменты для AI-изображений: чиним Nano Banana, ускоряем генерацию и экономим на вычислениях

14 июля 2026 4 мин чтения
✍️

Как «чинить» Nano Banana после неудачной правки

Известная проблема Nano Banana: генерирует она отлично, а вот редактирует — не очень. После первой перегенерации теряются свет и цвет, после третьей картинка превращается в мыло с плывущими текстурами. Рабочий способ восстановления — не просить модель «просто повысить качество» напрямую, а перегенерировать кадр через собственный набросок (скетч), особенно если сохранились исходные вложения, с которыми кадр генерировался до правок. На простых кадрах способ срабатывает за пару попыток, на сложных — дольше, но результат ощутимо стабильнее прямой перегенерации.

Krea 2: редактирование через LoRA-костыль

Krea 2 по умолчанию не умеет работать с текстовыми инструкциями по редактированию изображений — просто дать референсную картинку не получится. Разработчик Ostris сделал ComfyUI-ноды для редактирования и добавил в AI-Toolkit возможность тренировать собственные «edit LoRA» в обход этого ограничения. Уже появились практические примеры: LoRA для повышения детализации изображения и тренированная всего за 1750 шагов LoRA для стилизации под циклопов.

INT8-ConvRot: вдвое быстрее без потери качества

В ComfyUI 0.27 завезли поддержку INT8-ConvRot — нового метода квантования весов до 8-битных целых чисел, который делит матрицу на группы вместо вращения целиком, снижая сложность вычислений с квадратичной до линейной. Результат: веса вдвое компактнее, работают быстрее FP16 и не уступают по качеству FP8. Особенно заметен выигрыш на более слабых видеокартах — от RTX 30xx до GTX 10xx, — которым такое квантование приближает возможность генерации современными моделями. На практике: 15-секундное видео в LTXV 2.3 (1920×1088) на RTX 5090 генерировалось 268 секунд базовой моделью против 140 секунд с INT8-ConvRot. Веса уже доступны для Wan 2.2 Animate, Z-Image и SeedVR2.

SeFi-Image: конкурентный результат за 10–20% вычислений

Ещё одна китайская модель для генерации изображений (варианты на 1B/2B/5B параметров) построена на принципе «сначала понять семантику и композицию, потом дорисовать детали и текстуры». По заявлению авторов, SeFi-Image-5B обучили примерно за 10–20% вычислительных ресурсов, потраченных на Z-Image, при сопоставимой или более высокой производительности на части бенчмарков.

Civision: китайский аналог Civitai и Hugging Face в одном месте

Modelscope выкатил Civision — бесплатную (в рамках дневных кредитов) платформу для генерации изображений и видео, а также тренировки LoRA и файнтюнов: неограниченное место для моделей и датасетов, 2000 API-вызовов в день. Интерфейс пока сыроват, но объём возможностей уже заметный.

Что это значит для TTV

Локальная генерация дешевеет и ускоряется, но требует всё того же ручного тюнинга и костылей под конкретные модели. Если нужен предсказуемый результат без возни с квантованием и LoRA, проще идти в готовый облачный сервис — например, «Оживить фото» в TTV.

Попробуйте сами
Runway, Veo, Kling и Seedance — видео из текста или фото за 60 секунд.
✦ Начать
Ещё из блога
Индустрия
Netflix: генеративный ИИ уже в ~300 тайтлах и меняет экономику продакшена
На отчётном звонке за Q2 2026 Netflix заявил, что AI-воркфлоу использовались примерно в 300 тайтлах. Пример — 17 минут AI-кадров в сериале за половину стоимости и вдвое быстрее.
21 июля 2026 5 мин
Новости
SenseNova U1: открытая модель картинок с нативным 8K и версией под инфографику
Китайская open-source модель генерации изображений SenseNova U1 вышла в версии V3: нативное разрешение до 8K, сверхширокие и сверхвысокие кадры, редактирование и отдельная версия под тексты и инфографику. Есть GGUF под 10-12 ГБ VRAM.
21 июля 2026 4 мин
🚀 Новости
Lucy 2.5: реалтайм-композ и редактирование видео прямо в потоке
Decart обновил Lucy до версии 2.5 — редактирование видео в реальном времени: замена персонажей и фона, VFX и виртуальная примерка прямо на вебке или в трансляции с почти нулевой задержкой.
21 июля 2026 4 мин