Как «чинить» Nano Banana после неудачной правки
Известная проблема Nano Banana: генерирует она отлично, а вот редактирует — не очень. После первой перегенерации теряются свет и цвет, после третьей картинка превращается в мыло с плывущими текстурами. Рабочий способ восстановления — не просить модель «просто повысить качество» напрямую, а перегенерировать кадр через собственный набросок (скетч), особенно если сохранились исходные вложения, с которыми кадр генерировался до правок. На простых кадрах способ срабатывает за пару попыток, на сложных — дольше, но результат ощутимо стабильнее прямой перегенерации.
Krea 2: редактирование через LoRA-костыль
Krea 2 по умолчанию не умеет работать с текстовыми инструкциями по редактированию изображений — просто дать референсную картинку не получится. Разработчик Ostris сделал ComfyUI-ноды для редактирования и добавил в AI-Toolkit возможность тренировать собственные «edit LoRA» в обход этого ограничения. Уже появились практические примеры: LoRA для повышения детализации изображения и тренированная всего за 1750 шагов LoRA для стилизации под циклопов.
INT8-ConvRot: вдвое быстрее без потери качества
В ComfyUI 0.27 завезли поддержку INT8-ConvRot — нового метода квантования весов до 8-битных целых чисел, который делит матрицу на группы вместо вращения целиком, снижая сложность вычислений с квадратичной до линейной. Результат: веса вдвое компактнее, работают быстрее FP16 и не уступают по качеству FP8. Особенно заметен выигрыш на более слабых видеокартах — от RTX 30xx до GTX 10xx, — которым такое квантование приближает возможность генерации современными моделями. На практике: 15-секундное видео в LTXV 2.3 (1920×1088) на RTX 5090 генерировалось 268 секунд базовой моделью против 140 секунд с INT8-ConvRot. Веса уже доступны для Wan 2.2 Animate, Z-Image и SeedVR2.
SeFi-Image: конкурентный результат за 10–20% вычислений
Ещё одна китайская модель для генерации изображений (варианты на 1B/2B/5B параметров) построена на принципе «сначала понять семантику и композицию, потом дорисовать детали и текстуры». По заявлению авторов, SeFi-Image-5B обучили примерно за 10–20% вычислительных ресурсов, потраченных на Z-Image, при сопоставимой или более высокой производительности на части бенчмарков.
Civision: китайский аналог Civitai и Hugging Face в одном месте
Modelscope выкатил Civision — бесплатную (в рамках дневных кредитов) платформу для генерации изображений и видео, а также тренировки LoRA и файнтюнов: неограниченное место для моделей и датасетов, 2000 API-вызовов в день. Интерфейс пока сыроват, но объём возможностей уже заметный.
Что это значит для TTV
Локальная генерация дешевеет и ускоряется, но требует всё того же ручного тюнинга и костылей под конкретные модели. Если нужен предсказуемый результат без возни с квантованием и LoRA, проще идти в готовый облачный сервис — например, «Оживить фото» в TTV.