Что вышло
Китайская модель генерации изображений SenseNova U1 уже мелькала в новостях, но свежая версия V3 добавила пару любопытных моментов. Главное — это открытая модель, оформленная очень аккуратно: есть репозиторий, веса и рабочее демо.
Что умеет
- Нативное разрешение вывода до 8K — без апскейла поверх.
- Сверхширокие (ultra-wide) и сверхвысокие (ultra-tall) кадры — удобно для баннеров, обложек и нестандартных форматов.
- Модель редактирующая: правит уже существующее изображение, а не только генерирует с нуля.
- Отдельная версия заточена под тексты и инфографику — тот случай, когда генератору нужно аккуратно ставить надписи и схемы.
Правда, примеры инфографики заметно «желтят» по цвету — характерный отпечаток, по которому такие картинки легко опознать. И сами разработчики честно предупреждают, что над анатомией ещё предстоит поработать.
Для тех, кто гоняет локально
Модель открытая и хорошо упакована: есть GGUF-сборки под 10-12 ГБ VRAM, то есть запустить её реально на домашней видеокарте. Веса лежат на HuggingFace и ModelScope, есть онлайн-демо, все подробности — в репозитории OpenSenseNova/SenseNova-U1. В довесок команда выложила SenseNova-Vision — набор для detection/OCR/GUI, карт глубины и нормалей, сегментации и multi-view.
Что это значит для TTV
Открытые модели картинок с высоким нативным разрешением — хорошая опора для видео-пайплайна: чистый ключевой кадр или референс потом проще оживить. Собрать из статичной картинки готовый ролик можно в генераторе TTV.
