SenseNova U1.5-Lite-Preview: SenseTime открыла мультимодальный ИИ с нативной генерацией изображений
SenseTime открыла исходный код SenseNova U1.5-Lite-Preview — лёгкой предварительной версии мультимодальной модели на архитектуре NEO-Unify. В отличие от пайплайнов из отдельных нейросетей, одна модель нативно работает с текстом, визуальным пониманием и генерацией пикселей. Релиз продолжает апрельский запуск SenseNova U1 с улучшенными возможностями редактирования изображений.
AI-обработка оригинала Jiqizhixin (机器之心); редакция Hamidun News
SenseTime (商汤科技) 3 августа 2026 года открыла исходный код SenseNova U1.5-Lite-Preview — предварительной версии облегчённой нативно-унифицированной мультимодальной модели на архитектуре NEO-Unify. Это продолжение апрельского релиза SenseNova U1 с усиленными возможностями генерации и редактирования изображений.
Что такое SenseNova U1 и архитектура NEO-Unify
В апреле 2026 года SenseTime впервые полностью раскрыла нативно-унифицированный мультимодальный подход на базе архитектуры NEO-Unify. Ключевая идея: вместо цепочки специализированных моделей — одна нейросеть совместно обучается на трёх типах данных одновременно.
- Апрель 2026 года — релиз SenseNova U1 с первой полной реализацией NEO-Unify
- Единая нейросеть объединяет языковую семантику, визуальную семантику и пиксельную генерацию
- Модель нативно выполняет визуальное понимание, рассуждение и генерацию изображений
- 3 августа 2026 года — открытый исходный код для лёгкой версии U1.5-Lite-Preview
Совместное обучение трёх модальностей позволяет модели хранить единое представление о контексте. По замыслу разработчиков, это даёт преимущество при сложных задачах, где понимание изображения напрямую влияет на качество генерации.
Что изменилось в U1.5 по сравнению с оригиналом
SenseNova U1.5-Lite-Preview развивает апрельский U1 по двум ключевым направлениям. По данным SenseTime, за несколько месяцев после запуска команда сосредоточилась именно на улучшении генерации и редактирования изображений — эти компоненты претерпели наибольшие изменения.
«За прошедшие месяцы мы последовательно усиливали возможности модели
по генерации и редактированию изображений и теперь открываем предварительную версию лёгкой модели для сообщества», — говорится в официальном релизе SenseTime на платформе Jiqizhixin.
Суффикс «Lite» указывает на облегчённый вариант архитектуры, рассчитанный на более широкую аудиторию исследователей и разработчиков, не располагающих мощной инфраструктурой для флагманских моделей. Статус «Preview» означает, что это предварительный релиз — финальная версия ещё впереди.
Зачем нативная унификация лучше пайплайна
Большинство мультимодальных систем по-прежнему работают как конвейер: блок понимания изображения преобразует картинку в текст, языковая модель его обрабатывает, генеративный блок рисует результат. На каждом стыке теряется контекст и накапливаются ошибки.
Нативно-унифицированная архитектура NEO-Unify устраняет эти стыки: модель видит задачу целиком — текст, визуальный контекст и пиксельный результат — и обрабатывает их совместно. Это позволяет редактировать изображение с учётом тонкого визуального контекста, который при пайплайнном подходе терялся бы при преобразовании в текст.
Что это значит
Открытый исходный код SenseNova U1.5-Lite-Preview делает нативно-унифицированные мультимодальные модели доступными для прямого исследования. Разработчики могут изучить архитектурное решение SenseTime, дообучить модель на своих данных или использовать её как базу для экспериментов. Для SenseTime это способ получить обратную связь сообщества до финального коммерческого релиза.
Частые вопросы
Что такое нативно-унифицированная мультимодальность?
Это подход, при котором одна нейросеть обучается одновременно работать с текстом, визуальными данными и пиксельной генерацией без промежуточных конвейеров. SenseTime реализовала этот принцип в архитектуре NEO-Unify, начиная с апреля 2026 года в модели SenseNova U1.
Чем U1.5-Lite-Preview отличается от SenseNova U1?
U1.5-Lite-Preview — облегчённая версия с улучшенными возможностями генерации и редактирования изображений, разработанными за несколько месяцев после апрельского запуска. «Lite» означает уменьшенный размер модели для более широкой аудитории, «Preview» — что это открытый предварительный релиз для исследовательского сообщества, а не финальный коммерческий продукт.
Хотите не читать про ИИ, а внедрить его?
«AI News» — это полезные новости из мира ИИ. Системно научиться работать с нейросетями и применять их в работе — в Hamidun Academy.
Главное из мира ИИ — раз в неделю
7 ключевых событий недели, отобранных вручную. Без шума, репостов и пресс-релизов.
Готово! Проверьте почту — мы отправили подтверждение.