SenseTime выпустила SenseNova U1.5 — нативную мультимодальную модель на 8 млрд параметров
SenseTime представила SenseNova U1.5 — модель Mixture-of-Transformers на 8 млрд параметров, объединяющую понимание, рассуждение и генерацию изображений в единой архитектуре без внешних энкодеров и VAE. Поддерживается нативная генерация до 4K, открыт код обучения (SFT, RL и дистилляция).
- 8 млрд параметров, архитектура Mixture-of-Transformers
- Нативная генерация изображений до 4K без внешних модулей
- Открыты код обучения и веса в OpenSenseNova и Hugging Face
- Лучше U1 в генерации и редактировании изображений
Читать дальше
ИИ