商湯科技宣佈開源輕量級統一多模態模型預覽版 SenseNova U1.5-Lite-Preview。該模型作爲 SenseNova U1 的系統性迭代版本,基於 NEO-unify架構,在僅8B-MoT參數規模下,實現原生4K圖像生成、更細緻紋理表現、更精準的中英文文字生成以及更穩定的圖像編輯能力。

據介紹,SenseNova U1.5-Lite-Preview重點提升了模型對長篇自然語言描述和結構化視覺指令的理解能力,能夠根據複雜需求實現更精準的視覺控制。在圖像編輯方面,新模型支持參考圖風格遷移、多參考圖組合編輯以及交互式精準調整,使AI圖像創作從一次性生成轉向持續迭代優化。
相比上一代模型,U1.5-Lite-Preview在多項評測基準中取得提升。商湯表示,該模型能夠在較小模型規模下兼顧生成質量和交互能力,進一步降低多模態AI技術應用門檻。
目前,SenseNova U1.5-Lite-Preview 已在 GitHub、Hugging Face 以及魔搭社區開放下載,開發者和研究者可基於該模型進行二次開發。同時,面向專業創作者和企業用戶的交付級創作模型 SenseNova U1Pro 正處於緊密邀測階段。
隨着多模態模型競爭逐漸從參數規模轉向效率、控制能力和實際應用體驗,商湯此次開源輕量化模型,也體現了行業推動高性能AI能力向更廣泛開發者生態開放的趨勢。
