商湯科技は、軽量な統合マルチモーダルモデルのプレビュー版SenseNova U1.5-Lite-Previewをオープンソース化しました。このモデルは、SenseNova U1の体系的なアップデートバージョンで、NEO-unifyアーキテクチャに基づき、8B-MoTのパラメータ規模において、ネイティブな4K画像生成、より詳細なテクスチャ表現、より正確な中英文のテキスト生成およびより安定した画像編集機能を実現しています。

QQ20260803-173044.jpg

紹介によると、SenseNova U1.5-Lite-Previewは、長文の自然言語記述や構造化された視覚的指示の理解能力を重点的に向上させ、複雑な要件に対応してより正確なビジュアルコントロールを実現できます。画像編集に関しては、参照画像のスタイル移行、複数の参照画像の組み合わせ編集、インタラクティブな正確な調整がサポートされており、AI画像制作が一回限りの生成から継続的な最適化へと進化しています。

前世代モデルと比較して、U1.5-Lite-Previewは複数の評価基準において性能向上を達成しました。商湯は、このモデルが小さなモデル規模でも生成品質と相互作用能力を両立できることを示し、マルチモーダルAI技術の応用の障壁をさらに低くしていると述べています。

現在、SenseNova U1.5-Lite-PreviewはGitHub、Hugging Faceおよび魔搭コミュニティで無料ダウンロード可能です。開発者や研究者はこのモデルをもとに二次開発を行うことができます。また、プロのクリエイターおよび企業ユーザー向けの本格的な創作モデルSenseNova U1Proは、今まさに厳選な招待制のテスト段階にあります。

マルチモーダルモデルの競争が、パラメータの規模から効率性、制御能力、実際のアプリケーション体験へと移行する中、商湯が軽量モデルをオープンソース化したことは、業界が高性能AI能力をより広範な開発者エコシステムへ開放する傾向を示しています。