アリババクラウドは、視覚言語モデルQwen-VLをオープンソース化しました。これは、8月に汎用モデルQwen-7Bと対話型モデルQwen-7B-Chatをオープンソース化した後に続く、新たな大規模言語モデルです。Qwen-VLは中国語と英語に対応しており、知識質問応答、画像キャプション生成、画像質問応答など、様々な用途に使用できます。他のモデルと比較して、Qwen-VLは中国語のオープンな領域での位置特定が可能で、画像内の検出領域を正確にマークできます。Qwen-VLはQwen-7Bをベースに開発され、視覚エンコーダーを導入することで画像入力に対応しています。Qwen-VLは、複数の視覚言語タスクにおけるテストで、同等のモデルの中で最高の結果を達成しました。Qwen-VLはModelScopeなどのプラットフォームで既にオープンソース化されています。マルチモーダルは、大規模言語モデル発展の重要な方向性ですが、依然として技術的な課題が残されています。
関連推奨
アリババ新世代の大規模モデルQwen3.8が登場:プレビュー版がアリ云とQoderに先行公開、公式版は近日オープンソース化予定
国内大規模モデルのオープンソース化が加速。アリババが次世代「通義千問3.8」を近日公開、プレビュー版は体験可能。正式版も近くリリース。通義千問のオープンソース展開が加速。....
Jul 20, 2026
198.6k
通義千問がAppleエコシステムに正式に統合され、国内のAppleスマート体験が大きなアップグレードを遂げました
アリババは、自社開発の大規模モデル「通義千問」がAppleのAI機能に統合され、中国国内のiPhone、iPad、Mac、Vision Proなど全デバイスに組み込まれると確認。iOS、iPadOS、macOS、visionOSでシステムレベルから直接呼び出し可能となり、画像とテキストの深い理解や高品質な生成などのスマート操作を実現。アプリ切り替えの煩わしさから解放される。....
Jul 16, 2026
272.5k
アリババが通義千問をApple Intelligenceに統合することを確認、Apple端末の大規模モデルは7月に登録完了
7月15日、アリババの通義千問大規模モデルがAppleのインテリジェンス機能に統合されることが確認された。同モデルは7月8日に登録済みで、百度もAI検索とSiriで協力する。....
Jul 16, 2026
223.0k
ドウバオチエンワンが同日、スマートエージェント機能を停止。国内初のAI人間性のあるインタラクティブサービスに関する新規則が今日から正式に施行
バイトダンスの豆包とアリババの通義千問が本日、エージェント機能を停止。新規作成・呼び出し不可に。停止日は「人工知能擬人化インタラクションサービス管理暫定弁法」の施行日と重なる。同弁法は5部門が共同公布した中国初の専門立法で、全面的規制ではなく、バーチャルパートナーなどの擬人化対応を重点的に監視する。....
Jul 15, 2026
231.4k
通義千問の大幅アップグレード:リアルタイム音声認識モデル「Fun-ASR-Realtime」が正式リリース
通義千問はリアルタイム音声認識モデル「Fun-ASR-Realtime」をリリースし、最初の文字の遅延を100ミリ秒未満にまで短縮し、「即座にフィードバックする」というスムーズなインタラクションを実現しました。このモデルの認識精度はオフラインモデルに近づき、高精度を維持しつつリアルタイム性のボトルネックを突破し、音声インタラクション体験の新たな段階へと進みました。
Jul 6, 2026
243.5k
