テキスト大規模モデル分野で継続的な取り組みを進めた後、人工知能企業のMiniMaxはこのほど、新たなマルチモーダル生成モデル
マルチモーダルなコンテキスト入力をサポートする生成モデルとして、

技術的なアーキテクチャにおいて、
価格とエコシステムの面では、

テキスト大規模モデル分野で継続的な取り組みを進めた後、人工知能企業のMiniMaxはこのほど、新たなマルチモーダル生成モデル
マルチモーダルなコンテキスト入力をサポートする生成モデルとして、

技術的なアーキテクチャにおいて、
価格とエコシステムの面では、
最近、字節系の企業生産性製品が頻繁にアップデートされている:ボルケーノエンジンは豆包大モデルDoubao-Seed-2.1-proを0915バージョンにアップグレードし、APIがボルケーノアーケードに完全リリースされ、同時に豆包ワークでも利用可能となった。また、飛書は8.0をリリースし、チームスマートエージェント「豆包ワークパートナー」を導入し、AIを個人アシスタントからグループチャット、文書、ミーティングおよびビジネスプロセスに拡張した。新しいモデルは実運用での配信を重視し、エージェントタスクの証拠追跡などの能力を強化している。
元TikTok幹部のMelody Chu氏とJing Liu氏がAI撮影アプリ「Superpose」を開発。「撮影指導ツール」として約2カ月で2.2万DL超。AIが4種のポーズを提案し、姿勢・角度・構図を改善。着想はChu氏の夫の撮影技術への不満からで、コンピュータビジョンと生成AIを日常撮影に活用している。....
OpenAIが内部で長期運用する「リリー計画」では、審査員がChatGPTユーザーの実際のチャット履歴を人手で確認・採点していたことが判明。大規模モデルの進化はアルゴリズム更新と自動学習データだけという見方を覆し、人手審査がモデル訓練で依然重要であることを示す。....
SalesforceはDreamforceカンファレンスで初の推論大規模モデルであるKoaを発表しました。これはNVIDIAのオープンソースのNemotronをベースにし、両社が共同で微調整を行ったものです。このモデルは販売、マーケティング、カスタマーサービスなどの企業の核となるシナリオに焦点を当てています。この取り組みは、企業のスマート化への移行コストを低下させることを目的としており、閉鎖型AIが内部ファイル、コード、プロンプト、ユーザーのフィードバックなどをアップロードすることを要求することによって生じるデータリスクを回避します。
グーグルが新世代リアルタイム音声モデル「Gemini 3.8 Live」と拡張思考版を発表。ネイティブなエンドツーエンド音声対話で遅延を低減し自然さを向上。低遅延音声ストリームで初の深層マルチステップ推論に対応し、複雑な専門領域の音声AI応用を刷新。....