9月1日、科大訊飛の完全子会社であるシーモンスターは、星火X2.5-4Bと星火X2.5-1.7Bという2つのエッジ側汎用大規模モデルを正式にリリースし、オープンソース化しました。この2つの製品は、エッジ側モデルの中でも最初に最大100万トークンのコンテキストをネイティブにサポートするモデルであり、モデルの重み、コードリポジトリ、およびデプロイドキュメントがすべて公開されています。
100万トークンのコンテキストで、小モデルも「本を全部読める」
この2つのモデルは混合アテンションアーキテクチャを使用しており、エージェント、コード、数学、命令の遵守などの主要な能力を中心に最適化されており、実際のテストでは業界内の同サイズの一流オープンソースモデルを上回っています。
コンテキスト能力において、星火X2.5-4Bと1.7Bは長文文書や技術資料などの状況をカバーする数千億トークンレベルの高品質なデータでトレーニングされており、ネイティブに100万トークンのコンテキストウィンドウをサポートしています。これにより、より大きな規模の情報を一度に受け取り、理解することが可能です。

例えば製品のアフターサービスのケースを考えると:ユーザーは完了したアフターサービスマニュアルを星火X2.5-4Bにインポートできます。モデルは異なるシナリオにおけるアフターサービスルールを整理し、対応する章をマークします。たとえば、「購入から10日後に機器が故障し、サードパーティの消耗品を使用した場合、交換の条件に該当するか」という質問には、返品交換、故障処理、例外条件などの複数の章の規定を関連付けて総合的な判断を行います。その後、遠隔地域や機器内に家庭地図があるなどの新しい条件が追加されても、モデルは以前の文脈を保持し、物流、データ削除、費用負担などのルールを組み合わせて継続的にアドバイスを提供できます。
長文コンテキストは「情報がすべて見えるか」を解決し、エージェントとツールの呼び出し能力は「見て終わりではなく、実際に動けるか」を解決します。星火X2.5エッジモデルは、個人事務、コード開発、スマート家電、ロボットなど様々なシナリオに対してローカライズされた知能機能を提供します。コード開発のシナリオでは、星火X2.5-4Bはアルゴリズムの実装、コード補完および生成などのタスクにおいて、パラメータ数が2〜3倍大きいクラウドモデルと同等の性能を示します。Domuxスマートホームテストセットにおいて、星火X2.5-1.7Bのコントロールコマンドのエンドツーエンド実行正確率は90.3%で、平均応答時間はわずか0.85秒です。ロボットのシナリオでは、この2つのモデルはロボット本体またはエッジデバイスにデプロイでき、操作制御、ターゲットトラッキング、ナビゲーション意思決定などのタスクをサポートし、クラウド接続や固定された事前設定プログラムへの依存を減らします。
全中国産の計算力で訓練し、すぐにダウンロードして体験可能
星火X2.5-4Bと1.7Bは、全国の中国産の計算力プラットフォーム上で全体的なトレーニングが行われており、約20兆トークンの多様なデータで予トレーニングが行われ、高品質な監督微調整と強化学習を通じてパフォーマンスが継続的に向上しています。
デプロイ面では、これらのモデルはNVIDIA、Huawei、Haiguang、Houmoなどのハードウェアプラットフォームをサポートしており、vLLM、SGLang、llama.cppなどの主流の推論フレームワークと互換性があります。OllamaやLM Studioなどのツールで簡単にデプロイでき、LLaMA-Factoryを使って増分学習も可能です。今すぐ、モデルの重みはHugging FaceやGitHubなどのプラットフォームで公開されており、対応するモデルAPIは科大訊飛の星辰MaaSプラットフォームで公開され、期間限定で無料です。9月7日には、科大訊飛は新世代のエッジ側モデルである星火X2.5を正式にリリースし、コードやエージェントなどの主要な機能をさらにアップグレードする予定です。
VIP会員