アントグループのAIセーフティラボは、最近、大規模モデル向けの内在的セーフティバリア技術「SingProbe」のオープンソース化を正式に開始しました。この技術は、主流の外部セーフティレビュー方式とは異なり、ベースモデルの推論プロセス中の隠れ状態を再利用することで、0.5%未満の追加計算負荷でトークンレベルでのリアルタイムリスク評価を実現します。同時に意図分類、セーフティ検出、幻覚識別などのタスクを実行できます。医療など高リスクなシナリオにおいて大きな優位性を持ち、コンテンツ出力前にミリ秒レベルでブロックが可能です。
現在、SingProbeは29の主要な大規模モデルと互換性があります。これは主要なテクノロジー企業によってオープンソース化された最初の完全な内在的セーフティ技術ソリューションです。そのオープンソースコードおよび事前学習済みモデルも同時に公開されています。
VIP会員