IBMの研究によると、GPT-4のような大規模言語モデルは、悪意のあるコードの生成や誤ったセキュリティアドバイスの提供といった行為を、比較的容易に誘導できることが明らかになりました。研究者らは、英語の基本的な知識とモデルのトレーニングデータに関するある程度の理解があれば、AIチャットボットを騙して虚偽の情報を与えさせたり、悪意のあるコードを生成させたりすることが容易であることを発見しました。また、AIモデルによって騙されやすさが異なり、GPT-3.5とGPT-4は比較的騙されやすく、一方、GoogleのBardやHugging Faceのモデルは騙しにくいことも判明しました。この研究は、大規模言語モデルのセキュリティ上の脆弱性を明らかにし、ハッカーがこれらの脆弱性を悪用してユーザーの個人情報を入手したり、危険なセキュリティアドバイスを提供したりする可能性を示唆しています。
関連推奨
Epoch AIが3つのAIテキスト検出エンジンをテスト:人間の文風を模倣した場合、最高で30%近くのコンテンツが見逃される
Epoch AIの研究によると、主流のAIテキスト検出エンジンは通常のAI生成テキストをほぼ完璧に識別できるが、大規模な言語モデルが特定の著者の執筆スタイルを意図的に模倣すると、正確率が明確に低下し、科学的執筆は最も判断が難しい。この実験では、Pangram、GPTZero、Originality.aiの3つのツールをテストした。495編のブログ、小説、科学に関する人間のオリジナルテキスト(すべてChatGPTが登場する前に関作成されたもの)を使用し、スタイルの模倣が検出を効果的に回避できることを発見した。
MiniMaxが新世代の大規模モデルを発売予定 パラメータ数は2.7兆
ミニマックス(MiniMax)が2.7兆パラメータの次世代大規模モデルを近日発表予定。複雑なタスク処理と論理推論の課題解決を狙う。同社の基礎技術への注力と、パラメータ拡張で高度な知能を追求する業界の野心を示す。....
OpenAIの人員変動:元研究者である田永龍が騰訊に就職し、視覚言語モデルの開発に専念
OpenAIの元研究者である田永龍が騰訊の大規模言語モデル部に加わり、視覚言語モデルの開発に注力している。この動きは、騰訊がマルチモーダルな大規模言語モデル戦略を強化するための重要な採用と見られ、先端人材の争奪戦が激しくなっていることを示している。
AIでAIを管理:Redditが自動化システムをアップグレードし、1日2300万件のスパム情報をブロック
Redditはアップグレードされた大規模言語モデルと自動化ツールを組み合わせ、高精度で隠蔽されているAI生成スパムコンテンツ、偽の行動や人為的な宣伝を監視・撲滅し、コミュニティのコンテンツの真実性を守っています。
Anthropicが高性能大規模モデルClaude Sonnet 5を発表:性能はエントリーモデルに匹敵し、価格は大幅に低下
Anthropicが新中級モデルであるClaude Sonnet 5を発表しました。このモデルはコストパフォーマンスに優れており、旗舰モデルのOpusシリーズと非常に近い性能を実現しています。このモデルはこれまでで最も強力な代理機能を持ち、複雑なタスクを自主的に計画し、出力を自己チェックし、ブラウザや端末などの外部ツールを柔軟に呼び出すことができます。推論、プログラミング、知識関連のタスクにおいて優れたパフォーマンスを示します。
