医療分野における人工知能の応用が、再び大きな飛躍を遂げました!ハーバード大学、スタンフォード大学など、多くのトップ機関が共同で行った研究によると、OpenAIのo1-previewモデルは、複数の医学的推論タスクで驚くべき能力を示し、人間の医師を凌駕する結果となりました。この研究では、医学的多肢選択式試験におけるモデルの性能を評価しただけでなく、実際の臨床現場を模倣した診断と治療管理能力にも重点を置き、注目すべき結果が得られました。




医療分野における人工知能の応用が、再び大きな飛躍を遂げました!ハーバード大学、スタンフォード大学など、多くのトップ機関が共同で行った研究によると、OpenAIのo1-previewモデルは、複数の医学的推論タスクで驚くべき能力を示し、人間の医師を凌駕する結果となりました。この研究では、医学的多肢選択式試験におけるモデルの性能を評価しただけでなく、実際の臨床現場を模倣した診断と治療管理能力にも重点を置き、注目すべき結果が得られました。



OpenAIは、AI投資のリターン測定では、従来の採用率ではなく、モデルが実際にこなした作業量こそが真の指標だと提唱。7月17日の記事で、企業は「AI投資から得られる価値」を問うべきだとし、ユーザー数よりアウトプット効率を重視すべきと強調した。....
文遠知行は2026世界AI会議で、大規模モデルWIITを発表。「最小物理事実単位」の概念に基づき、連続環境を基礎事実に分解し、事実抽出・推論・検証モジュールを備えた現実世界理解フレームワークを構築。AIをデータ理解から実世界の認識へと導く。....
OpenAIは、GPT-5.6駆動のCodexが「完全アクセスモード」でサンドボックス保護なしの場合、$HOME環境変数の上書きによりホームディレクトリファイルを誤削除する可能性を確認。Tibo Sottiaux氏は少数の報告があり、特定条件下でのみ発生と説明。....
雲知声はU2ベースをアップグレードし、業界初のU2-Med三医大モデルをリリースしました。このモデルは医療、医保、薬品分野に特化しており、医保・商業保険の協業などのコア業務に深く埋め込まれる予定です。これにより、三医のデジタル化レベルを向上させることを目的とし、スマート医療への配置がさらに深まっていることを示しています。
OpenAIのGPT-5.6複数バージョンが、Tracking AIの最新オフラインIQテストで136点を獲得。大規模言語モデルとして初めて天才の閾値130を超え、人類の99%を凌駕した。非公開の不正防止問題で達成し、他を圧倒。公開Mensa Norway形式テストでは既に140点超えを記録。....