人工智能在醫療領域的應用再次迎來重大突破!一項由哈佛大學、斯坦福大學等多所頂尖機構聯合開展的研究顯示,OpenAI 的 o1-preview 模型在多項醫學推理任務中表現出驚人的能力,甚至超越了人類醫生。這項研究不僅評估了該模型在醫學多項選擇題基準測試中的表現,更着重考察了其在模擬真實臨牀場景下的診斷和管理能力,結果令人矚目。




人工智能在醫療領域的應用再次迎來重大突破!一項由哈佛大學、斯坦福大學等多所頂尖機構聯合開展的研究顯示,OpenAI 的 o1-preview 模型在多項醫學推理任務中表現出驚人的能力,甚至超越了人類醫生。這項研究不僅評估了該模型在醫學多項選擇題基準測試中的表現,更着重考察了其在模擬真實臨牀場景下的診斷和管理能力,結果令人矚目。



OpenAI提出,衡量AI投資回報,不能再沿用軟件行業舊尺子——採用率。真正的刻度是模型實際完成的工作量。其7月17日長文直指企業核心經濟問題:從AI投入中究竟換回多少價值,強調以產出效能而非用戶數來評估。
文遠知行在2026世界人工智能大會發布WIIT大模型,提出“最小物理事實單元”理念,將連續環境拆解爲基礎事實,構建物理世界AI理解框架,包含事實提取、推理、驗證等模塊,推動AI從數據理解邁向真實世界認知。
OpenAI確認,由GPT-5.6驅動的Codex在開啓“完全訪問模式”且未啓用沙箱保護時,可能因覆蓋$HOME環境變量誤刪用戶主目錄文件。負責人Tibo Sottiaux稱已收到少量報告,問題僅在特定條件下觸發。
雲知聲基於U2基座升級推出行業首個“U2-Med三醫大模型”,專注醫療、醫保、醫藥領域。該模型用於深度融入醫保商保協作等核心業務,旨在提升三醫數字化水平,標誌其智慧醫療佈局進一步深化。
OpenAI GPT-5.6多版本在Tracking AI最新離線IQ測試中齊獲136分,首次將大語言模型智商推過130分天才門檻,超越99%人類。該成績是在不公開的防作弊題庫上取得,甩開所有對手;而公開Mensa Norway風格測試中,模型此前已超140分。