2024年8月3日,中國人民大學與百川智能共同成立了"大模型聯合實驗室",旨在推動大模型技術的創新和發展。

聯合實驗室的成立標誌着雙方將在大模型預訓練、對齊、檢索增強、智能體、多模態等前沿技術領域展開深入合作。中國人民大學將利用其在大模型研究上的人才和技術優勢,與百川智能在工程和產品研發方面的力量相結合,共同推進相關技術的研究和應用。
未來,雙方期望通過多層次、多領域和多形式的合作,在科學研究、成果轉化、人才培養等方面取得突破,爲中國大模型技術的發展做出貢獻。
針對持續數月的上市猜測,OpenAI首席執行官奧爾特曼在開發者大會後迴應稱,只有能就模型安全作出更完善承諾,公司纔會正式考慮上市,目前無確定時間節點。他強調,大模型能力跨越式發展下,系統越強,企業越須給出站得住腳的安全聲明;他也坦言,若上市等待過久,會帶來影響。
谷歌在印度啓動早期測試,允許部分用戶通過Gemini及AI模式直接購買沃爾瑪旗下Flipkart商品,覆蓋智能手機、電子產品及配件等。此舉標誌其AI服務從信息檢索與推薦正式延伸至商業交易閉環,加速大模型在電商環節落地。
騰訊混元新研究聚焦在線大模型強化學習的批大小設置:當模型自生成訓練數據、rollout生成與訓練縮放節奏不一致時,經典臨界批大小理論需在新場景重推。研究覆蓋GRPO與PPO等主流算法並給出務實結論,爲大規模GPU集羣下提升訓練效率提供參考。
阿里雲無影團隊正研發AI設備QwenBook,定位原生智能體電腦,形態接近“千問平板”,尚處早期試水,主打辦公場景,接入Qwen3.8-Max和Flash模型。產品定義與硬件自研,融合無影雲電腦系統及端雲能力,團隊約150人。
上海AI實驗室與上海交大LUMIA Lab提出新預訓練任務“下一個概念預測”(NCP),推出全球首個8.9B離散隱空間基座模型NCP-ArchPreview。該模型僅用51.3%的Token預算,就在5.73T語料上追平OLMo-3-7B最終預訓練Loss,顯著提升訓練效率。