在

在技術和產品佈局上,谷歌近期相繼發佈了
業內預計 Gemini4將於今年11月至12月期間正式亮相。面對日益激烈的 AI 競賽,谷歌通過傾斜核心算力與提速迭代週期,展現出守住前沿技術陣地的決心,這也預示着行業大模型研發正加速邁入以高頻更新和高效能協同爲特徵的新階段。

在

在技術和產品佈局上,谷歌近期相繼發佈了
業內預計 Gemini4將於今年11月至12月期間正式亮相。面對日益激烈的 AI 競賽,谷歌通過傾斜核心算力與提速迭代週期,展現出守住前沿技術陣地的決心,這也預示着行業大模型研發正加速邁入以高頻更新和高效能協同爲特徵的新階段。
9月11日外灘大會上,具身智能業界與投資人圍繞行業泡沫等話題討論。嘉賓認爲“泡沫感”源於產業階段、估值與商業價值錯配,行業仍處“黎明前期”;關鍵能力初現,但距規模化生產力仍有距離,需突破系統工程、算力和數據等瓶頸。
小米開源工業級目標說話人語音識別大模型CocktailASR-1,瞄準多人同時講話的“雞尾酒會難題”。該模型改變傳統ASR任務輸入方式,可在嘈雜環境中精準鎖定並識別目標說話人語音,提升複雜場景下的識別能力,爲行業提供新的解決方案。
支付寶“碰一下”發佈面向品牌商的無界經營智能體“圖圖”,依託百萬級商家設備網絡,連接4億消費者與百萬門店,助力品牌線下增長。繼線下觸點AI升級及門店智能體“曉雨”後,支付寶再次以AI重構線下經營,實現全球首個大規模線下人、貨、場AI全面升級。
《金融時報》報道,Anthropic稱今年已阻止多起科學家利用其AI開展可能助研生物武器的研究,列舉五起案例,涉事者繞過管控、混淆目的以規避安全防護。事件凸顯AI對公共安全的潛在威脅。
OpenAI推出全雙工語音模型GPT-Live-1,採用單一模型架構取代傳統“語音轉文字—推理—文字轉語音”級聯流程,顯著降低延遲,實現類人流暢交互。該模型已上線API,面向開發者,能更穩健應對停頓、打斷和話題轉換等複雜對話場景。