中国大模型在国际顶尖竞技场上再次刷新了纪录。3月20日,
凭借这一强势表现,

作为由国际开源研究机构 LMSYS 组织的第三方评测平台,
数学能力: 排名全球第五,展现了极强的逻辑推理底蕴。
综合性能: 在无风格控制的绝对胜率比拼中位列全球第六。
专家级处理: 在复杂文本处理能力方面同样跻身全球前十。

据
目前,该模型已作为预览版开放,

中国大模型在国际顶尖竞技场上再次刷新了纪录。3月20日,
凭借这一强势表现,

作为由国际开源研究机构 LMSYS 组织的第三方评测平台,
数学能力: 排名全球第五,展现了极强的逻辑推理底蕴。
综合性能: 在无风格控制的绝对胜率比拼中位列全球第六。
专家级处理: 在复杂文本处理能力方面同样跻身全球前十。

据
目前,该模型已作为预览版开放,
9月10日,月之暗面启动“Kimi企业合作伙伴计划”,推动大模型进入企业核心业务场景。该计划通过生态合作打通AI落地“最后一公里”,并培养前线部署工程师(FDE),解决模型能力与业务深度融合难题。
普林斯顿大学教授王梦迪在外滩大会指出,大模型虽掌握大量人类知识,但距自主科学发现仍有明显局限:更擅长给出“最可能”答案,而真正新发现往往藏在概率分布长尾中。她正与谢宇教授合作,探索AI迈向新科学发现的路径。
近日,Anthropic发布Fable 5.1,因价格贵、限制多遭客户冷遇;OpenAI的GPT-6 Astra则持续刷屏,虽编码略逊,但综合性能强、Token效率高、成本更低,应用广泛。梁文锋表示不搞视频与世界模型,专注LLM主线。
近日,Anthropic发布Fable5.1,OpenAI推出Astra,全球大模型军备竞赛再升级。Astra虽性能和性价比引发热议,但背后资金与硬件消耗巨大,凸显中美算力基础设施差距。报道称,OpenAI未公开具体参数,但依托StarGate计划,训练动用超10万张NVIDIA显卡。
9月3日美东时间上午9点23分左右,ChatGPT、Claude、Grok、谷歌Gemini、微软Copilot等海外主流AI服务集体宕机,持续约3小时40分钟,给海外用户办公与技术调用造成困扰。与海外集体掉线形成鲜明对比,国内AI大模型同一时间未出现类似故障。