过去 12 小时,AI 圈的焦点集中在小米 MiMo-V2.6 系列的发布与开源:Pro 模型在多项开放权重评测中冲上前列,同时 Grok 4.7 的智能体编码表现也受到关注。产业侧,AI 智能体的安全边界与代码验证效率继续成为讨论热点。

模型发布/更新

小米 MiMo-V2.6-Pro 登上 Code Arena WebDev 榜前十

来源:X:Arena(@arena)|今天 05:08|原文

小米 MiMo-V2.6-Pro 在 Code Arena 的 WebDev 榜以 1628 分(AutoEval)位列约第 10 名,在开源权重模型中约排名第 3,较 MiMo-V2.5-Pro 提升 153 分。

MiMo-V2.6-Pro 登顶 Artificial Analysis 开放权重模型智能指数

来源:X:Clément Delangue(Hugging Face CEO)|今天 05:03|原文

该模型在 Artificial Analysis Intelligence Index 得分 46,超过前代的 26,成为当前开放权重模型中的最高分。

小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型

来源:X:小米 MiMo(@XiaomiMiMo)|今天 04:51|原文

MiMo-V2.6 Pro 与 Flash 均为原生全模态模型,覆盖编码、computer use、3D 推理和创作等能力。官方称 Pro 在多数 Agent 基准上可与 Claude Opus 5 和 GPT-5.6 Sol 相当。

MiMo-V2.6 系列开源,探索递归自我改进路径

来源:公众号:小米 MiMo|今天 04:18|原文

小米正式开源 MiMo-V2.6 Pro 与 Flash,强调通过扩大强化学习规模,探索 RSI(递归自我改进)路径。

行业动态

不列颠哥伦比亚省起诉 OpenAI,追问高风险活动的转介机制

来源:X:Rohan Paul(@rohanpaul_ai)|今天 04:11|原文

不列颠哥伦比亚省在加州起诉 OpenAI,指称被标记的 ChatGPT 活动本应在 2026 年 2 月枪击案前通报警方,案件进一步引发对平台安全响应机制的讨论。

亚马逊封禁 Meta Muse 智能体代用户购物

来源:IT之家|今天 03:52|原文

亚马逊阻断 Meta 个人 AI 智能体 Muse 的购物访问,称其未获授权、没有表明身份,并可能采集和保存用户账号凭证,AI 代理的身份与权限边界再成焦点。

技巧与观点

Artificial Analysis:Grok 4.7 的智能体知识工作能力跻身前沿

来源:Artificial Analysis|今天 03:41|原文

评测显示,Grok 4.7 的 Intelligence Index 得分为 46,AA-Briefcase 得分 1657 Elo,较上一代提升 111 分,仅次于部分领先模型。

马斯克称 Grok 4.7 让 xAI 的智能体编码排名第三

来源:X:Elon Musk(@elonmusk,xAI)|今天 01:06|原文

马斯克援引 Artificial Analysis 的评测称,Grok 4.7 使 xAI 在智能体编码领域排名第三,仅次于 Anthropic 和 OpenAI。

Linear 重构 CI 流程,应对 AI 编码带来的验证瓶颈

来源:Linear Now|昨天 20:26|原文

随着 AI Agent 加速代码产出,Linear 重新设计 CI 流程,将 PR 等待时间从 6 分钟以上降到 5 分钟出头,并将单测 runner 时间缩短约一半。

开源模型的中美实力格局持续变化

来源:Nathan Lambert:Interconnects|昨天 19:56|原文

分析指出,中国开源权重模型已在下载量、基准成绩和学术采用上领先;自 2025 年 7 月起,中国模型在 Hugging Face 的下载量约领先 16 亿次。


今日关键词: MiMo-V2.6、开放权重模型、全模态、Grok 4.7、智能体编码、AI 安全、CI 验证