过去 12 小时 AI 圈精选:月之暗面发布 2.8T 参数开源 MoE 模型 Kimi K3,原生视觉理解 + 1M 上下文窗口,并同步开源 AgentENV 智能体环境与视觉感知基准 PerceptionBench,SGLang、Modal 等提供发布当日支持;Google AI Overviews 搜索出现率一年内从 15% 升至 43%;Anthropic 澄清从未主张禁止开源权重模型;GitHub Copilot 推出”Harness”工作流整合开发全流程。

模型发布/更新

Kimi K3 开源:2.8T MoE 模型与技术报告
来源:X(@Kimi_Moonshot),昨晚 23:14 | 原文链接

Kimi 发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升。除模型权重外,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体运行环境基础设施。

Kimi K3 上线 Modal,支持无损加速推理
来源:X(@Kimi_Moonshot),昨晚 23:44 | 原文链接

Modal 成为 Kimi K3 的 Day 0 发布合作伙伴,为 K3 的架构训练了自定义 DFlash 投机器,实现更快推理且无质量损失。


产品发布/更新

Kimi K3 开源分布式智能体环境 AgentENV
来源:X(@Kimi_Moonshot),昨晚 23:25 | 原文链接

Kimi 与 kvcache-ai 合作开源 AgentENV,一个用于大规模运行智能体环境的分布式系统。其组件为 Kimi K3 的智能体强化学习训练提供支持,具备快速快照、恢复和分支功能,适用于大规模并行智能体工作流。

SGLang 和 Miles 为 Kimi K3 提供发布当日支持
来源:LMSYS Blog,今天凌晨 01:50 | 原文链接

SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。

Kimi 发布视觉感知基准 PerceptionBench
来源:X(@Kimi_Moonshot),今天凌晨 02:45 | 原文链接

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。


行业动态

Google AI Overviews 搜索结果出现率升至 43%
来源:TechCrunch,昨晚 23:57 | 原文链接

Google AI Overviews 在搜索结果中的出现率一年内从 15% 升至 43%,AI Mode 月访问量从 1.26 亿增至 2.79 亿。用户搜索长度增加,正从短关键词转向更长的自然对话式查询。


技巧与观点

GitHub Copilot app 入门指南:多 Agent 会话工作区与 Canvas 预览
来源:GitHub Blog,今天凌晨 00:00 | 原文链接

GitHub Copilot app 将 AI 编码工具升级为多 Agent 会话工作区,支持同时管理多个任务线程而不丢失进度。用户可为每个会话绑定项目上下文,通过 /create-canvas 命令在浏览器 Canvas 中预览 UI 并直接点选修改,还能启用 Agent Merge 自动处理 PR 审查反馈和合并冲突。

GitHub Copilot 发布”Harness”工作流:用单一工具完成原型、规划、实现与代码审查
来源:GitHub Blog,今天凌晨 02:00 | 原文链接

GitHub Copilot 推出”Harness”工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码审查的完整软件开发流程,无需追逐多种新 AI 工具。该工作流强调实用性与集成性,旨在减少工具切换带来的效率损耗。

用 Claude 和 Python 构建技能驱动的金融分析智能体
来源:MarkTechPost,今天凌晨 02:08 | 原文链接

本教程基于 Anthropic 的 financial-services 仓库,用纯 Python 复现其技能驱动架构。通过解析 SKILL.md 文件构建可搜索技能注册表,并创建可复用 SkillAgent,将金融分析剧本注入 Anthropic Messages API,支持迭代工具调用循环。

OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作
来源:The Decoder,今天凌晨 03:08 | 原文链接

OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析、网站故障排查等原由专家负责的工作。OpenAI 认为这是岗位职责正在变化的早期信号,该趋势在缺乏专业团队的小公司尤为明显。

Anthropic 澄清立场:从未主张全面禁止开源权重模型,支持芯片出口管制与安全测试
来源:Anthropic Newsroom,今天上午 06:26 | 原文链接

Anthropic CEO Dario Amodei 明确表示公司从未主张禁止开源权重模型,并认为不具备危险能力的开源权重模型是公共产品。他提出三项实际措施:对华芯片出口管制、打击工业级知识蒸馏、对所有足够强大的模型进行强制性安全测试。Amodei 指出,保护主义禁令无法解决其最担忧的国家安全威胁,包括威权政府利用更强大 AI 实现军事优势或深度监控。


今日关键词:Kimi K3 开源 · 2.8T MoE · 1M 上下文 · AgentENV · PerceptionBench · Google AI Overviews 43% · Anthropic 开源立场 · GitHub Copilot Harness