AI 早报 2026-08-05
过去 12 小时 AI 圈精选:Anthropic 豪掷 100 亿美元签下成立仅数月的云初创 Volta;商汤、蚂蚁百灵、NVIDIA 密集发布开源模型;Cloudflare 一口气推出 Agents 平台等多项 AI 重磅产品;MiniMax-H3 成功移植 Apple Silicon,单颗 AMD MI300X 即可跑 DeepSeek V4 Flash。
模型发布/更新
OpenRouter 上线 FLUX 3 Video 统一多模态模型
X:OpenRouter (@OpenRouter) · 约 1 小时前
FLUX 3 Video 现已向所有人开放,这是一个统一的视频、音频、图像和动作预测多模态模型家族,覆盖从严肃到创意、电影感等多种风格,基于统一架构联合训练。
https://x.com/OpenRouter/status/2084699413898027064
商汤 SenseNova U1 开源:统一推理与图像生成
X:商汤 SenseTime (@SenseTime_AI) · 约 7 小时前
SenseNova U1 可在统一流程中同时进行推理与图像生成,信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。
https://x.com/SenseTime_AI/status/2084667189479837741
蚂蚁百灵发布 Ling-3.0-flash 开源权重
X:蚂蚁百灵 (@AntLingAGI) · 约 8 小时前
官方 BF16 和 FP8 量化版本现已可用,用户可根据硬件、性能要求和部署需求选择最合适的版本。
https://x.com/AntLingAGI/status/2084656533489754475
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶
NVIDIA Blog · 约 8 小时前
基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。
https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available
产品发布/更新
Replit 环境智能:免提示词自动生成设计
X:Replit (@Replit) · 约 1 小时前
环境智能(Ambient Intelligence)在每个画面旁显示建议卡片,每张卡片指向设计的不同方向。点击喜欢的卡片即可生成新画面,再也不用纠结下一步该做什么。
https://x.com/Replit/status/2084761337570144424
Soup v0.72.4:在 4GB 显存笔记本 GPU 上微调 8B 模型
Hacker News · 约 5 小时前
Soup 通过 QLoRA 技术,支持在配备仅 4GB 显存的笔记本 GPU 上微调 8B 参数模型,无需 SSH 或云服务。
https://github.com/MakazhanAlpamys/Soup
SpecForge v0.3.0:统一投机解码栈,新增开源草稿模型
LMSYS Blog · 约 5 小时前
将目标模型推理与草稿模型训练分离,支持 EAGLE3、DFlash、Domino 等多种投机解码算法,统一在线、离线与解耦工作流。
https://www.lmsys.org/blog/2026-08-04-specforge-v0-3
Google Cloud API Gateway 推出统一模型路由功能
Google Developers Blog · 约 6 小时前
开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,网关接受标准 OpenAI 兼容请求,自动转码并动态路由流量,无需硬编码端点或管理代理。
https://developers.googleblog.com/a-unified-api-for-ai-model-routing
Google Cloud 推出 Database Operations Agents,实现自主数据库管理
Google Cloud Blog · 约 7 小时前
Database Onboarding Agent 负责 Day 0 配置与部署,Database Observability Agent 负责 Day 1/2 监控与故障排查,推动数据库管理向全自主化迈进。
https://cloud.google.com/blog/products/databases/deep-dive-on-new-ai-powered-database-agents
NVIDIA 开源 cuFile API,推动 GPU 直连存储
NVIDIA Blog · 约 8 小时前
GPU 可直接读写存储,访问延迟降至微秒级。Vera CPU 在压缩与加密流水线中吞吐量比 x86 最高提升 3.21 倍,联合 40 多家厂商推出 Storage-Next 计划。
https://blogs.nvidia.com/blog/ai-storage-fms
Cloudflare 推出 Agents 平台,率先上线智能体追踪功能
Cloudflare Blog · 约 10 小时前
将部署在平台上的智能体会话统一到一个视图中,支持 OpenTelemetry 兼容的 Think、Flue 和 AI SDK 等框架,可测量每次模型调用、工具执行和 token 消耗。
https://blog.cloudflare.com/agents-on-cloudflare
Cloudflare 让智能体通过本地追踪调试 Workers
Cloudflare Blog · 约 10 小时前
wrangler dev 和 vite dev 自动为本地 Worker 捕获 OpenTelemetry 追踪,智能体可通过 Local Explorer API 查询追踪数据,定位失败操作并修复。
https://blog.cloudflare.com/local-tracing
Cloudflare 推出 CI SDK:在 Cloudflare 上为百万级仓库运行 CI/CD
Cloudflare Blog · 约 10 小时前
基于 Workflows 和 Sandbox SDK,支持构建、lint、类型检查、单元测试、依赖缓存及条件部署,让平台方直接在 Cloudflare 上运行 CI/CD 流水线。
https://blog.cloudflare.com/ci-workflows
Cloudflare 推出 Agent Development Lifecycle(ADLC)
Cloudflare Blog · 约 10 小时前
以 ADLC 取代传统 SDLC,让 AI 智能体从仅生成代码扩展到承担更多开发流程。
https://blog.cloudflare.com/agent-development-lifecycle
行业动态
Anthropic 与 Volta 签署 100 亿美元算力协议
X:Rohan Paul · 约 8 小时前
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议(约每年 17 亿美元)。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。
https://x.com/rohanpaul_ai/status/2084655258102546579
论文研究
本时段暂无精选论文,敬请关注后续更新。
技巧与观点
MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行
Simon Willison 博客 · 约 4 小时前
MiniMax-H3 是一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。在 M5 Max MacBook Pro 上实测,下载约 115GB 模型文件,视频生成耗时不到 45 分钟。
https://simonwillison.net/2026/Aug/4/minimax-h3-mlx
GitHub 如何用堆叠式 PR 拆解 AI 生成的巨型代码
GitHub Blog · 约 6 小时前
AI 编码智能体常常生成 1000+ 行的大 diff,难以审查。GitHub 介绍用堆叠式 PR 将代码按数据、API、接线、UI 拆成 L1-L4 独立分层,每层可分配不同审查者。
https://github.blog/engineering/turn-one-giant-ai-generated-pull-request-to-a-reviewable-stack
Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零
Cloudflare Blog · 约 10 小时前
通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200+ 降至约 30 个,预计下月归零。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。
https://blog.cloudflare.com/astro-issue-triage
在单颗 AMD MI300X 上运行 DeepSeek V4 Flash
Hacker News · 约 10 小时前
开源仓库提供在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁。304B 参数模型在 192GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。
https://github.com/ryanzhou/deepseek-v4-flash-mi300x
今日关键词:Anthropic 百亿算力 · 开源模型密集发布 · Cloudflare AI 全家桶 · GPU 直连存储 · MiniMax-H3 · DeepSeek V4 Flash · 商汤 SenseNova U1