AI 日报

AI 日报 2026年8月5日

  • Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议

    Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。

    来源:X:Rohan Paul (@rohanpaul_ai)
  • 工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施

    工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721—2024升级而来,为自动驾驶产品明确了统一的安全准入基线。

    来源:IT之家(RSS)
  • GPT-5.6 Luna降价80%永久生效

    有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。

    来源:X:Tibo (@thsottiaux)
  • Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事务官

    Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责全球政策、国际战略参与及政府关系事务。Cuéllar 曾任卡内基国际和平基金会主席、加州最高法院法官,并自 2026 年 1 月起担任 Anthropic 长期利益信托受托人,现已卸任该职务加入公司。

    来源:Anthropic:Newsroom(网页)
  • OpenAI 说明第三方网络安全评估事件并公布新保障措施

    OpenAI 就近期第三方网络安全评估事件作出说明,并公布新的保障措施以强化 AI 模型测试与评估流程。相关措施旨在提升模型评估的安全性与可靠性,确保第三方测试在受控环境下进行。

    来源:OpenAI:官网动态(RSS · 排除企业/客户案例)
  • AI 领袖提出 SAFE 指南,强化智能体网络安全透明度

    Linux 基金会发布共享 AI 事件交换(SAFE)指南征求意见稿,旨在将智能体网络安全事件转化为全生态共享防护。

    来源:NVIDIA Blog(RSS)
  • Google 发布 Gemini 3.6 Flash 等三款新模型及 Gemini Robotics ER 2

    Google 在 7 月推出三款新 Gemini 模型——Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,面向生产级 AI 智能体,主打更高 token 效率、更低延迟和更可靠性能。

    来源:Google Blog:AI(RSS)
  • 在单颗 AMD MI300X 上运行 DeepSeek V4 Flash

    一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。

    来源:Hacker News 热门(buzzing.cc 中文翻译)
  • MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行

    MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。

    来源:Simon Willison 博客
  • 用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线

    本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。

    来源:MarkTechPost(RSS)
  • Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零

    Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200 多个降至约 30 个,预计下月归零。该流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。

    来源:Cloudflare Blog
  • GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码

    GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。

    来源:GitHub Blog
  • 如何用 LangSmith 评估语音智能体

    LangChain 官方博客介绍如何用 LangSmith 评估语音智能体,覆盖执行、结果与来电者体验三个层面。评估手段包括 LangSmith traces、代码评估器、LLM judges 和人工审查,帮助开发者系统化验证语音智能体的实际表现。

    来源:LangChain:Blog(RSS)
  • 从零开始,教你用Codex搓出属于你自己的第一个硬件

    作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用Agent调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘(13个机械按键,售价230美元)等案例,强调“干中学”的AI开发方式。

    来源:公众号:数字生命卡兹克
  • 杰文斯悖论还能持续吗:AI 定价分层如何支撑算力需求增长

    科技巨头高管普遍表示算力供应仍无法满足需求,但 AI 定价却在上涨:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,较 Opus 5 翻倍;OpenAI 则在 Fable 5 发布五天后将 GPT-5.6 Luna 价格下调 80%。

    来源:Tomer Tunguz 博客(VC 分析)