🤖 AI HOT 日报 · 2026-08-25
GPT-5.6 登陆软件开发智能体 Kiro,任务成本降低约 82%;NVIDIA Vera Rubin NVL72 在智能体负载下每瓦特工作量提升至 30 倍;Meta 开源面向 AI 规模以太网的 RDMA 协议 MetaRoCE;NVLink Fusion 让定制 XPU 以 3 倍低延迟接入 AI 工厂;MTIA 300 成为 Meta 首款内置 NIC 的训练芯片;Mistral 与 HUMAIN 达成数亿欧元合作推进沙特主权 AI;丰田北美用 Deep Agents 和 LangSmith 把交付周期从 6 个月缩至 4 天;苹果提出 Internalized Visual Thinking 实现零额外成本的主动视频推理。
1. GPT-5.6 登陆 Kiro,任务成本降低约 82%
Sol、Terra、Luna 三款模型进入开发智能体 Kiro,Terminal-Bench 2.1 测试中 GPT-5.6 Terra 完成任务成本降低约 82%,由 OpenAI 与 AWS 合作优化。
2. Vera Rubin NVL72:每瓦特工作量提升至 30 倍
NVIDIA 实测显示其在智能体工作负载下每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降低至 35 倍。
3. MetaRoCE:为 AI 规模以太网打造的 RDMA 协议开源
专为通用以太网上的 AI 负载设计,经 OCP 发布规范与合规测试套件,原生支持乱序交付、多路径与双向拥塞控制,无需 PFC 即可扩展至百万卡规模。
4. NVLink Fusion 让定制 XPU 融入 AI 工厂
将定制 XPU 接入 NVLink 扩展域,端到端延迟比现成以太网方案低 3 倍、数据包速率高 10 倍。
5. MTIA 300:Meta 首款内置 NIC 的训练芯片
封装内集成 12 个 800 Gbps RDMA NIC,提供 1.2 TB/s 总 I/O 带宽,通过 16 个消息引擎卸载通信,大规模并发时计算吞吐损耗低于 0.5%。
6. Mistral 与 HUMAIN 合作推进沙特主权 AI
数亿欧元合作覆盖基础设施、模型开发与方案部署,初期聚焦网络安全与语音,并计划开发阿拉伯语表现出众的前沿模型。
7. 丰田北美:Deep Agents 让交付周期从 6 个月到 4 天
借助 Deep Agents 和 LangSmith 运行 50 多个生产环境智能体,并通过 LangSmith 追踪 AI 投资 ROI,支撑企业级规模化落地。
8. Internalized Visual Thinking:主动视频推理零开销
苹果提出 IVT 后训练框架,在训练阶段内化视觉思考,推理时直接进行文本预测,无需生成中间推理图像即可实现主动视频推理。
9. OpenAI 正为一切构建 AI 智能体
ChatGPT Work 将 Codex 改造为面向非工程师的智能体产品,最低每月 20 美元;内部 98% 员工使用 Codex,但组织订阅者仅 17%、个人不足 1%。
10. ADK 如何评估实时语音智能体
Google 为 ADK 带来原生实时评估能力,可用模拟用户音频驱动实时语音智能体并对回复打分,与文本智能体共用同一评估循环。
11. Databricks 支持从本地 IDE 运行调试工作负载
弥合本地开发环境与云端平台差距,开发者无需切换上下文即可完成编码、测试和部署,直接运行、调试和扩展工作负载。
12. 你的 alt 文本能通过检查不代表合格
WebAIM Million 报告显示 16.2% 的图片缺 alt 文本、10.8% 模糊或重复;GitHub 为 Accessibility Scanner 构建插件,用五条确定性规则加视觉模型审查。
来源与核验
这是一条旧版简报,原始来源链接未保留。涉及安全、金融、政策或突发事件的信息,请在采取行动前通过权威原始来源再次核验。