🤖 AI HOT 日报 · 2026-08-25
2026-08-25
GPT-5.6 登陆软件开发智能体 Kiro,任务成本降低约 82%;NVIDIA Vera Rubin NVL72 在智能体负载下每瓦特工作量提升至 30 倍;Meta 开源面向 AI 规模以太网的 RDMA 协议 MetaRoCE;NVLink Fusion 让定制 XPU 以 3 倍低延迟接入 AI 工厂;MTIA 300 成为 Meta 首款内置 NIC 的训练芯片;Mistral 与 HUMAIN 达成数亿欧元合作推进沙特主权 AI;丰田北美用 Deep Agents 和 LangSmith 把交付周期从 6 个月缩至 4 天;苹果提出 Internalized Visual Thinking 实现零额外成本的主动视频推理。
1. GPT-5.6 登陆 Kiro,任务成本降低约 82%
Sol、Terra、Luna 三款模型进入开发智能体 Kiro,Terminal-Bench 2.1 测试中 GPT-5.6 Terra 完成任务成本降低约 82%,由 OpenAI 与 AWS 合作优化。
2. Vera Rubin NVL72:每瓦特工作量提升至 30 倍
NVIDIA 实测显示其在智能体工作负载下每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降低至 35 倍。
3. MetaRoCE:为 AI 规模以太网打造的 RDMA 协议开源
专为通用以太网上的 AI 负载设计,经 OCP 发布规范与合规测试套件,原生支持乱序交付、多路径与双向拥塞控制,无需 PFC 即可扩展至百万卡规模。
4. NVLink Fusion 让定制 XPU 融入 AI 工厂
将定制 XPU 接入 NVLink 扩展域,端到端延迟比现成以太网方案低 3 倍、数据包速率高 10 倍。
