🤖 AI HOT 日报 · 2026-08-05
NVIDIA 开放商用 Alpamayo 2 Super 面向 Robotaxi 与自动驾驶;商汤开源 SenseNova U1 统一推理与图像生成;OpenRouter 上线 FLUX 3 Video 统一多模态模型;蚂蚁百灵发布 Ling-3.0-flash 开源权重;腾讯混元发布 Hy ASR 3.0 语音识别;Swiftlet 在 Mac 上运行 80B 版 Qwen;Anthropic 与初创云公司 Volta 签署 100 亿美元算力协议;工信部发布首部 L3/L4 自动驾驶强制性国标 2027 年 7 月实施;GPT-5.6 Luna 降价 80% 永久生效;MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行。
1. NVIDIA Alpamayo 2 Super 开放商用
基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,面向 Robotaxi 与自动驾驶,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。
2. 商汤 SenseNova U1 开源:统一推理与图像生成
在统一流程中同时进行推理与图像生成,信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,已上线 SenseNova Studio、HuggingFace 及 GitHub。
3. OpenRouter 上线 FLUX 3 Video 统一多模态模型
FLUX 3 Video 是统一的视频、音频、图像和动作预测多模态模型家族,基于统一架构联合训练,现已向所有人开放。
4. 蚂蚁百灵发布 Ling-3.0-flash 开源权重
官方 BF16 和 FP8 量化版本均已可用,用户可根据硬件、性能要求和部署需求选择最合适的版本。
5. 腾讯混元发布 Hy ASR 3.0 preview 语音识别
基于 LLM Hy3 与 MoE 架构,中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,支持上下文纠错、热词注入及高噪耳语等场景。
6. Swiftlet:在 Mac 上运行 80B 版 Qwen
Swift + Metal 运行时,在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需流式加载路由专家权重。
7. Anthropic 与 Volta 签署 100 亿美元算力协议
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元,Volta 硬件几乎全为租用,算力来自比特币矿商 Bitdeer 的挪威站点。
8. 工信部发布首部 L3/L4 自动驾驶强制性国标
《智能网联汽车 自动驾驶系统安全要求》强制性国标获批发布,2027 年 7 月 1 日起实施,是我国首部针对 L3 级有条件自动驾驶和 L4 级高度自动驾驶的强制性国标。
9. GPT-5.6 Luna 降价 80% 永久生效
OpenAI 确认 GPT-5.6 Luna 降价 80% 不是临时噱头而是永久调整,效率提升不会消失。
10. MiniMax-H3 通过 MLX 移植可在 Apple Silicon 运行
MiniMax-H3 是可接受文本、图像、音频和视频并生成最长 15 秒带音频视频的全模态生成系统,Python 包将其移植到 MLX,支持 Apple Silicon 运行。
11. Google 发布 Gemini 3.6 Flash 等三款新模型
Google 在 7 月推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,面向生产级 AI 智能体,主打更高 token 效率、更低延迟和更可靠性能。
来源与核验
这是一条旧版简报,原始来源链接未保留。涉及安全、金融、政策或突发事件的信息,请在采取行动前通过权威原始来源再次核验。