🤖 AI HOT 日报 · 2026-08-04
Qwen3.8-Max 发布 2.4T 参数首次开源 Qwen-Max 级权重;商汤发布 SenseNova U1.5-Lite 轻量多模态模型;OpenAI 发布 GPT-Live 实时音频新架构可边说边听;微软开源 Orchard 智能体训练框架;Cloudflare 推出 @cloudflare/computer 智能体运行时与 Billable Usage API;欧盟《人工智能法案》透明度规则生效违规最高罚 1500 万欧元;AirLLM 实现单块 4GB GPU 运行 70B 模型;Gary Marcus 称 Anthropic 数学家 24 小时复现 OpenAI Astra 半数结果。
1. Qwen3.8-Max 发布:开源最强编码与协作模型
Qwen 家族迄今最强模型,2.4T 参数(95B 激活),首次开源 Qwen-Max 级权重,开放权重将于下周发布。
2. 商汤发布 SenseNova U1.5-Lite-Preview 开源模型
基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。
3. GPT-Live 实时音频新架构发布
GPT-Live 可以在说话的同时聆听,从客户端到模型重建了语音栈,让音频持续流动,更深入的推理和工具使用不会打断对话。
4. 微软开源 Orchard 智能体训练框架
面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体,降低复杂性并让较小模型也能实现强劲性能。
5. Cloudflare 推出 @cloudflare/computer 智能体运行时
开源智能体运行时,为每个智能体提供虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码。
6. 欧盟《人工智能法案》透明度规则生效
8 月 2 日起生效,要求公司披露用户何时与 AI 互动,并为合成音视频和文本添加机器可读标记,违规最高罚 1500 万欧元或全球年营业额 3%。
7. AirLLM:单块 4GB GPU 运行 70B 模型推理
开源项目支持在单块 4GB 显存 GPU 上运行 70B 参数大模型推理,无需多卡或大规模显存配置,在 Hacker News 引发关注。
8. Gary Marcus:Anthropic 24 小时复现 OpenAI Astra 半数结果
Anthropic 数学家 Levent Alpöge 用已公开的 Fable 模型在 24 小时内复现了 OpenAI 声称的半数结果,质疑 Astra 是否为真正的突破。
9. Palantir CEO:前沿 AI 实验室带「马克思主义色彩」
Alex Karp 在股东信中称前沿实验室意图「占有合作伙伴的生产资料」,Palantir 二季度营收 19 亿美元同比增长 93%,主张提供模型无关的 AI 与分布式方案。
10. Cloudflare 推出 Billable Usage API
为自助账户提供单一端点,一次调用返回按产品和计费周期拆分的用量与成本,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream。
来源与核验
这是一条旧版简报,原始来源链接未保留。涉及安全、金融、政策或突发事件的信息,请在采取行动前通过权威原始来源再次核验。