AI 日报

🤖 AI HOT 日报 · 2026-08-04

Qwen3.8-Max 发布 2.4T 参数首次开源 Qwen-Max 级权重;商汤发布 SenseNova U1.5-Lite 轻量多模态模型;OpenAI 发布 GPT-Live 实时音频新架构可边说边听;微软开源 Orchard 智能体训练框架;Cloudflare 推出 @cloudflare/computer 智能体运行时与 Billable Usage API;欧盟《人工智能法案》透明度规则生效违规最高罚 1500 万欧元;AirLLM 实现单块 4GB GPU 运行 70B 模型;Gary Marcus 称 Anthropic 数学家 24 小时复现 OpenAI Astra 半数结果。

  1. 1. Qwen3.8-Max 发布:开源最强编码与协作模型

    Qwen 家族迄今最强模型,2.4T 参数(95B 激活),首次开源 Qwen-Max 级权重,开放权重将于下周发布。

  2. 2. 商汤发布 SenseNova U1.5-Lite-Preview 开源模型

    基于 NEO-Unify 架构的轻量级原生统一多模态模型,仅 8B-MoT 参数即可达到商业闭源模型的生成与编辑质量。

  3. 3. GPT-Live 实时音频新架构发布

    GPT-Live 可以在说话的同时聆听,从客户端到模型重建了语音栈,让音频持续流动,更深入的推理和工具使用不会打断对话。

  4. 4. 微软开源 Orchard 智能体训练框架

    面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体,降低复杂性并让较小模型也能实现强劲性能。

  5. 5. Cloudflare 推出 @cloudflare/computer 智能体运行时

    开源智能体运行时,为每个智能体提供虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码。

  6. 6. 欧盟《人工智能法案》透明度规则生效

    8 月 2 日起生效,要求公司披露用户何时与 AI 互动,并为合成音视频和文本添加机器可读标记,违规最高罚 1500 万欧元或全球年营业额 3%。

  7. 7. AirLLM:单块 4GB GPU 运行 70B 模型推理

    开源项目支持在单块 4GB 显存 GPU 上运行 70B 参数大模型推理,无需多卡或大规模显存配置,在 Hacker News 引发关注。

  8. 8. Gary Marcus:Anthropic 24 小时复现 OpenAI Astra 半数结果

    Anthropic 数学家 Levent Alpöge 用已公开的 Fable 模型在 24 小时内复现了 OpenAI 声称的半数结果,质疑 Astra 是否为真正的突破。

  9. 9. Palantir CEO:前沿 AI 实验室带「马克思主义色彩」

    Alex Karp 在股东信中称前沿实验室意图「占有合作伙伴的生产资料」,Palantir 二季度营收 19 亿美元同比增长 93%,主张提供模型无关的 AI 与分布式方案。

  10. 10. Cloudflare 推出 Billable Usage API

    为自助账户提供单一端点,一次调用返回按产品和计费周期拆分的用量与成本,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream。

来源与核验

这是一条旧版简报,原始来源链接未保留。涉及安全、金融、政策或突发事件的信息,请在采取行动前通过权威原始来源再次核验。