AI 日报

🤖 AI HOT 日报 · 2026-09-15

小红书 AllSpark 团队发布并开源 Search Agent 模型 Iris,35B 与 397B 两个版本在同量级成绩领先,权重与评测代码已公开;硅基流动上线开源模型 Hy4 preview:总参数 770B、每 token 激活 49B、支持 1M 上下文、Apache 2.0 协议,面向编码分析研究等复杂工作,可接入 Claude Code、Codex、Cursor 等工具;Apple 发布新一代 Apple Intelligence,全面重构的 Siri AI 以英文测试版随 2027 系统更新上线,支持个人语境理解、屏幕感知、系统级应用操作与跨设备对话,下月扩至法语、日语、韩语、葡萄牙语和西班牙语;Anthropic 计划登陆纳斯达克,以连续第二季度盈利冲击约 2 万亿美元估值——该数字基于剔除股权激励的调整后指标,毛利率超 80% 且未计入与 Amazon 的分成及训练成本;DeepSeek-V4.1-Flash (Max) 进入 Agent Arena 开源模型第 3 名,每任务中位成本 $0.07、比第 2 名 Hy4 preview 便宜 68% 而成绩仅差 0.09 个百分点,重塑 Pareto 前沿;Altman、Amodei、Hassabis 与 Musk 周末粗略同意放慢 AI 开发——引入第三方审计、监管国内实验室并达成全球放缓协议,批评者称这不过是压制竞争者的'卡特尔';一份对比评测显示 GPT-5.6 Luna 用 $0.20 在 50 个公开 PR 中找到 69 个已验证 bug(精度 74%),而 GPT-6 Astra 花 $5.66 找到 92 个(精度 96%);VC 分析师 Tomer Tunguz 梳理 Amodei 放缓倡议背后的可解释性、劳工、经济、地缘政治与监管俘获五派立场,指出没有任何一派给出具体速度;面对智能体编码洪流,Anthropic 重构了测试影响分析服务——工程师季度代码交付量已达 2021-2025 年均值的 8 倍、其中 80% 由 Claude 编写,六个月内 CI 任务暴增 25 倍。

  1. 1. 小红书开源自研 Search Agent 模型 Iris

    AllSpark 团队发布 Iris,35B 与 397B 同量级成绩领先;权重与评测代码已公开,数据与训练配方将陆续公布。

  2. 2. Hy4 preview 登陆硅基流动:770B 参数、1M 上下文

    总参数 770B、每 token 激活 49B、Apache 2.0,面向编码、分析、研究等复杂工作,可接入 Claude Code、Codex、Cursor。

  3. 3. 新一代 Apple Intelligence:重构版 Siri AI 上线

    支持个人语境理解、屏幕感知、系统级应用操作与跨设备对话;英文测试版随 2027 系统更新推出,下月扩至五种语言。

  4. 4. Anthropic 冲刺纳斯达克,瞄准 2 万亿美元估值

    向投资者主打连续第二季度盈利,但为剔除股权激励的调整后口径;毛利率超 80%,尚未计入 Amazon 分成与模型训练成本。

  5. 5. DeepSeek-V4.1-Flash 晋升 Agent Arena 开源第 3

    +4.87% 净提升、每任务中位成本 $0.07,比第 2 名 Hy4 preview 便宜 68%、成绩仅差 0.09 个百分点;总榜第 12。

  6. 6. 科技巨头口头放缓 AI:安全共识还是卡特尔?

    Altman、Amodei、Hassabis 与 Musk 粗略同意放缓:第三方审计、监管国内实验室、全球放缓协议;批评者称其压制竞争与开源。

  7. 7. $0.20 与 $5.66 的代码评审:Luna 对 Astra

    50 个公开 PR 同提示词对比:GPT-5.6 Luna 找到 69 个已验证 bug(精度 74%),GPT-6 Astra 92 个(精度 96%)。

  8. 8. Tomer Tunguz:放缓倡议背后的五派立场

    梳理出可解释性、劳工、经济、地缘政治与监管俘获五派立场,并指出——没有任何一派给出具体速度。

  9. 9. Anthropic 重构测试影响分析,扛住 25 倍 CI 洪流

    工程师季度代码量已是 2021-2025 均值 8 倍、80% 由 Claude 编写,六个月 CI 任务增长 25 倍,遂重构测试影响分析服务。

来源与核验

这是一条旧版简报,原始来源链接未保留。涉及安全、金融、政策或突发事件的信息,请在采取行动前通过权威原始来源再次核验。