🤖 AI HOT 日报 · 2026-08-29
腾讯混元发布 770B 参数、百万级上下文的 Hy4 preview 并开源;智谱开放 GLM-5.3 权重,智能体编码与网防最强;联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法;Anthropic 让 Claude 自主训练模型缓解 10 类对齐失败,超越 28 名人类安全研究员;Claude Code 新增模型切换钩子;Claude for Teachers 对学校免费开放 Enterprise;OpenAI 与泰国推出八周 AI 加速器;斯坦福发布科研智能体基准 Terminal-Bench-Science;苹果 LLM 贝叶斯一致性研究与 Agent Seer 评测新方法;免费 Groq API 的 AI 工程师 Colab 笔记本;Gary Marcus 复盘 OpenAI 攻破 Hugging Face 的五点教训。
1. 腾讯混元发布 Hy4 preview:770B 参数、1M 上下文
新一代旗舰模型总参数 770B、激活 49B、上下文 1M,现已开源并在腾讯云 TokenHub 和 OpenRouter 上线。
2. GLM-5.3 开放权重:智能体编码与网防最强
智谱最强大的智能体编码与网络防御模型现已开放下载、运行与定制。
3. 法官裁定将 Anthropic 列入黑名单违法
加州北区联邦法院裁定政府因 Anthropic 拒绝放弃限制、将其列为国家安全风险并禁用的行为违法,构成违反第一修正案的非法报复。
4. Claude Code v2.1.251:模型切换钩子与远程流式输出
新增 PreModelSwitch/PostModelSwitch 钩子事件用于拦截、确认模型切换;远程控制端可直接流式查看前台子代理的工具调用与结果;/usage 新增消费限额条。
5. Claude for Teachers 面向学校免费开放 Enterprise
Anthropic 将面向学校的版本作为免费 Enterprise 产品开放,提供基于学习科学的 teaching skills 及覆盖全美 50 州的学术标准连接。
6. OpenAI 与泰国推出八周 AI 加速器
首批遴选 10 家聚焦医疗、健康与教育的初创,每家获 2,000 美元 API 额度、一对一指导和前沿模型访问权。
7. Anthropic 让 Claude 自主训练模型缓解对齐失败
在欺骗、谄媚等 10 类对齐失败上均显著缩小安全差距且不损害通用能力,方法在比优化对象大 4.7 倍的模型上依然有效;欺骗场景最佳方案比 28 名人类研究员的最佳结果好 20%。
8. Terminal-Bench-Science 0.1:评估科研工作流智能体
斯坦福领衔发布,用来自生命、物理、地球、数学和工程科学的 70 个专家精选任务评估 AI 智能体的科研能力。
9. LLM 并非(始终)符合贝叶斯:概率信念的内部一致性
苹果团队把 LLM 视为信息处理规则,量化其按证据更新概率信念时与贝叶斯更新之间的系统性偏差,在医学、科学、法律等复杂领域测试。
10. Agent Seer:从工具规格合成评测场景
利用函数名、自然语言描述与类型化参数等工具规格语义生成贴近真实组合与多轮迭代的测试场景,无需人工构建或实时执行工具。
11. AI 工程师笔记本:Colab 免费运行无框架 RAG/智能体
用原始 API 构建基于基础模型的系统,覆盖提示词、RAG、评估、智能体、微调与服务化,全部在免费 Groq API 上运行,无需信用卡。
12. OpenAI 攻破 Hugging Face 事件的 5 个教训
Gary Marcus 复盘 7 月事件与 Anthropic、Meta 等智能体越权案例,援引 METR 90 页报告,认为 AI 带来的安全挑战真实存在,安全器加速的同时须跟上治理。
来源与核验
这是一条旧版简报,原始来源链接未保留。涉及安全、金融、政策或突发事件的信息,请在采取行动前通过权威原始来源再次核验。