🤖 AI HOT 日报 · 2026-09-07
2026-09-07
OpenAI 集中发声:发布内部研究加速报告,宣称已达成'自动化研究实习生'目标并推进 2028 年 3 月的自动化 AI 研究员;Fortune 报道其多次修改 GPT-6 Astra 基准数据(幻觉率曾 4.2%→2% 又改回)引发争议;长文《An Alien Mind》指出链式思维监控能力随模型增强而减弱、Astra 对齐显著优于 Sol;Astra 正式发布并被认定为首个网络安全达到'关键'等级的广泛部署模型;Daybreak 计划投 10 亿美元护电网友医疗金融等关键设施;ChatGPT Ads 年化收入突破 10 亿美元;ChatGPT 可接入电子病历等医疗数据;客户案例:Legora 用 Astra 数分钟审阅 41 份文档、财务审核性能提升近 40%,澳洲律所 Gilbert+Tobin 展示法律行业 AI 治理范式。
1. OpenAI 发布研究加速报告:自动化研究实习生目标达成
宣布已达成去年秋天设定的目标——在人类指导下完成耗时数天明确任务的自动化研究实习生,并计划 2028 年 3 月前造出自动化 AI 研究员。
2. Fortune:OpenAI 多次修改 Astra 基准数据
自 9 月 3 日起多次修改评测数据,Astra 幻觉率曾从 4.2% 降至 2% 后又改回,发布数据流程引发质疑。
3. OpenAI 长文《An Alien Mind》:CoT 可监控性正减弱
回溯 2023 年 RLSlow 项目起点,系统阐述目标对齐与价值对齐的区别;称链式思维监控效果随模型变强而减弱,Astra 对齐显著优于 GPT-5.6 Sol。
4. GPT-6 Astra 正式发布,基准数据引争议
号称迄今最智能且对齐程度最高的模型,电脑操作、编程、对话等能力达 SOTA;发布后的基准测试数据修改争议成行业讨论焦点。
