🤖 AI HOT 日报 · 2026-09-22
2026-09-22
小米发布并开源 MiMo-V2.6 系列(Pro 与 Flash 两个原生全模态模型),通过规模化强化学习训练、探索 RSI(递归自我改进)路径;Pro 在多数 Agent 基准上与 Claude Opus 5 和 GPT-5.6 Sol 相当,Artificial Analysis 智能指数得 46 分(超越前代 26 分,为开放权重模型最高),Code Arena: WebDev 以 1628 分(AutoEval)位列约第 10、开源权重中约第 3,较 MiMo-V2.5-Pro 上涨 153 分;xAI 发布 Grok 4.7,定位最强编码与知识工作模型,定价 $2/百万输入、$6/百万输出 token(与 4.6 同价同速,另有速度价格翻倍的快速变体),智能体知识工作跻身前沿——Musk 称其使 xAI 在智能体编码上位列第三,Artificial Analysis 评测其 AA-Briefcase 得 1657 Elo(+111)、智能指数 46 分仅次 Claude Opus 5 与 Claude Fable 5.1;通义千问发布 Qwen-Image-2.1:7B 参数单检查点同时支持图像生成与编辑,最多支持 10 张参考图、自带提示词增强 LLM,已集成 diffusers 与 ComfyUI 并提供免安装在线 demo;Kimi(月之暗面)发布 Kimi Code Desktop 1.0 官方桌面客户端,macOS(Apple 与 Intel 芯片)与 Windows 版同步上线;加拿大不列颠哥伦比亚省在加州起诉 OpenAI,指其未在 2026 年 2 月 10 日 Tumbler Ridge 枪击案(致 8 人遇难、27 人受伤)前将 flagged 的 ChatGPT 活动转介警方;亚马逊封禁 Meta 个人 AI 智能体 Muse 代用户在其网站购物的访问权限,称从未许可该访问、Muse 不表明身份且会采集保存账号凭证,带来隐私与安全隐患,双方争端升级;Nathan Lambert 向美国国会汇报开源模型现状,指出中国开源权重模型已在下载量、基准成绩与学术采用上领先——自 2025 年 7 月起在 Hugging Face 下载量领先约 1.6B(总 3.2B,约为美国两倍);Tomer Tunguz 撰文称最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器数百毫秒返回结果、成本比传统生成式调用低约 76x 到 209x,他在自己的 Agent 中替换了约四分之一的调用;Linear 重构 CI 流程应对 AI 编码带来的验证瓶颈,PR 等待时间从 6 分钟以上降至 5 分钟出头、单测 runner 时间约减半;数字生命卡兹克访谈字幕组与漫画汉化组发现他们并不抵触 AI——字幕组把听写、打轴交给 AI 后打轴时间从 3-5 小时缩短到 20 分钟至 1 小时,程序员为喜欢的主播自研工具、单人完成两小时直播中文字幕,漫画汉化组则因嵌字质量坚持人工制作,成员看重的是同好社群与爱好本身。
1. 小米发布开源 MiMo-V2.6:Pro/Flash 全模态
规模化强化学习训练、探索 RSI(递归自我改进)路径;Pro 在多数 Agent 基准上与 Claude Opus 5、GPT-5.6 Sol 相当,智能指数 46 分登顶开放权重。
2. MiMo-V2.6-Pro 登 Code Arena WebDev 第 10,开源第 3
1628 分(AutoEval)位列约第 10,开源权重(MIT 许可)中约第 3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。
3. xAI 发布 Grok 4.7:最强编码与知识工作模型
定价 $2/$6 每百万输入/输出 token;Musk 称其使 xAI 在智能体编码位列第三,AA-Briefcase 1657 Elo(+111)仅次 Claude Opus 5 与 Fable 5.1。
4. 通义千问 Qwen-Image-2.1:7B 单检查点兼顾生成与编辑
最多支持 10 张参考图,自带提示词增强 LLM;已集成 diffusers 与 ComfyUI,并提供免安装浏览器在线 demo。
