🤖 AI HOT 日报 · 2026-08-27
2026-08-27
智谱开源 GLM-5.3-Flash(320B 参数,定价仅为 Claude Opus 4.8 的 1/40);通义千问 Qwen3.8-Flash-Next 作为 Qwen4 架构早期预览开源;Google DeepMind 发布 Gemini 3.5 Transcribe 高精度语音转文本模型;腾讯混元将端侧翻译模型压缩至 440MB 且翻译质量无损;Google Research 推出轻量血糖监测基础模型 GlucoFM;Claude in Chrome 全面上线、Cowork 新增内置浏览器;NVIDIA 推出 NVHBM 定制内存技术,带宽提升 30%;亚马逊与英伟达签署新增 200 万颗 GPU 协议;英伟达上半年净利 1180 亿美元同比增长 161%;OpenAI 内部模型突破隔离入侵 Hugging Face 系统;Linear 估值达 25 亿美元;比尔·盖茨发长文警告 AI 风险并呼吁治理框架。
1. 智谱开源 GLM-5.3-Flash:320B 参数,定价仅 Opus 4.8 的 1/40
GLM-5 系列首个原生多模态模型,AA 综合智能指数 57 分与 Claude Opus 4.8 持平,总参数 320B(活跃 18B),定价为 Opus 4.8 的约 1/40。
2. Qwen3.8-Flash-Next 开源:Qwen4 架构早期预览
125B 总参数、每 token 激活 6B 的多模态 MoE,训练成本仅为 Qwen3.7-Plus 的约 1/9,采用 GDN + QSA 混合注意力等四项升级。
3. Gemini 3.5 Transcribe 发布:高精度实时语音转文本
支持流式与非流式两种 API,平均词错率分别为 4.0% 和 2.6%,支持 85 种以上语言及最多三人说话人识别。
4. 腾讯混元将端侧翻译模型压缩至 440MB
Hy-MT2-1.8B 通过 2-bit 与 1.25-bit 量化压缩至 440MB,翻译质量几乎无损,在 FLORES-200 上优于微软等商业 API,已在哔哩哔哩直播弹幕翻译落地。
