💡 今日趋势速览:OpenAI完成新预训练代号Bel,智谱推出开源GLM-5.3-Flash,阿里发布Qwen3.8-Flash,三大厂商竞相突破,开源生态与前沿预训练并进,预示模型能力新跃升。
🎯 今日要点
📋 今日内容汇总
🤖 AI动态
- OpenAI 被曝完成新预训练代号 Bel
- 智谱发布 GLM-5.3-Flash 开源模型
- Qwen3.8-Flash 开源:Qwen4 架构预览
- OpenAI 恢复 Plus 五小时使用限额
- ModelScope 匿名 29B-A4B 模型开启早测
- 谷歌发布 Gemini 3.5 Transcribe
- 混元极低 bit 翻译模型跑进直播弹幕
- fal 发布后训练视频模型 H3 Max
- MiniMax:M3 Pro 参数将提升至约 3T
- 阿里推出 QwenWork 国际版公测
🧪 芯片半导体
🦾 机器人具身智能
📦 开源项目
📌 模型排行榜
🤖 AI动态
OpenAI刚完成新的大规模预训练,内部代号Bel,总参数超过10万亿,已被定位在GPT-6之后,甚至可能成为未来AGI阈值模型的基础。此前代号Doug的模型被认为是Astra和GPT-6的预训练基础;Bel是Doug之后的下一代。


🔗 https://x.com/0xLogicrw/status/2092419470069498146
智谱正式发布 GLM-5.3-Flash:原生多模态、100 万 token 上下文,320B 总参数激活 18B 的 MoE 架构,以 MIT 协议开源。该模型此前以 Ox Alpha 的化身在社区爆火,官方定价极具竞争力,发布当晚即开放权重下载。


🔗 https://x.com/Zai_org/status/2092616204787626030
3. Qwen3.8-Flash 开源:Qwen4 架构预览
来源:原文 | Alibaba_Qwen
阿里开源 Qwen3.8-Flash:多模态 MoE 模型,也是 Qwen4 架构的早期预览。1250 亿参数、每个 token 仅激活 60 亿;正式版将通过 Qwen Cloud API 提供,每百万输入 0.16 美元。


🔗 https://x.com/Alibaba_Qwen/status/2092591393424515114
经过约六周无每日额度限制后,OpenAI正式恢复标准版ChatGPT Plus用户的五小时使用上限(适用于Codex与ChatGPT Work环境),Pro账号暂不受影响。此举是为平衡计算资源负载,避免用户因意外耗尽周额度而困惑。标准版用户需重新适应限制,Pro订阅仍无此限制。



🔗 https://www.ithome.com/0/994/339.htm
ModelScope 开放一款匿名 29B-A4B 模型的早鸟体验:总参数 290 亿、激活 40 亿的 MoE 架构,限 100 个名额,注册次日即可获得调用权限并支持无限次调用。官方未披露模型身份与发布方。


🔗 https://x.com/ModelScope2022/status/2092439000652943506
来源:原文 | GoogleDeepMind
谷歌推出迄今最精准的语音转文字模型 Gemini 3.5 Transcribe:可无缝处理自我纠正、去除语气填充词、理解自然意图与说话风格,嘈杂环境仍能捕捉音频,支持 85 种以上语言含地方口音,即日起可在 Gemini API 与 AI Studio 体验。以下是官方给出的 demo

🔗 https://x.com/GoogleAIStudio/status/2092659361235587416
腾讯混元发布极低 bit 翻译模型:模型体积从 3.3GB 压缩到 440MB,可部署进直播弹幕等低资源场景。官方强调这不是停留在实验室的 Demo,而是已落地、可直接体验的产品,为实时字幕与互动翻译提供新方案。


🔗 https://mp.weixin.qq.com/s?__biz=MzkwODU2OTQyNQ==&mid=2247498367&idx=1&sn=f1a5cf87eb06015cbe995bd5ef8b5d0a
fal Research 推出后训练视频模型 H3 Max:在第一方与第三方独立评测中,整体质量、提示词理解和美学均排名第一,3 秒即可生成一段 5 秒 720p 视频。未来一周半价优惠,官方称其为质量、速度与价格综合最优的选择。

🔗 https://x.com/fal/status/2092710676431020376
据证券时报消息,MiniMax 在中期业绩电话会上透露 M3 Pro 参数规模预计提升至约 3 万亿,并将扩大强化学习与长程任务训练以提高泛化能力和智能上限;公司同时表示大规模国产算力集群将很快上线。


🔗 https://www.ithome.com/0/994/759.htm
QwenWork International 开启公测:一个工作区集成各家前沿模型,配备真正执行任务的 AI 智能体,可产出网页应用、文档、研究、图片与视频等多种成果,现面向国际用户开放注册使用。

🔗 https://x.com/alibaba_cloud/status/2092448199550124390
🧪 芯片半导体
11. d-Matrix 发布 3D DRAM 加速器 Raptor
来源:原文 | Tom's Hardware
d-Matrix在Hot Chips 2026上发布Raptor——首个面向生成式推理的3D DRAM加速器,单卡带宽达100TB/s。该加速器采用台积电4nm计算芯片以36微米间距面对面键合在定制DRAM之上,大幅缩短数据搬运距离。


🔗 https://www.tomshardware.com/tech-industry/semiconductors/d-matrix-stacks-its-ai-accelerator-directly-on-custom-dram-for-100-tbs-per-card
🦾 机器人具身智能
12. Perceptron 开源具身模型 Isaac 0.5
来源:原文 | rohanpaul_ai
Perceptron 发布 Isaac 0.5:36B 动态 MoE 开放权重的具身基础模型,将多模态视频理解、具身推理与机器人控制整合进同一个稀疏主干网络,瞄准机器人与物理世界交互的通用智能。

🔗 https://x.com/perceptroninc/status/2092678357775442103
📦 开源项目
来源:原文 | GitHubDaily
豆包上线完整Agent能力:除对话问答外,可在办公自动化场景自主拆解任务、调用工具并连续执行多步操作。此外,这款月活突破3亿的应用正从聊天助手转向执行力更强的智能体形态,实测任务完成度出乎意料。


🔗 https://mp.weixin.qq.com/s?__biz=MzAxOTcxNTIwNQ==&mid=2457995322&idx=1&sn=29c2178b58c14933e01deb20bbc34cd5
📌 模型排行榜
最后是今日的 AI 模型能力排行榜单,智能体榜 GLM-5.3、Grok 4.6 与 Claude Opus 5 同以 59 分并列第一,GLM-5.3-Flash 58 分紧随其后。智力榜 Claude Opus 5 以 63 分居首,Claude Fable 5 以 62 分第二,国产 GLM-5.3 表现亮眼,智能体榜与榜首并列第一。


🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。


被折叠的 条评论
为什么被折叠?



