OpenAI 10万亿参数 Bel 曝光! 智谱 GLM-5.3 Flash、阿里 Qwen3.8 Flash 同日发布 | 8月27日 AI日报

💡 今日趋势速览:OpenAI完成新预训练代号Bel,智谱推出开源GLM-5.3-Flash,阿里发布Qwen3.8-Flash,三大厂商竞相突破,开源生态与前沿预训练并进,预示模型能力新跃升。

🎯 今日要点

  1. OpenAI 被曝完成新预训练代号 Bel
  2. 智谱发布 GLM-5.3-Flash 开源模型
  3. Qwen3.8-Flash 开源:Qwen4 架构预览

📋 今日内容汇总

🤖 AI动态

  1. OpenAI 被曝完成新预训练代号 Bel
  2. 智谱发布 GLM-5.3-Flash 开源模型
  3. Qwen3.8-Flash 开源:Qwen4 架构预览
  4. OpenAI 恢复 Plus 五小时使用限额
  5. ModelScope 匿名 29B-A4B 模型开启早测
  6. 谷歌发布 Gemini 3.5 Transcribe
  7. 混元极低 bit 翻译模型跑进直播弹幕
  8. fal 发布后训练视频模型 H3 Max
  9. MiniMax:M3 Pro 参数将提升至约 3T
  10. 阿里推出 QwenWork 国际版公测

🧪 芯片半导体

  1. d-Matrix 发布 3D DRAM 加速器 Raptor

🦾 机器人具身智能

  1. Perceptron 开源具身模型 Isaac 0.5

📦 开源项目

  1. 豆包上线完整 Agent 能力

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. OpenAI 被曝完成新预训练代号 Bel

OpenAI刚完成新的大规模预训练,内部代号Bel,总参数超过10万亿,已被定位在GPT-6之后,甚至可能成为未来AGI阈值模型的基础。此前代号Doug的模型被认为是Astra和GPT-6的预训练基础;Bel是Doug之后的下一代。

OpenAI 被曝完成新预训练代号 Bel

OpenAI 被曝完成新预训练代号 Bel

🔗 https://x.com/0xLogicrw/status/2092419470069498146


2. 智谱发布 GLM-5.3-Flash 开源模型

来源:原文 | Zai_org

智谱正式发布 GLM-5.3-Flash:原生多模态、100 万 token 上下文,320B 总参数激活 18B 的 MoE 架构,以 MIT 协议开源。该模型此前以 Ox Alpha 的化身在社区爆火,官方定价极具竞争力,发布当晚即开放权重下载。

智谱发布 GLM-5.3-Flash 开源模型

智谱发布 GLM-5.3-Flash 开源模型

🔗 https://x.com/Zai_org/status/2092616204787626030


3. Qwen3.8-Flash 开源:Qwen4 架构预览

来源:原文 | Alibaba_Qwen

阿里开源 Qwen3.8-Flash:多模态 MoE 模型,也是 Qwen4 架构的早期预览。1250 亿参数、每个 token 仅激活 60 亿;正式版将通过 Qwen Cloud API 提供,每百万输入 0.16 美元。

Qwen3.8-Flash 开源:Qwen4 架构预览

Qwen3.8-Flash 开源:Qwen4 架构预览

🔗 https://x.com/Alibaba_Qwen/status/2092591393424515114


4. OpenAI 恢复 Plus 五小时使用限额

经过约六周无每日额度限制后,OpenAI正式恢复标准版ChatGPT Plus用户的五小时使用上限(适用于Codex与ChatGPT Work环境),Pro账号暂不受影响。此举是为平衡计算资源负载,避免用户因意外耗尽周额度而困惑。标准版用户需重新适应限制,Pro订阅仍无此限制。

OpenAI 恢复 Plus 五小时使用限额

OpenAI 恢复 Plus 五小时使用限额

OpenAI 恢复 Plus 五小时使用限额

🔗 https://www.ithome.com/0/994/339.htm


5. ModelScope 匿名 29B-A4B 模型开启早测

ModelScope 开放一款匿名 29B-A4B 模型的早鸟体验:总参数 290 亿、激活 40 亿的 MoE 架构,限 100 个名额,注册次日即可获得调用权限并支持无限次调用。官方未披露模型身份与发布方。

ModelScope 匿名 29B-A4B 模型开启早测

ModelScope 匿名 29B-A4B 模型开启早测

🔗 https://x.com/ModelScope2022/status/2092439000652943506


6. 谷歌发布 Gemini 3.5 Transcribe

来源:原文 | GoogleDeepMind

谷歌推出迄今最精准的语音转文字模型 Gemini 3.5 Transcribe:可无缝处理自我纠正、去除语气填充词、理解自然意图与说话风格,嘈杂环境仍能捕捉音频,支持 85 种以上语言含地方口音,即日起可在 Gemini API 与 AI Studio 体验。以下是官方给出的 demo

谷歌发布 Gemini 3.5 Transcribe

🔗 https://x.com/GoogleAIStudio/status/2092659361235587416


7. 混元极低 bit 翻译模型跑进直播弹幕

来源:原文 | 腾讯混元

腾讯混元发布极低 bit 翻译模型:模型体积从 3.3GB 压缩到 440MB,可部署进直播弹幕等低资源场景。官方强调这不是停留在实验室的 Demo,而是已落地、可直接体验的产品,为实时字幕与互动翻译提供新方案。

混元极低 bit 翻译模型跑进直播弹幕

混元极低 bit 翻译模型跑进直播弹幕

🔗 https://mp.weixin.qq.com/s?__biz=MzkwODU2OTQyNQ==&mid=2247498367&idx=1&sn=f1a5cf87eb06015cbe995bd5ef8b5d0a


8. fal 发布后训练视频模型 H3 Max

fal Research 推出后训练视频模型 H3 Max:在第一方与第三方独立评测中,整体质量、提示词理解和美学均排名第一,3 秒即可生成一段 5 秒 720p 视频。未来一周半价优惠,官方称其为质量、速度与价格综合最优的选择。

fal 发布后训练视频模型 H3 Max

🔗 https://x.com/fal/status/2092710676431020376


9. MiniMax:M3 Pro 参数将提升至约 3T

据证券时报消息,MiniMax 在中期业绩电话会上透露 M3 Pro 参数规模预计提升至约 3 万亿,并将扩大强化学习与长程任务训练以提高泛化能力和智能上限;公司同时表示大规模国产算力集群将很快上线。

MiniMax:M3 Pro 参数将提升至约 3T

MiniMax:M3 Pro 参数将提升至约 3T

🔗 https://www.ithome.com/0/994/759.htm


10. 阿里推出 QwenWork 国际版公测

QwenWork International 开启公测:一个工作区集成各家前沿模型,配备真正执行任务的 AI 智能体,可产出网页应用、文档、研究、图片与视频等多种成果,现面向国际用户开放注册使用。

阿里推出 QwenWork 国际版公测

🔗 https://x.com/alibaba_cloud/status/2092448199550124390


🧪 芯片半导体

11. d-Matrix 发布 3D DRAM 加速器 Raptor

来源:原文 | Tom's Hardware

d-Matrix在Hot Chips 2026上发布Raptor——首个面向生成式推理的3D DRAM加速器,单卡带宽达100TB/s。该加速器采用台积电4nm计算芯片以36微米间距面对面键合在定制DRAM之上,大幅缩短数据搬运距离。

d-Matrix 发布 3D DRAM 加速器 Raptor

d-Matrix 发布 3D DRAM 加速器 Raptor

🔗 https://www.tomshardware.com/tech-industry/semiconductors/d-matrix-stacks-its-ai-accelerator-directly-on-custom-dram-for-100-tbs-per-card


🦾 机器人具身智能

12. Perceptron 开源具身模型 Isaac 0.5

来源:原文 | rohanpaul_ai

Perceptron 发布 Isaac 0.5:36B 动态 MoE 开放权重的具身基础模型,将多模态视频理解、具身推理与机器人控制整合进同一个稀疏主干网络,瞄准机器人与物理世界交互的通用智能。

Perceptron 开源具身模型 Isaac 0.5

🔗 https://x.com/perceptroninc/status/2092678357775442103


📦 开源项目

13. 豆包上线完整 Agent 能力

来源:原文 | GitHubDaily

豆包上线完整Agent能力:除对话问答外,可在办公自动化场景自主拆解任务、调用工具并连续执行多步操作。此外,这款月活突破3亿的应用正从聊天助手转向执行力更强的智能体形态,实测任务完成度出乎意料。

豆包上线完整 Agent 能力

豆包上线完整 Agent 能力

🔗 https://mp.weixin.qq.com/s?__biz=MzAxOTcxNTIwNQ==&mid=2457995322&idx=1&sn=29c2178b58c14933e01deb20bbc34cd5


📌 模型排行榜

14. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智能体榜 GLM-5.3、Grok 4.6 与 Claude Opus 5 同以 59 分并列第一,GLM-5.3-Flash 58 分紧随其后。智力榜 Claude Opus 5 以 63 分居首,Claude Fable 5 以 62 分第二,国产 GLM-5.3 表现亮眼,智能体榜与榜首并列第一。

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

内容概要:本文围绕“基于改进秃鹰算法的微电网群经济优化调度”展开研究,提出了一种改进的秃鹰搜索算法(BES),旨在解决微电网群在复杂运行环境下的多目标、强约束、非线性及高维经济调度问题。通过引入特定优化策略,增强了基础算法的全局搜索能力和收敛效率,克服了传统能算法易陷入局部最优的缺陷。研究构建了一个包含分布式电源、储能系统与多元负荷的微电网群调度模型,以最小化系统综合运行成本为核心目标,综合考虑功率平衡、设备出力能力、储能运行特性等多重约束条件。通过仿真实验验证了所提算法在调度精度、稳定性和计算效率方面相较于传统方法具有明显优势,并进一步展示了其在降低能源开支、提升可再生能源消纳水平方面的实际应用价值。; 适合人群:具备一定电力系统基础知识或优化算法背景,从事新能源调度、能优化算法研究与应用等相关领域的研究生、科研人员及工程技术人员。; 使用场景及目标:①应用于微电网群、综合能源系统等场景下的经济调度优化;②为秃鹰算法及其他群体能算法的改进、复现与性能对比提供参考范例;③服务于科研仿真、算法验证及工程化应用需求。; 阅读建议:建议读者结合文中提供的Matlab代码实现进行实践操作,重点关注算法改进机制与调度模型的构建逻辑,同时可借助网盘资源获取完整资料,以加深对算法性能表现与应用场景的理解。
内容概要:本文围绕“多种改进粒子群算法在深度神经网络卸载策略中的比较研究”展开,系统探讨了边缘计算环境下基于启发式优化算法的DNN任务卸载问题。文章首先剖析了传统粒子群算法(PSO)的基本原理及其在收敛性和全局搜索能力方面的局限性,继而深入介绍四种代表性改进算法:自适应权重PSO、混合遗传PSO、模拟退火PSO以及多目标PSO,详述其在提升寻优效率、增强鲁棒性及应对复杂多约束场景下的机制与优势。研究通过构建DNN卸载模型,设计多维度性能评估体系,在延迟、能耗、资源利用率等关键指标上对各类算法进行对比实验分析,进而提出面向不同应用场景的算法选型策略与优化建议。该工作为边缘能系统中的计算任务调度提供了理论支撑与实践指导。; 适合人群:具备一定人工能与优化算法基础,从事边缘计算、物联网、能系统优化等相关领域的研究生、科研人员及工程技术人员。; 使用场景及目标:① 掌握多种改进粒子群算法的核心思想与实现机制;② 理解深度神经网络在边缘-云协同环境下的任务卸载建模方法;③ 学习如何通过仿真实验对比不同启发式算法的性能差异,并根据实际需求选择最优算法方案; 阅读建议:建议结合提供的Matlab代码实现进行动手实践,重点关注算法参数调优、适应度函数设计及实验结果可视化分析过程,以深入理解算法行为与系统性能之间的内在关联。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值