Anthropic发布Fable 5.1与Mythos 5.1登顶,Meta超级应用定名Muse,Spark连发两款端侧智能体 | 9月2日 AI日报

💡 今日趋势速览:Anthropic发布Claude Fable 5.1与Mythos 5.1,双双登顶智力榜与智能体榜。Meta超级应用Project Hatch定名Muse并开启候补名单。SparkLLM发布两款端侧智能体模型,支持百万token上下文,模型轻量与智能体应用正成为新战场。

B站视频:【Anthropic发布Fable 5.1与Mythos 5.1登顶,Meta超级应用定名Muse,Spark连发两款端侧智能体 | 9月2日 AI日报】

🎯 今日要点

  1. Anthropic 发布 Fable 5.1 与 Mythos 5.1
  2. Meta 超级应用 Project Hatch 将以 Muse 之名发布
  3. SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B

📋 今日内容汇总

🤖 AI动态

  1. Anthropic 发布 Fable 5.1 与 Mythos 5.1
  2. Meta 超级应用 Project Hatch 将以 Muse 之名发布
  3. SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B
  4. World Labs 发布空间智能世界模型 Atlas
  5. OpenRouter 独家上线 Mercury 2.5,称其推理速度最快
  6. Runway 发布世界模型 Solaris,直接生成可交互 App 界面
  7. viskoai 发布首个实时模型 Orbis 1.0,流式生成世界
  8. Meta 发布流式语音转写模型 Muse Voice Transcribe
  9. Gemini 新增智能体式视频理解,token 消耗最多降 88%
  10. OpenAI 暂停前沿强化学习训练,Astra 触及网络安全阈值
  11. 英伟达 DLSS 5 将于 9 月 3 日随《NBA 2K27》上线
  12. OpenAI 单日连挖三人充实 Codex 与 ChatGPT 团队
  13. Celeris-1 Magnus 发布:面向智能体工作的混合扩散模型
  14. Grok Build v1.0.17 发布,MCP 工具支持多轮引导交互

🧪 芯片半导体

  1. The Information:长鑫存储首次小批量产出 HBM3E

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. Anthropic 发布 Fable 5.1 与 Mythos 5.1

来源:原文 | cheatyyyy | elder_plinius

Anthropic官方宣布推出Claude Fable 5.1与Claude Mythos 5.1性能上,该模型在各项基准测试中树立新标准,Terminal-Bench-Science 0.1测试得分52.6%价格方面,Fable 5.1缓存读取成本比Fable 5低75%,典型工作负载整体降约25%,高度智能化负载降达45%。

Anthropic 发布 Fable 5.1 与 Mythos 5.1

Anthropic 发布 Fable 5.1 与 Mythos 5.1

Anthropic 发布 Fable 5.1 与 Mythos 5.1

🔗 https://x.com/claudeai/status/2094848572143407483


2. Meta 超级应用 Project Hatch 将以 Muse 之名发布

来源:原文 | Medfa1222

据TestingCatalog消息,Meta即将推出的超级应用内部代号Project Hatch,将以Muse之名正式发布,并推出候补名单。该应用被称作ChatGPT Work和Claude Cowork的竞品,消息发布者本人已加入候补名单。

Meta 超级应用 Project Hatch 将以 Muse 之名发布

Meta 超级应用 Project Hatch 将以 Muse 之名发布

🔗 https://x.com/testingcatalog/status/2094827945843921332


3. SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B

来源:原文 | SparkLLM

vLLM团队宣布,SparkLLM发布Spark-X2.5-4B和1.7B两款紧凑型端侧智能体模型,支持200多种语言,具备原生100万token上下文。发布当天,两款模型均通过Spark的树外通用插件获得vLLM首日支持,并在智能体、代码、数学等多项基准测试中亮相。

SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B

SparkLLM 发布端侧智能体模型 Spark-X2.5-4B 与 1.7B

🔗 https://x.com/vllm_project/status/2094674692133298363


4. World Labs 发布空间智能世界模型 Atlas

来源:原文 | mark_k

World Labs 发布面向空间智能的全新世界模型 Atlas。它可以从图像和视频生成、重建并模拟 3D 世界,支持精准镜头控制,能够生成长度最长 1 分钟、1440p 分辨率的视频,把 3D 世界的创建与模拟整合进单一模型。以下是官方给出的 demo

World Labs 发布空间智能世界模型 Atlas

🔗 https://x.com/mark_k/status/2094865925912633389


5. OpenRouter 独家上线 Mercury 2.5,称其推理速度最快

OpenRouter 宣布独家上线 Inception AI 的 Mercury 2.5 Preview,称其为推理速度最快的大语言模型。模型采用并行 token 生成,速度达每秒 1,107 个 token,支持可调节推理强度、并行工具调用与符合 schema 的 JSON 输出,面向延迟敏感的工作负载。

OpenRouter 独家上线 Mercury 2.5,称其推理速度最快

🔗 https://x.com/OpenRouter/status/2094792813603119482


6. Runway 发布世界模型 Solaris,直接生成可交互 App 界面

来源:原文 | op7418 (Twitter)

Runway 发布世界模型 Solaris,可直接生成应用界面,目前处于研究预览阶段。它跳过先写 HTML、CSS 代码再渲染的传统流程,界面由模型实时生成,基于 Gen-4.5 改造官方同步发布了 demo,演示其逐帧实时生成可交互界面的效果,用户可申请抢先体验。以下是官方给出的 demo

Runway 发布世界模型 Solaris,直接生成可交互 App 界面

Runway 发布世界模型 Solaris,直接生成可交互 App 界面

🔗 https://x.com/0xLogicrw/status/2094705208844841068


7. viskoai 发布首个实时模型 Orbis 1.0,流式生成世界

来源:原文 | TestingCatalog (Twitter)

viskoai 发布其首个实时模型 Orbis 1.0,可创建生动的世界并实时流式传输。模型具备持久记忆与交互性,支持基于物理规律的无限制长度生成。官方同时提供动态版本与稳定版本,API 也已开放获取。以下是官方给出的 demo

viskoai 发布首个实时模型 Orbis 1.0,流式生成世界

🔗 https://x.com/viskoai/status/2094817592754291173


8. Meta 发布流式语音转写模型 Muse Voice Transcribe

来源:原文 | alexandr_wang

Meta 超级智能实验室发布首个流式语音转文本模型 Muse Voice Transcribe,在 AA-WER 最终转写准确率登顶:语音结束后 0.16 秒实现 3.1% 词错率(WER)。模型基于 70 多种语言训练,其中 25 种经严格验证,支持超一小时音频输入且无需后处理。

Meta 发布流式语音转写模型 Muse Voice Transcribe

Meta 发布流式语音转写模型 Muse Voice Transcribe

🔗 https://x.com/ArtificialAnlys/status/2094849283120128135


9. Gemini 新增智能体式视频理解,token 消耗最多降 88%

来源:原文 | Google

Google DeepMind 宣布为最新的 Gemini 模型带来智能体式视频理解能力。升级后,模型可以更精准地分析视频,同时将 token 消耗减少多达 88%,在视频理解任务中兼顾分析质量与调用成本。

Gemini 新增智能体式视频理解,token 消耗最多降 88%

🔗 https://x.com/GoogleDeepMind/status/2094840179676660097


10. OpenAI 暂停前沿强化学习训练,Astra 触及网络安全阈值

来源:原文 | 思维怪怪 (Tech) (Twitter) | TechMeme (Twitter)

OpenAI率先公开踩下前沿模型训练的刹车,面向部署的最新模型强化学习训练暂停了两周随后压力传至Anthropic,该公司也把未发布模型的高风险RL训练暂停了数周,目前大部分已恢复,仍有部分训练环境处于暂停状态,等待人工审核,外部网络安全评估也一度中止。

OpenAI 暂停前沿强化学习训练,Astra 触及网络安全阈值

OpenAI 暂停前沿强化学习训练,Astra 触及网络安全阈值

🔗 https://x.com/0xLogicrw/status/2094632857482182842


11. 英伟达 DLSS 5 将于 9 月 3 日随《NBA 2K27》上线

来源:原文 | Tom’s Hardware

英伟达确认 DLSS 5 将于 9 月 3 日随《NBA 2K27》发布,并公布首批基准测试。该技术将支持所有 RTX 50 系列显卡、笔记本以及 GeForce NOW 云服务。DLSS 5 此前争议不断,首批基准数据将检验其实际画质与性能。

英伟达 DLSS 5 将于 9 月 3 日随《NBA 2K27》上线

英伟达 DLSS 5 将于 9 月 3 日随《NBA 2K27》上线

🔗 https://www.tomshardware.com/pc-components/gpus/nvidias-controversial-dlss-5-will-launch-september-3-with-nba2k27-available-on-all-rtx-50-series-gpus-laptops-and-geforce-now


12. OpenAI 单日连挖三人充实 Codex 与 ChatGPT 团队

OpenAI 在一天内为 Codex 和 ChatGPT 招入三名干将。Linear 产品负责人 Nan Yu 宣布结束四年任期加入 OpenAI;Kairos Computer 两位联合创始人 Manas Bam 与 Samarth Patel 随后宣布加盟,三人均流向 Codex 与 ChatGPT 团队。Kairos 主打能直接操作电脑的个人智能体产品。

OpenAI 单日连挖三人充实 Codex 与 ChatGPT 团队

🔗 https://x.com/0xLogicrw/status/2094737793457233988


13. Celeris-1 Magnus 发布:面向智能体工作的混合扩散模型

来源:原文 | Celeris_ai

Celeris AI 推出专为智能体工作打造的混合扩散模型 Celeris-1 Magnus,基于 qwen3.8-27b 衍生。在 τ³-bench 银行任务上,Magnus 以 55 秒中位耗时取得 41.2% 的成绩,对比 GPT-5.6-sol 的 79 秒与 38.1%,速度与正确率均占优。

Celeris-1 Magnus 发布:面向智能体工作的混合扩散模型

Celeris-1 Magnus 发布:面向智能体工作的混合扩散模型

🔗 https://x.com/Celeris_ai/status/2094626639842078755


14. Grok Build v1.0.17 发布,MCP 工具支持多轮引导交互

来源:原文 | XFreeze

Grok Build v1.0.17 正式发布。MCP 工具现已支持 2026-07-28 规范的多轮往返引导流程,工具调用可返回 input_required 状态,并在重试时继续执行。此外,下一行提示的幽灵建议出现频率降低且准确性提高;/btw 面板的表格单元格选择也修复为正确高亮并按 TSV 格式复制。

Grok Build v1.0.17 发布,MCP 工具支持多轮引导交互

Grok Build v1.0.17 发布,MCP 工具支持多轮引导交互

🔗 https://x.com/blankspeaker/status/2094856719751156060


🧪 芯片半导体

15. The Information:长鑫存储首次小批量产出 HBM3E

来源:原文 | LinuxDo 前沿快讯

据 The Information 报道,两位知情人士确认,中国最大内存厂商长鑫存储(CXMT)首次小批量产出 HBM3E,即 AI 处理器所用的高速内存。阿里平头哥和寒武纪已开始测试,计划 2027 年起用于自家产品;报道也指出其技术仍落后三星与 SK 海力士。

The Information:长鑫存储首次小批量产出 HBM3E

🔗 https://x.com/wlzh/status/2094585412560056818


📌 模型排行榜

16. Artificial Analysis AI 模型能力排行榜

智力榜前三:Claude Fable 5.1(66分)、Claude Opus 5(63分)、Claude Fable 5(62分)。智能体榜:Claude Fable 5.1 以61分居首,Opus 5、GLM-5.3、Grok 4.6 同以59分并列。GLM-5.3 智能体榜并列第二、智力榜60分第7。

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

内容概要:本文围绕“基于改进秃鹰算法的微电网群经济优化调度”展开研究,提出了一种改进的秃鹰搜索算法(BES),旨在解决微电网群在复杂运行环境下的多目标、强约束、非线性及高维经济调度问题。通过引入特定优化策略,增强了基础算法的全局搜索能力和收敛效率,克服了传统智能算法易陷入局部最优的缺陷。研究构建了一个包含分布式电源、储能系统多元负荷的微电网群调度模型,以最小化系统综合运行成本为核心目标,综合考虑功率平衡、设备出力能力、储能运行特性等多重约束条件。通过仿真实验验证了所提算法在调度精度、稳定性和计算效率方面相较于传统方法具有明显优势,并进一步展示了其在降低能源开支、提升可再生能源消纳水平方面的实际应用价值。; 适合人群:具备一定电力系统基础知识或优化算法背景,从事新能源调度、智能优化算法研究应用等相关领域的研究生、科研人员及工程技术人员。; 使用场景及目标:①应用于微电网群、综合能源系统等场景下的经济调度优化;②为秃鹰算法及其他群体智能算法的改进、复现性能对比提供参考范例;③服务于科研仿真、算法验证及工程化应用需求。; 阅读建议:建议读者结合文中提供的Matlab代码实现进行实践操作,重点关注算法改进机制调度模型的构建逻辑,同时可借助网盘资源获取完整资料,以加深对算法性能表现应用场景的理解。
内容概要:本文围绕“多种改进粒子群算法在深度神经网络卸载策略中的比较研究”展开,系统探讨了边缘计算环境下基于启发式优化算法的DNN任务卸载问题。文章首先剖析了传统粒子群算法(PSO)的基本原理及其在收敛性和全局搜索能力方面的局限性,继而深入介绍四种代表性改进算法:自适应权重PSO、混合遗传PSO、模拟退火PSO以及多目标PSO,详述其在提升寻优效率、增强鲁棒性及应对复杂多约束场景下的机制优势。研究通过构建DNN卸载模型,设计多维度性能评估体系,在延迟、能耗、资源利用率等关键指标上对各类算法进行对比实验分析,进而提出面向不同应用场景的算法选型策略优化建议。该工作为边缘智能系统中的计算任务调度提供了理论支撑实践指导。; 适合人群:具备一定人工智能优化算法基础,从事边缘计算、物联网、智能系统优化等相关领域的研究生、科研人员及工程技术人员。; 使用场景及目标:① 掌握多种改进粒子群算法的核心思想实现机制;② 理解深度神经网络在边缘-云协同环境下的任务卸载建模方法;③ 学习如何通过仿真实验对比不同启发式算法的性能差异,并根据实际需求选择最优算法方案; 阅读建议:建议结合提供的Matlab代码实现进行动手实践,重点关注算法参数调优、适应度函数设计及实验结果可视化分析过程,以深入理解算法行为系统性能之间的内在关联。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值