💡 今日趋势速览:OpenAI扩大GPT Astra内测范围,代号mozaik-alpha-fdm,发布信号渐强。官方为Codex和ChatGPT Work付费用户重置用量,额度最多提升50%。OrcaRouter发布GLM-5.3-Flash无审查权重,320B参数采用原始FP8精度。大模型开源与商业化齐头并进,竞争持续升温。
🎯 今日要点
- GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm
- Codex 与 ChatGPT Work 付费用户将获用量重置
- OrcaRouter 发布 GLM-5.3-Flash 无审查权重
📋 今日内容汇总
🤖 AI动态
- GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm
- Codex 与 ChatGPT Work 付费用户将获用量重置
- OrcaRouter 发布 GLM-5.3-Flash 无审查权重
- NVIDIA 发布 DeepSeek V4 Pro NVFP4 四比特量化版
- OpenAI 宣布终止与 Cursor 合作,11 月 12 日切断直连
- Anthropic 称将继续支持 Cursor 中的 Claude 模型
- ChatGPT 周更新:免费用户可用定时任务与贴纸功能
- Anthropic 发布 MHS 硬件标准,让 Claude 直接操控实验设备
- Claude 付费方案周额度 9 月 14 日起永久提升 25%
- Anthropic 周额度永久加 25% 被指实为变相降额
- Claude Code 周更:CLI 启动提速与用量可视化增强
- Grok Bot 开放 Android 版预注册
- 腾讯混元将 Hy4-preview 压缩到约 200GiB 的 GGUF 格式
- OpenAI 联合百家公司警告 AI 网络攻击逼近临界点
🧪 芯片半导体
🦾 机器人具身智能
📌 模型排行榜
🤖 AI动态
爆料称OpenAI已扩大GPT Astra的内部测试范围,代号mozaik-alpha-fdm,被视为发布临近的信号。此外,首批公开输出为零样本zero-shot、Max强度下的结果,显示前端问题可能已修复,模型对细节的关注度很高;该模型可能很快发布,预计在9月第一周左右。


🔗 https://x.com/Lentils80/status/2093617080327127456
官方宣布为所有 Codex 和 ChatGPT Work 付费用户重置用量,并称团队昼夜处理了数千份用量报告、发布多项修复,按使用方式不同,用量可比之前多 10% 到 50%。排查中还发现并修复了压缩(Compaction)等多个长期存在的问题。

🔗 https://x.com/thsottiaux/status/2093801758665715784
OrcaRouter发布了GLM-5.3-Flash的无审查权重,参数为320B、18B激活,直接采用原始block-FP8精度。该模型无需LoRA或越狱提示词,拒绝机制的移除已直接融入权重中。评测显示MaliciousInstruct拒绝率从96%降至11%,智谱可能构建了更深层的拒绝机制。



🔗 https://x.com/OrcaRouter/status/2093612518396871075
NVIDIA 在 Hugging Face 上发布了 DeepSeek V4 Pro 的 NVFP4 四比特量化版本。官方介绍,该量化版本在推理和智能体基准测试中可保持 99% 以上的准确率,同时大幅降低模型在 Blackwell B200 上运行推理时的内存占用,兼顾精度与效率。

🔗 https://x.com/HuggingPapers/status/2093507791419736235
OpenAI 官方宣布,因 Cursor 被 SpaceX 收购,将结束双方合作;按其方案,Cursor 直接访问 OpenAI 模型的权限将于 11 月 12 日终止。OpenAI 表示最受影响的是依赖其模型的 Cursor 开发者,称关心他们在过渡期的体验,并准备全力提供支持。

🔗 https://x.com/OpenAI/status/2093515564786540695
6. Anthropic 称将继续支持 Cursor 中的 Claude 模型
来源:原文 | NotTomBrown
与OpenAI相反,Cursor 自 Sonnet 3.5 时代起就一直是 Anthropic 值得信赖的合作伙伴,双方合作多年;未来 Anthropic 将继续增加算力,以支持 Cursor 中的 Claude 模型,并对他们在 SpaceX 的未来充满期待。

🔗 https://x.com/NotTomBrown/status/2093541294027280657
7. ChatGPT 周更新:免费用户可用定时任务与贴纸功能
来源:原文 | Max For AI (Twitter)
ChatGPT 团队发布本周(8 月 28 日)功能更新:一是定时任务向免费用户开放,任何人都可创建周期性任务,例如每周四询问周末附近的活动;二是贴纸功能,可利用图像生成把任意照片做成贴纸包,分享到 iMessage 或 WhatsApp。以下是官方给出的 demo

🔗 https://x.com/adamhfry/status/2093467062995918992
Anthropic发布MHS硬件标准研究预览,启动第一阶段研究。这项标准让Claude能统一调度指令,直接操控机械臂、移液仪、显微镜等设备。实测中Claude调试QuEra量子计算机激光系统,稳定率达99.3%,高于人类专家的58%;但MHS局限是缺乏物理直觉,且只能接管带编程接口的设备。


🔗 https://hub.baai.ac.cn/view/57525
9. Claude 付费方案周额度 9 月 14 日起永久提升 25%
来源:原文 | ClaudeDevs
Anthropic 宣布,自 9 月 14 日起,Pro、Max、Team 以及按席位计费的企业版方案的每周标准额度将永久提升 25%;在此之前的 9 月 13 日,现行的 50% 临时提升额度政策继续有效。

🔗 https://x.com/ClaudeDevs/status/2093742321473065266
接上条新闻,Anthropic 宣布 9 月 14 日后每周额度永久提升 25%,有博主指出这实为变相降额:现行 50% 临时提升结束后,额度相当于从 150 降到 125,官方却称之为令人振奋的改进,引发用户对文案包装的批评,认为周限额实际缩减约 17%。

🔗 https://x.com/MaxForAI/status/2093786277242151136
Anthropic 表示正根据用户反馈持续为 Claude Code 推送改进。本周更新包括:加快 CLI 启动速度,增加 token 用途的更多可视化信息,让自动模式规则更易于查看和编辑,并推送了更多远程控制方面的修复。

🔗 https://x.com/ClaudeDevs/status/2093480630801858750
Grok Bot 智能体自发布以来已可在 iOS 下载,Android 版此前一直没有消息,如今终于开启预注册。完成预注册的用户可获得提前体验资格,并在应用面向所有设备正式上线时收到通知。发帖者认为,对 X Premium+ 套餐的 iOS 用户来说现在正是好时机。

🔗 https://x.com/vikktorrrre/status/2093645916565610922
腾讯混元将 Hy4-preview 从 1.5TB 压缩到约 200GiB 的 GGUF 格式,并称效果依然很好。其 MIX-STQ1_0 方案用校准数据为每一层选择比特宽度:低至 1.31-bit STQ1_0,高至 2.06-bit IQ2_XXS,同等预算下误差更低;与 BF16 相比准确率几乎没有变化。



🔗 https://x.com/TencentHunyuan/status/2093572224342954019
OpenAI 联合 Google、Microsoft、AWS、Cloudflare、CrowdStrike、Cisco、Visa、Mastercard 等 100 多家公司发布公开信,警告随着 AI 能力持续提升,AI 驱动的网络攻击正快速逼近临界点,留给防守方加固网络安全的时间可能只剩几个月,并把当前阶段称为 Defender’s Window。


🔗 https://x.com/MaxForAI/status/2093784561578807344
🧪 芯片半导体
15. 小米 18 Fold 将首发长鑫 LPDDR6,9 月发布
来源:原文 | Nokiapoweruser
据路透社报道,小米与长鑫存储表示,小米 18 Fold 折叠屏手机将首发搭载长鑫存储的 LPDDR6 DRAM 内存芯片,同时配备小米自研的 3nm 玄戒 O3 SoC,新机预计于 9 月正式发布。

🔗 https://x.com/Techmeme/status/2093573286609498175
🦾 机器人具身智能
最新演示视频显示,马斯克旗下 Optimus 人形机器人已进入完整家庭场景,目标不只是搬箱子、拧螺丝,而是做饭、收拾房间、端东西、照顾家庭等更复杂的日常任务。官方判断称,Optimus 很快就能完成视频里的这些工作,甚至更多。以下是官方给出的 demo

🔗 https://x.com/MaxForAI/status/2093792867131212282
📌 模型排行榜
最后是今日的 AI 模型能力排行榜单,智力榜头部由Claude Opus 5以63分领跑,智能体榜上,Claude Opus 5、GLM-5.3与Grok 4.6同以59分并列第一。国产阵营表现亮眼,GLM-5.3在智能体榜以59分与榜首并列第一,智力榜亦以60分位列第六;


🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。


被折叠的 条评论
为什么被折叠?



