GPT Astra 内测扩大!Codex 用量重置,GLM-5.3-Flash 无审查权重炸场 | 8月30日 AI日报

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

💡 今日趋势速览:OpenAI扩大GPT Astra内测范围,代号mozaik-alpha-fdm,发布信号渐强。官方为Codex和ChatGPT Work付费用户重置用量,额度最多提升50%。OrcaRouter发布GLM-5.3-Flash无审查权重,320B参数采用原始FP8精度。大模型开源与商业化齐头并进,竞争持续升温。

🎯 今日要点

  1. GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm
  2. Codex 与 ChatGPT Work 付费用户将获用量重置
  3. OrcaRouter 发布 GLM-5.3-Flash 无审查权重

📋 今日内容汇总

🤖 AI动态

  1. GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm
  2. Codex 与 ChatGPT Work 付费用户将获用量重置
  3. OrcaRouter 发布 GLM-5.3-Flash 无审查权重
  4. NVIDIA 发布 DeepSeek V4 Pro NVFP4 四比特量化版
  5. OpenAI 宣布终止与 Cursor 合作,11 月 12 日切断直连
  6. Anthropic 称将继续支持 Cursor 中的 Claude 模型
  7. ChatGPT 周更新:免费用户可用定时任务与贴纸功能
  8. Anthropic 发布 MHS 硬件标准,让 Claude 直接操控实验设备
  9. Claude 付费方案周额度 9 月 14 日起永久提升 25%
  10. Anthropic 周额度永久加 25% 被指实为变相降额
  11. Claude Code 周更:CLI 启动提速与用量可视化增强
  12. Grok Bot 开放 Android 版预注册
  13. 腾讯混元将 Hy4-preview 压缩到约 200GiB 的 GGUF 格式
  14. OpenAI 联合百家公司警告 AI 网络攻击逼近临界点

🧪 芯片半导体

  1. 小米 18 Fold 将首发长鑫 LPDDR6,9 月发布

🦾 机器人具身智能

  1. Optimus 家庭场景演示:目标覆盖做饭与家务

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm

来源:原文 | Lentils80

爆料称OpenAI已扩大GPT Astra的内部测试范围,代号mozaik-alpha-fdm,被视为发布临近的信号。此外,首批公开输出为零样本zero-shot、Max强度下的结果,显示前端问题可能已修复,模型对细节的关注度很高;该模型可能很快发布,预计在9月第一周左右。

GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm

GPT Astra 内测范围扩大,代号 mozaik-alpha-fdm

🔗 https://x.com/Lentils80/status/2093617080327127456


2. Codex 与 ChatGPT Work 付费用户将获用量重置

官方宣布为所有 Codex 和 ChatGPT Work 付费用户重置用量,并称团队昼夜处理了数千份用量报告、发布多项修复,按使用方式不同,用量可比之前多 10% 到 50%。排查中还发现并修复了压缩(Compaction)等多个长期存在的问题。

Codex 与 ChatGPT Work 付费用户将获用量重置

🔗 https://x.com/thsottiaux/status/2093801758665715784


3. OrcaRouter 发布 GLM-5.3-Flash 无审查权重

OrcaRouter发布了GLM-5.3-Flash的无审查权重,参数为320B、18B激活,直接采用原始block-FP8精度。该模型无需LoRA或越狱提示词,拒绝机制的移除已直接融入权重中。评测显示MaliciousInstruct拒绝率从96%降至11%,智谱可能构建了更深层的拒绝机制。

OrcaRouter 发布 GLM-5.3-Flash 无审查权重

OrcaRouter 发布 GLM-5.3-Flash 无审查权重

OrcaRouter 发布 GLM-5.3-Flash 无审查权重

🔗 https://x.com/OrcaRouter/status/2093612518396871075


4. NVIDIA 发布 DeepSeek V4 Pro NVFP4 四比特量化版

来源:原文 | Hugging Papers (Twitter)

NVIDIA 在 Hugging Face 上发布了 DeepSeek V4 Pro 的 NVFP4 四比特量化版本。官方介绍,该量化版本在推理和智能体基准测试中可保持 99% 以上的准确率,同时大幅降低模型在 Blackwell B200 上运行推理时的内存占用,兼顾精度与效率。

NVIDIA 发布 DeepSeek V4 Pro NVFP4 四比特量化版

🔗 https://x.com/HuggingPapers/status/2093507791419736235


5. OpenAI 宣布终止与 Cursor 合作,11 月 12 日切断直连

来源:原文 | OpenAI

OpenAI 官方宣布,因 Cursor 被 SpaceX 收购,将结束双方合作;按其方案,Cursor 直接访问 OpenAI 模型的权限将于 11 月 12 日终止。OpenAI 表示最受影响的是依赖其模型的 Cursor 开发者,称关心他们在过渡期的体验,并准备全力提供支持。

OpenAI 宣布终止与 Cursor 合作,11 月 12 日切断直连

🔗 https://x.com/OpenAI/status/2093515564786540695


6. Anthropic 称将继续支持 Cursor 中的 Claude 模型

来源:原文 | NotTomBrown

与OpenAI相反,Cursor 自 Sonnet 3.5 时代起就一直是 Anthropic 值得信赖的合作伙伴,双方合作多年;未来 Anthropic 将继续增加算力,以支持 Cursor 中的 Claude 模型,并对他们在 SpaceX 的未来充满期待。

Anthropic 称将继续支持 Cursor 中的 Claude 模型

🔗 https://x.com/NotTomBrown/status/2093541294027280657


7. ChatGPT 周更新:免费用户可用定时任务与贴纸功能

来源:原文 | Max For AI (Twitter)

ChatGPT 团队发布本周(8 月 28 日)功能更新:一是定时任务向免费用户开放,任何人都可创建周期性任务,例如每周四询问周末附近的活动;二是贴纸功能,可利用图像生成把任意照片做成贴纸包,分享到 iMessage 或 WhatsApp。以下是官方给出的 demo

ChatGPT 周更新:免费用户可用定时任务与贴纸功能

🔗 https://x.com/adamhfry/status/2093467062995918992


8. Anthropic 发布 MHS 硬件标准,让 Claude 直接操控实验设备

Anthropic发布MHS硬件标准研究预览,启动第一阶段研究。这项标准让Claude能统一调度指令,直接操控机械臂、移液仪、显微镜等设备。实测中Claude调试QuEra量子计算机激光系统,稳定率达99.3%,高于人类专家的58%;但MHS局限是缺乏物理直觉,且只能接管带编程接口的设备。

Anthropic 发布 MHS 硬件标准,让 Claude 直接操控实验设备

Anthropic 发布 MHS 硬件标准,让 Claude 直接操控实验设备

🔗 https://hub.baai.ac.cn/view/57525


9. Claude 付费方案周额度 9 月 14 日起永久提升 25%

来源:原文 | ClaudeDevs

Anthropic 宣布,自 9 月 14 日起,Pro、Max、Team 以及按席位计费的企业版方案的每周标准额度将永久提升 25%;在此之前的 9 月 13 日,现行的 50% 临时提升额度政策继续有效。

Claude 付费方案周额度 9 月 14 日起永久提升 25%

🔗 https://x.com/ClaudeDevs/status/2093742321473065266


10. Anthropic 周额度永久加 25% 被指实为变相降额

接上条新闻,Anthropic 宣布 9 月 14 日后每周额度永久提升 25%,有博主指出这实为变相降额:现行 50% 临时提升结束后,额度相当于从 150 降到 125,官方却称之为令人振奋的改进,引发用户对文案包装的批评,认为周限额实际缩减约 17%。

Anthropic 周额度永久加 25% 被指实为变相降额

🔗 https://x.com/MaxForAI/status/2093786277242151136


11. Claude Code 周更:CLI 启动提速与用量可视化增强

来源:原文 | TestingCatalog (Twitter)

Anthropic 表示正根据用户反馈持续为 Claude Code 推送改进。本周更新包括:加快 CLI 启动速度,增加 token 用途的更多可视化信息,让自动模式规则更易于查看和编辑,并推送了更多远程控制方面的修复。

Claude Code 周更:CLI 启动提速与用量可视化增强

🔗 https://x.com/ClaudeDevs/status/2093480630801858750


12. Grok Bot 开放 Android 版预注册

Grok Bot 智能体自发布以来已可在 iOS 下载,Android 版此前一直没有消息,如今终于开启预注册。完成预注册的用户可获得提前体验资格,并在应用面向所有设备正式上线时收到通知。发帖者认为,对 X Premium+ 套餐的 iOS 用户来说现在正是好时机。

Grok Bot 开放 Android 版预注册

🔗 https://x.com/vikktorrrre/status/2093645916565610922


13. 腾讯混元将 Hy4-preview 压缩到约 200GiB 的 GGUF 格式

腾讯混元将 Hy4-preview 从 1.5TB 压缩到约 200GiB 的 GGUF 格式,并称效果依然很好。其 MIX-STQ1_0 方案用校准数据为每一层选择比特宽度:低至 1.31-bit STQ1_0,高至 2.06-bit IQ2_XXS,同等预算下误差更低;与 BF16 相比准确率几乎没有变化。

腾讯混元将 Hy4-preview 压缩到约 200GiB 的 GGUF 格式

腾讯混元将 Hy4-preview 压缩到约 200GiB 的 GGUF 格式

腾讯混元将 Hy4-preview 压缩到约 200GiB 的 GGUF 格式

🔗 https://x.com/TencentHunyuan/status/2093572224342954019


14. OpenAI 联合百家公司警告 AI 网络攻击逼近临界点

OpenAI 联合 Google、Microsoft、AWS、Cloudflare、CrowdStrike、Cisco、Visa、Mastercard 等 100 多家公司发布公开信,警告随着 AI 能力持续提升,AI 驱动的网络攻击正快速逼近临界点,留给防守方加固网络安全的时间可能只剩几个月,并把当前阶段称为 Defender’s Window。

OpenAI 联合百家公司警告 AI 网络攻击逼近临界点

OpenAI 联合百家公司警告 AI 网络攻击逼近临界点

🔗 https://x.com/MaxForAI/status/2093784561578807344


🧪 芯片半导体

15. 小米 18 Fold 将首发长鑫 LPDDR6,9 月发布

来源:原文 | Nokiapoweruser

据路透社报道,小米与长鑫存储表示,小米 18 Fold 折叠屏手机将首发搭载长鑫存储的 LPDDR6 DRAM 内存芯片,同时配备小米自研的 3nm 玄戒 O3 SoC,新机预计于 9 月正式发布。

小米 18 Fold 将首发长鑫 LPDDR6,9 月发布

🔗 https://x.com/Techmeme/status/2093573286609498175


🦾 机器人具身智能

16. Optimus 家庭场景演示:目标覆盖做饭与家务

最新演示视频显示,马斯克旗下 Optimus 人形机器人已进入完整家庭场景,目标不只是搬箱子、拧螺丝,而是做饭、收拾房间、端东西、照顾家庭等更复杂的日常任务。官方判断称,Optimus 很快就能完成视频里的这些工作,甚至更多。以下是官方给出的 demo

Optimus 家庭场景演示:目标覆盖做饭与家务

🔗 https://x.com/MaxForAI/status/2093792867131212282


📌 模型排行榜

17. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜头部由Claude Opus 5以63分领跑,智能体榜上,Claude Opus 5、GLM-5.3与Grok 4.6同以59分并列第一。国产阵营表现亮眼,GLM-5.3在智能体榜以59分与榜首并列第一,智力榜亦以60分位列第六;

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

内容概要:本文围绕基于CNN-BiLSTM-Attention混合神经网络模型的电力负荷预测展开研究,提出一种结合卷积神经网络(CNN)、双向长短期记忆网络(BiLSTM)与注意力机制(Attention)的深度学习框架,并通过Python代码实现高精度的短期与超短期负荷预测。该模型充分利用CNN对局部特征的提取能力,捕捉负荷数据中的周期性与趋势性模式;借助BiLSTM对时间序列前后向依赖关系的建模能力,增强对动态变化的感知;并通过Attention机制自适应地聚焦关键历史时刻,提升预测准确性。文中详细阐述了数据预处理、模型结构设计、训练流程及超参数调优方法,并在真实负荷数据集上进行了实验验证,结果表明该混合模型相比传统单一模型和其他基准模型具有更优的预测性能,尤其在应对非线性、非平稳负荷波动方面表现突出。; 适合人群:具备一定Python编程能力和机器学习基础,从事电力系统分析、能源管理、智能电网或时序预测相关工作的科研人员、工程师及高校研究生。; 使用景及目标:①应用于电网调度、电力市出清、需求响应管理等景下的精细化负荷预测;②为研究人员提供一套完整的、可复现的深度学习负荷预测代码框架,推动AI技术在能源领域的落地应用;③帮助理解CNN、BiLSTM与Attention模块之间的协同机制及其在时序建模中的集成方式。; 阅读建议:建议读者结合所提供的Python代码进行动手实践,重点掌握数据归一化、滑动窗口构造、模型搭建与训练技巧,并尝试在不同地区、不同季节的负荷数据上进行迁移测试,以深入理解模型泛化能力与调参策略。
内容概要:本文围绕“MATLAB具有储能的经济调度及机会约束和鲁棒优化”展开,系统研究了电力系统中融合储能技术的经济调度问题,重点探讨了机会约束规划与鲁棒优化方法在应对新能源出力不确定性、负荷波动及系统运行风险中的应用。内容涵盖风光储协同调度、多微网共享储能、电动汽车参与调度、低碳经济调度等多种典型景,深入分析了储能的选址定容、功率协调控制、状态估计与优化调度模型。核心技术包括粒子群优化(PSO)、分布鲁棒机会约束(DRCC)、模型预测控制(MPC)、鲁棒优化、二阶锥规划(SOCP)等先进算法,并提供了基于Matlab/Simulink的完整仿真代码实现,旨在提升新型电力系统的运行灵活性、经济性与抗风险能力。; 适合人群:具备电力系统、自动化、电气工程或相关专业背景,熟悉Matlab/Simulink仿真环境与基本优化算法,从事新能源并网、微电网运行、储能系统规划、电力市调度等领域的研究生、科研人员及工程技术人员。; 使用景及目标:① 学习并构建含储能的电力系统经济调度优化模型;② 掌握机会约束与鲁棒优化在处理新能源不确定性问题中的建模思路与求解方法;③ 利用提供的Matlab代码进行算法复现、仿真验证与性能对比,支撑科研项目攻关;④ 为撰写高水平学术论文、学位论文或工程优化方案提供可靠的模型参考与代码支持。; 阅读建议:建议读者结合文档中具体的案例(如风电-水电联合调度、电动汽车集群调度、多微网共享储能等)和配套的Matlab代码进行动手实践,重点关注优化模型的构建逻辑、约束条件设定与求解器配置过程,同时可关注公众号“荔枝科研社”获取完整资源包、复现教程及持续的技术支持。
打开链接下载源码: https://pan.quark.cn/s/d8b35376d2e3 深度学习不确定性量化近年来已成为人工智能研究中的一个关键议题,特别是在优化过程和决策制定中的应用正变得越来越关键。文章《深度学习不确定性量化:技术、应用与挑战》详细研究了这一议题,其目的在于归纳当前已有的方法,审视其在不同景下的应用情况,并明确当前面临的难题以及未来的探索方向。不确定性量化(UQ)的主要宗旨在于对模型的不确定程度及其预测结果的可信度进行评估,这对于防止决策失误和增强系统稳定性具有决定性作用。在深度学习模型中,由于模型结构的复杂性以及训练数据的限制,模型可能表现出高度的不确定性,这使得UQ成为深度学习不可或缺的一部分。 在不确定性量化的方法论层面,文章指出了两种主要技术路径:贝叶斯近似方法和集成学习方法。贝叶斯近似通过构建概率模型来推断模型参数的后验分布,以此方式捕捉模型内在的不确定性;而集成学习则通过组合多个模型的预测结果来减少单一模型的不确定性。这些技术已在包括计算机视觉(涵盖自动驾驶和物体识别)、图像处理(比如图像修复)、医疗影像分析(涉及医学影像的归类和分割)、自然语言处理(如文本归类和风险评估)、生物信息学等多个领域展现出广泛的应用前景。 在强化学习(RL)的框架内,不确定性量化同样扮演着重要角色。在非静态环境中,智能体需要评估其行为决策所带来的不确定性,从而做出更为合理的行动选择。不确定性量化技术能够提供关于奖励机制和环境状态的不确定性评估,进而帮助智能体更有效地探索环境并优化其学习策略。 尽管深度学习中的不确定性量化取得了长足的发展,但仍存在若干核心难题。例如,如何高效地评估大型神经网络的不确定性,特别是在计算资源受限的情况下;如何将不确定性量化...
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值