据 meiguo.com 于 2026 年 9 月 8 日收到的消息 ‣ OpenAI 于 9 月 3 日正式发布新模型 GPT-6 Astra。据 Axios 报道,OpenAI 总裁 Greg Brockman 在媒体简报会上宣称“欢迎来到 AGI 时代”。英伟达首席执行官黄仁勋随后在社交平台 X 上祝贺并表示“AGI 已经到来”。更早前,马斯克在讨论 Astra 内部版本科研能力时也曾发文“欢迎来到奇点”。负责 ARC 系列评测的 ARC Prize 机构创始人 Greg Kamradt 则在分析中指出,Astra 表现出了前沿模型能力的明显跃升。

此次引发广泛关注的核心在于 Astra 在 ARC-AGI-3 测试中取得的成绩。该测试类似一组没有说明书的陌生小游戏,要求系统自主摸索规则并完成目标,考察的是“碰到新东西能不能自己学会” 的能力。Astra 在厂商适配环境下取得了 99.9% 的近乎满分成绩,该环境支持跨请求保留内部推理状态并压缩整理长上下文,使模型能更充分地接着之前的工作继续推进。这标志着 AI 在陌生环境中自主学习和解决问题的能力有了显著增强。
关于 AGI(通用人工智能)的定义,业界主要有三种视角:OpenAI 侧重工作能力,即在大多数有经济价值的工作上超越人类;Google DeepMind 强调能力的广度与深度;ARC 提出者 François Chollet 则关注学习效率,即面对新问题需要多少经验才能掌握新技能。Astra 的突破主要回应了第三种视角,展示了更强的“现场学习”能力。
然而,从测试走向实际工作仍存差距。ARC Prize 公布的数据显示,Astra 在标准运行环境下的最佳成绩为 62.7%,与适配环境下的 99.9% 存在显著差距。这提示评价 AI 需将模型与运行方式结合考量。ARC Prize 明确表示,刷满测试不等于实现 AGI,测试环境规则目标相对封闭,而现实任务往往目标模糊、约束冲突、周期漫长,要求 AI 能澄清需求、发现失策、长程记忆并迁移经验。
综上所述,Astra 展示了令人振奋的“在陌生环境中摸索规则并完成目标”能力,为 AGI 讨论提供了具体证据。但按广泛工作能力标准看,目前证据尚不足以确认其已实现 AGI。未来需在更多实际任务中验证其能否持续减少人工介入并交出可靠结果,通用人工智能的到来仍需更扎实的实践检验。
综合自网络信息