凌晨一点,你盯着API账单发呆。上个月跑了个Agent流水线,多轮工具调用加上中间态存储,Token消耗量直接翻了三倍。然后你刷到一条新闻:OpenAI总裁Greg Brockman在GPT-6 Astra发布会上说了一句话——“按Token定价已无意义”,未来行业应该比的是“每任务成本”。
这句话乍听像营销话术,但仔细想想,它可能戳中了一个所有靠API吃饭的开发者都在焦虑的问题。
Token单价跌破了1美元,但你的账单没降
先说一个数字。数据服务商SiliconData的大语言模型Token支出指数,本周跌到了0.97美元/百万Token,首次跌破1美元关口。这个指数按实际成交量加权计算全球主流模型价格,被业内当作风向标。对比一下,5月底还是2.04美元,现在不到半年腰斩。
但这跟你感受到的成本下降之间,隔着一道鸿沟。原因很简单——你的调用量也在暴涨。
智谱MaaS平台截至8月底用户超740万,Token调用量较年初增长超40倍。OpenRouter周Token消耗量突破93.4万亿,首次越过90万亿关口。单价腰斩,用量翻几番,总账单不降反升。
更要命的是,如果你跑的是Agent场景,多轮工具调用、重试、死循环,每个环节都在烧Token。DeepSeek峰谷分时计费上线后,工作日高峰时段输出价27元/百万Token,低谷13.5元。把批量任务挪到周末确实能省一半,但实时Agent跑在白天高峰段,成本反而比8月前的统一定价涨了125%。
单价跌了,总价没跌。 这就是Brockman那句话的现实背景。
GPT-6 Astra的定价逻辑:贵的是Token,省的是步骤
回到Astra本身。标准定价是每百万输入Token10美元、输出50美元。对比一下:Meta的Muse Spark 1.3标准价才1.25/4.25美元,谷歌Gemini 3.8 Flash更低,0.75/3.75美元。Astra贵了差不多一个数量级。
但OpenAI的说法是:Astra能用更少的Token完成同样的任务。据称在DeepSWE编码测试中,Astra完成任务成本降低了57%,相当于用约四分之一的Token就能完成同样的工作。
这笔账怎么算?假设你原来跑10轮迭代、每轮消耗1万Token,现在跑5轮、每轮还是1万Token,Token总量减半。哪怕单价贵3倍,总成本也可能是降的。这就是Brockman所说的“每任务成本”——不看你单价多少,看你完成一个任务总共花了多少钱。
计费模式的岔路口
把最近几天的新闻串起来看,整个行业正站在计费模式的岔路口上。
一边是OpenAI在拉高单价的同时对“每任务成本”叙事下注,另一边是中国模型把Token单价压到地板。Meta更激进——Muse Spark 1.3的Contributor层直接把价格砍到0.10/0.20美元,降幅95%,代价是让Meta拿你的提示词和输出做训练数据。
这些信号拼在一起,指向一个趋势:单纯比Token单价已经没有意义了。未来的比拼,要么是“每任务成本”,要么是“每单位智能的价格”。
你需要的是能跟上这个变化的基础设施
对独立开发者来说,这意味着选模型的思路要变了。不再是谁单价低就用谁,而是你的具体任务场景里,谁能在更少的Token、更少的步骤里交付更好的结果。
你需要同时管理多个模型供应商,做A/B测试,根据任务类型路由到不同模型。这件事的复杂度远超比价——你需要在多个供应商之间灵活切换,处理不同的API格式、计费规则、缓存策略。
EasyAPI做的恰好就是这件事——把不同供应商的Token定价、缓存规则、峰谷时段拉平到同一个面板下,一个Key接入所有主流模型,切换只改配置不碰业务代码。按任务挑模型,按效果算成本,而不是锁死在某一家的价目表上。

计费模式本身在变天,你需要的是能跟上这个变化的基础设施。

807

被折叠的 条评论
为什么被折叠?



