
Claude模型的老问题与新升级
Claude模型存在两个老问题,一是爱封号,二是贵。在过去一周,很多Claude用户已见识到频繁封号的情况,社交平台上关于Anthropic风控的讨论众多,传闻细节有待核实,但频繁封号已是不争事实。至于价格贵的问题,Anthropic给出了新答案。刚刚,Claude Sonnet 5正式发布,按照官方说法,Sonnet 5是目前最具agent能力的Sonnet模型,可制定计划、调用工具并自主执行。从产品定位看,Anthropic想把Opus高端模型的能力下放到Sonnet产品线上,此次升级核心是重新权衡「好用」与「用得起」的关系。
Sonnet 5:便宜版Opus?
在Claude产品线里,中杯Sonnet是走向开发者社区的关键入口。过去一年,Anthropic能力提升集中在Opus高端模型上,Opus更强更贵,Sonnet与Opus在复杂任务等方面的差距逐渐拉开。Sonnet 5要解决这一落差难题,Anthropic称其在多方面相比Sonnet 4.6有明显提升,整体能力接近Opus 4.8但价格更低。官方定位明确,Opus 4.8适合追求更高准确率的任务,Sonnet 5提供成本更低、能力接近高端模型的选择。不过,Sonnet 5使用了更新后的tokenizer,开发者不能只看标价,还要考虑真实任务里的token消耗等。从价格看,Anthropic给出首发窗口期,即日起到2026年8月31日有优惠价格,9月1日后恢复标准价格。相比Opus 4.8,差价是让开发者从Opus试验转向Sonnet规模化部署的关键。对普通用户来说,Claude Sonnet 5从今天起面向所有套餐开放,也进入Claude Code和Claude Platform,开发者可通过claude - sonnet - 5调用。
Sonnet 5的安全性能
安全是Anthropic此次发布的重点。官方称Sonnet 5相比Sonnet 4.6更擅长拒绝恶意请求、抵抗prompt injection攻击,幻觉和迎合倾向更低,不良行为率低于Sonnet 4.6但高于Opus 4.8和Claude Mythos Preview。在网络安全能力方面,Anthropic未专门训练Sonnet 5做高风险网络安全任务,它能完成常规无害工作,但在危险能力评测中弱于Opus 4.8和Mythos 5。以Firefox 147漏洞利用评测为例,Sonnet 5只是部分成功率略高于Sonnet 4.6。因此,Sonnet 5默认启用网络安全防护机制,防护强度低于Fable 5。
Claude Science:面向科学研究场景
同一天,Anthropic还发布了Claude Science,它瞄准科学研究场景,是面向科学家的AI workbench,可整合研究人员日常使用的工具、数据库等。科学研究有大量琐碎工作,Claude Science想把分散工具整合起来,让科学家在一个会话里完成多项任务。其生成的结果带有可审计历史,能原生渲染科学对象,支持用自然语言修改图表。在算力层面,它可连接多种设备和调用按需算力,数据可留在实验室已有基础设施上。Anthropic为其预置了60多个科学技能和连接器,可连接多个数据库和使用相关模型库。UCSF Brain Tumor Center的Stephen Francis用它加速胶质瘤分子流行病学研究,部分分析时间被压缩到原来的十分之一左右。目前,Claude Science已以beta形式开放给部分用户,Anthropic还会支持相关项目并提供credits,Modal也会提供算力支持,申请截止到2026年7月15日。
Anthropic的IPO考量与Claude的用户处境
Sonnet 5和Claude Science分别面向开发者和企业生产流程、科研等相关研究,最终目标是让Anthropic证明Claude可进入更专业、付费意愿更强的工作场景。恰逢Anthropic的IPO故事逐步清晰,6月初已秘密提交IPO招股书草案。今年2月和5月底,Anthropic完成高额融资,市场对其期待很高,同时市场消息称其收入运行率已突破470亿美元。对Anthropic来说,IPO叙事不能只停留在Claude很强,投资人更关心强模型能否变成稳定收入等问题。Claude Science将问题推向更专业场景。而Claude的用户处境尴尬,它好用但未到无脑依赖的程度,昂贵又未到让人彻底放弃的地步,且用户沉淀了很多数据。但Anthropic的封号等操作让用户难以接受,所谓「负责任的AI」难以靠安全系统卡解释,Claude让人看到AI能力上限的同时,平台下限也同样重要。

36

被折叠的 条评论
为什么被折叠?



