9月29日消息,Anthropic发布Claude Sonnet 5.5。新模型的API价格与上一版相同,每百万输入token收费2美元、输出10美元;公司称它生成答案的速度提高30%以上,完成同类任务所需token更少,在内部测试中单项任务成本最多降低30%。
据Anthropic介绍,新模型更常把多次工具调用合并到同一步,减少执行步骤。完成同类任务时,它通常也消耗更少的token,实际费用因而有望降低。
Sonnet 5.5主要面向日常编程和知识工作,可以改代码、修Bug,也能做文档、幻灯片和表格。按照Anthropic的产品定位,开发者可以把要求明确的任务交给Sonnet;需要持续判断的复杂、开放式任务,则更适合一周前发布的Opus 5.5。
在取材于Cursor真实会话、要求跨文件修改代码的CursorBench 4.0中,Sonnet 5.5在最高推理强度(Max)下得分55.5%,上一版为34.1%,Opus 5.5为57.8%。Sonnet在这项测试中的最好成绩,已接近Opus。
Anthropic公布的客户反馈中,Slack称,在没有修改提示词的离线测试中,新模型完成任务所用步骤更少,输出token约减少14%。Zendesk则用数百个真实客服案例测试,称处理工单的速度比它现用的Claude模型快了20%。
Sonnet 5.5现已进入Claude应用、Claude Code及API,也通过主要云平台提供。Anthropic还计划在未来几周推出面向高调用量任务的Haiku 5.5。Claude Code和应用默认使用中等推理强度(Medium),开发平台默认为高档(High)。提高推理强度后,模型会花更多时间思考和检查结果,token用量也会增加。
责任编辑:kj005
近日,中国化学工程十三化建承建的哈萨克斯坦Silleno聚乙烯项目顺利完成常温罐底板大体积混凝土一次性浇筑,为项目后续土建及设备安装施工打下坚实基础该节点施工体...
9月28日,由中国五金制品协会、中国国际贸易促进委员会轻工行业分会与德国科隆国际展览有限公司联合主办的2026中国国际五金展(CIHS)在上海新国际博览中心开幕...
围绕采购需求、技术应用与项目合作开展专业商贸配对,是2026 TCT深圳展公布的一项现场安排本届展会将于10月14日至16日在深圳国际会展中心(宝安)15号馆举...
一扇门,守的是一个家几分钟,是大多数普通防盗门在熟练锁匠面前的极限不久前在中国永康,王力安防发起了一场“最长时间技术性开锁”吉尼斯挑战把...