拓十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Claude深夜炸场!Sonnet 5.5发布,读财报、数据分析,金融能力超强

Claude深夜炸场!Sonnet 5.5发布,读财报、数据分析,金融能力超强

今天凌晨2点,Anthropic又发布了最新模型Claude Sonnet 5.5。

相比之前的Sonnet 5,成本、运行效率提升了30%以上,同时在金融、代码、日常办公方面能力大涨。

简单来说,Sonnet 5.5拥有接近旗舰模型Opus5.5的能力,但价格全部给打下来了。

性能暴涨,部分能力追平旗舰

这次最让人意外的,就是Sonnet 5.5的性能提升幅度,简直是跨越式升级。

在业内权威的智能体编码测试中,上代Sonnet 5只能拿到10.3%的成绩,而全新的Sonnet 5.5直接冲到70.6%,翻了将近6倍。

甚至在部分编码场景里,分数还超过了旗舰Opus5.5。

覆盖44个职业、九大行业的真实职场任务测试里,它的成绩仅仅比顶配旗舰低2分,基本可以做到无限接近旗舰水平。

网上很火的一个测试细节也特别有意思,它是首个仅凭游戏截图,就能独立通关宝可梦红的Sonnet模型。足以证明它的图像识别、长流程任务把控能力,已经做到非常成熟。

协作体验优化得也很好。输出的文字逻辑更通顺、表达更自然,迭代调整的适配性更强。日常高频次、中等难度的反复修改类工作,交给这个比任何前代模型都更省心。

Slack的首席工程师表示,在不改提示词的情况下,Sonnet 5.5在几乎所有离线Slackbot评估中都赢了,步骤更少输出token还省了14%,让用户更快拿到更好结果。

Zendesk拿几百个真实客服用例测下来发现它错误决策更少,工单处理速度提高20%,客户不用干等。

金融场景全适配,办公效率翻倍

Sonnet 5.5这次在金融场景方面也进行了深度加强。

以往我们做金融财报复盘、用户反馈整理、工作总结、PPT文稿,总要反复修改、多次校对,耗费大量时间。

现在的Sonnet 5.5可以直接读取财报、会议纪要、各类文档模板,一次性生成可以直接对外交付的成品内容。

专业评审实测,直接产出的10页经营复盘报告,初稿质量就达标,基本不用二次修改。

金融场景中,Sonnet 5.5处理上千道专业金融分析任务,单次消耗资源只有老模型的四分之一不到,分析准确率大幅提升。客服场景中,工单处理速度提升20%,误判漏判的情况大幅减少。

Balyasny在2441个金融任务测试中发现它每个答案只用12.1万token,而Sonnet 5用了49.7万,高吞吐场景下性价比无敌。

同时设计审美也进步明显。UI美化、幻灯片排版、文档优化,都做得非常规整精致,自带高级质感。不管是职场办公、内容创作,还是数据整理分析,都能完美适配。

编码能力超强

除了金融场景,编码能力提升也不小。

很多资深开发者实测后都表示,Sonnet 5.5彻底摆脱了上代的短板。高算力模式下,编码得分比Sonnet 5高出10%,完成同等代码任务的成本,只有上代的十五分之一。

Sonnet 5.5能快速读懂几万行的大型代码库,不用精细繁琐的提示词,就能精准完成代码审计、漏洞排查、架构梳理。

还能批量整合多步工具操作,减少无效执行步骤,大幅提升开发效率。

不管是EpicGames、Unity这类游戏大厂,还是SpaceX技术团队,实测反馈都高度统一。

复杂的系统代码审核、长时间持续的项目开发、多文件联动修改,Sonnet 5.5都能稳定hold住。

甚至很多团队直接把中等难度的代码评审、功能落地开发,全部迁移到这个模型上,用来替代成本更高的旗舰模型。

比较实用的一点是,很少中途卡顿、频繁向用户提问确认,能够一口气跑完完整开发流程,不会打断工作节奏。

如何使用

价格方面,Sonnet 5.5输入每百万token2美元,输出每百万token10美元,缓存读取每百万token0.20美元。

目前Sonnet 5.5已经全平台正式上线,亚马逊云、谷歌云、微软Azure都能直接调用,适配所有主流商用场景。

同时它延续了Claude全系的零数据留存模式,企业用户可以放心处理敏感业务数据。

算力档位可以自由调节,按需平衡速度、质量和成本。日常办公开中等档位就足够流畅,复杂任务拉高档位,就能实现接近旗舰的输出效果。

返回列表