AI资讯

Anthropic Sonnet 5.5泄露:200万token对标DeepSeek,性价比逆天

智能摘要

DeepSeek,意欲夺回性价比王座5.5,内部代号Fennec(沙漠狐),或下月发布。支持最高200万token上下文,推理速度快、延迟低,长上下文推理及多步规划显著提升,浏览器/终端工具调用增强。5,但维持Sonnet定价,打造性价比之王。

才刚被曝光出来的消息引发轰动了, 5.5版本其内部代号是沙漠狐, 听说将会带着200万token在上下文方面杀回来, 它对标旗舰的性能, 然而价格却根本没有上涨, 这是打算把性价比王座亲自捧将回来。

200万token是什么概念

200 万 token 所呈现出的状态, 就等同于能够一次性将 200 多万字的文档阅读完毕, 几本普通小说塞进去就会满掉。用户无需再度对片段进行切割进而分批次地上传,面对复杂报告以及长代码库, 可将整本直接投入其中, 一口气就能够完成。

此举表明, 产品经理无需要求拆解合同, 法务无需针对条款逐批审核, 就连程序员进行工作也不必将几万行代码分割成十几部分来供给模型使用, 这样一来, 信息完整性得以显著提高, 因上下文缺失所引发的理解偏差也会相应减少许多, 情况得到明显改善。

推理速度和延迟大提升

先前有不少人抱怨, 长上下文只要一长, 响应速度便会掉线。此次5.5着重对推理链路予以优化, 延迟显著降了下来。并非单纯堆砌数量, 而是要让模型运行得更快且更稳。

多步规划能力得以提升到了一个新的层次, 对于复杂任务拆分得更为明晰, 以往那种需要经过不断反复追问来梳理通顺的逻辑链条, 如今达成一步到位的概率更高, 进而用户体验将会提升不少, 变得更为流畅。

浏览器和终端工具调用加强

此次进一步增强了浏览器以及终端的工具调用能力, 这表明AI并非仅仅局限于聊天框内的机器人情形, 而是能够切实着手操作网页、运行命令行并协助你完成实际工作流程这一系列事项, 且是在实际场景之中去完成。

考量如下情况, 开发者而言, 这或许是最为实用的一种提升改进。以往需要经由手动去开展的自动编写脚本, 以及测试环境的部署, 还有批量文件的处理等事宜, 后续交付给AI直接执行。如此一来, 将会显得特别省事。

性能直逼旗舰Fable 5

最让人无法想到的是, 它的综合性能已经快要达到旗舰Fable 5的水准, 并非只是相差些许, 而是在诸多基准测试里面二者紧咬不放, 这种情况在中端价位当中极其罕见。

平常情况下, 旗舰产品跟主流产品之间, 存在格外明显的性能方面的断层现象, 然而这次却被不遗余力地给硬生生抹平了。对于那些预算有限, 却又执着于追求高性能的用户而言, 这就相当于明明只花了一半的钱, 却买到了近乎顶配的体验, 实在是令人惊喜不已。

维持定价是最大杀手锏

就连性能出色也就罢了, 重点在于价格并未上涨。好多厂商只要一进行升级便提升价格, 用户早就对此习以为常了。5.5却反其道而行之, 其定价维持不变, 这才是切实能让消费者为之买单的缘由。

说到性价比这个词, 那可是被频繁提及, 以至于都快说烂了, 然而真正能够达成的是性能提升, 同时价格却保持不变的情况少之又少。这次看起来明显是打算在市场之中重新确立起, 让便宜实用并存这一理念, 给市场上好好呈现一番。

下月发布悬念重重

有消息称, 下个月将会正式进行亮相, 然而截至目前, 官方并没有对具体的时间予以确认。内部所使用的代号为沙漠狐, 此消息已经广泛流传开来, 这意味着项目已然步入到收尾的阶段。越是快要临近发布的时候, 周边相关的信息便越发密集地向外流出。

设若你正处于对是否更换模型而感到犹豫不决的状态, 而又或者是想要针对5.5以及其他产品的实际呈现效果去进行一番对比, 那么不妨暂且等一等瞧一瞧情况发展。当发布时间一旦抵达之时, 所有的具体数据都会被陈列展现于众人面前, 到了那个时候自然而然结果便明确获知知晓了。

怎么看, 5.5真能去将性价比重新予以全新定义吗, 你是会等它发布之后才去做出选择, 还是当下就去买入现有产品, 欢迎于评论区去讲讲你的看法, 点赞并分享以便让更多人能够看到咧。

相关文章