AI资讯

DeepSeek-V4-Flash正式版API公测,三大爆点引开发者沸腾

智能摘要

消息一出,开发者圈直接沸腾了,因为这次有三大爆点——消息一出,全球开发者圈都炸锅了。DeepSeek-V4-Flash正式版,直接把这个潜规则给掀了。在这俩专门针对真实开发环境和复杂代码设计的测试里,V4-Flash正式版的分数不仅比预览版「好很多」,甚至让同行侧目。

后训练魔法让200B模型逆袭

十点, 就在今天上午, Anthropic官方博客与X平台同一时间官宣, V4 – Flash正式版API开始进行公测。消息发布后的一小时之内, Hacker News以及Reddit的r/MachineLearning板块被刷屏, 众多开发者纷纷涌入官网去体验, 一时间致使API网关响应延迟了。

最令人诧异的是, 官方清晰表明, V4 – Flash – 0731的模型架构、参数量跟预览版全然相同, 均为200B参数, 只是再度进行了后训练。这表明未增添任何算力成本, 纯粹凭借训练技巧便将性能提升了一大截, 怪不得有开发者评价称这简直如同魔法来着。

轻量版把专业版按在地上摩擦

曾几何时, 于过往的行业之中, 潜规是这般, Flash所表征的乃是轻量、便宜以及快, Pro所意味的则是贵且具备强大性能。然而, 此次V4 – Flash正式版本却径直将此规则予以掀翻, 在多项基准测试层面, 不但把自家曾经的旗舰产品予以碾压, 甚至在部分代码生成之任务方面, 追平了Opus 4.8。

在内部测试期间, V4 – Flash于SWE – Bench以及Hard这两项测试里, 这两项测试是专门针对真实开发环境与复杂代码所设计的, 其分数相较于预览版有显著提升。有开发者在看到跑分状况后, 接连发出问号, 直接表明疑惑这数据是否标错了, 另外还有人表示就目前而言, V4 – Flash对于自身日常使用场景来讲, 已然出现性能溢出的情况。

原生API格式终结JSON解析噩梦

这次进行更新, 其中最明晰开发者痛点的所在之处, 便是原生对Anthropic API格式予以支持, 将大模型输出JSON格式时常常出现解析失败的棘手疑难问题给全然解决了。以往要模型输出条理整饬标准化的数据, 就如同抽取盲盒一般, 当下V4 – Flash能够以百分百的稳定程度Output开发者预先确订好的数据结构。

凭借其原生具备的卓越Agent规划能力, 开发者能够安心让V4-Flash去实施调用外部工具的操作, 但要注意读写数据库的权限, 还要把控RPA机器人的运行。于杭州一家SaaS公司任职的后端工程师李强向记者透露, 他于昨日连夜对测试环境进行了迁移, 原本需要编写两百行解析容错代码的区域, 如今连一行都无需撰写了。

全面适配Codex打通编程工作流

V4 – Flash全面适配Codex究竟意味着啥呢?那便是你于VS Code、Codex CLI或者桌面端能够毫无阻碍地接入此模型, 代码生成、代码审查以及自动补全均可达至专业编程助手的水准。macOS和Linux用户径直在终端实施安装命令便能够运用了, Windows用户同样仅需在命令行里予以操作。

技术负责人王磊, 来自深圳一家跨境电商公司, 他表示, 他们团队已然在Codex CLI里切换到了V4 – Flash, 着手处理一个维护项目, 此项目含有三千行PHP遗留代码, 原本这本该两名工程师耗费三天时间才能完成, 如今半天就达成了。他还进行了一番成本计算, 结果显示, API调用成本仅是原来的四分之一, 然而效率却提升至原来的三倍。

价格暴击让友商坐不住了

在GPT – 5点6宣布大幅降价的当日, V4 – Flash公测消息径直给友商使出一次暴击, 有开发者打趣问友商脸是否疼, 还有人已然在慎重思考退订GPT Plus与Claude Pro订阅, 只因V4 – Flash的性价比着实太明显。

执行日常任务, 200B参数用于跑长文本、高并发以及多Agent协同, 那是完全足够的, 并且API定价相比Pro级别模型要低很多。张明, 是北京一家AI创业公司的联合创始人, 他讲道, 上个月他们在模型API方面花费了四万二, 要是全面切换到V4 – Flash, 预计这个月费用能够削减到一万五以内, 同时产生的效果只会更优。

bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup.sh)

irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex

V4-Pro大魔王还在后面

官方专门作出特别说明, 表明今天的升级仅仅是针对V4 – Flash API, 而V4 – Pro的API以及App端模型暂时保持不变, 不过V4 – Pro正式版很快就会到来。要是200B的Flash仅仅依靠后训练便能够达到这样的高度, 那么传说中1.6T参数的V4 – Pro正式版将会有多么惊人, 大家都在拭目以待。

许多开发者已然在揣测, V4 – Pro正式版本是否能够与地表战斗力最强那一款的Claude 3.5 Opus正面展开较量。倘若那一天真的降临, 便是国产大型模型重新塑造全世界AI格局的时刻, 毕竟当下就连Flash版本都已经致使不少人叫嚷着要退订GPT以及Claude Pro了。

你打算何时将工作流切换至 V4 – Flash 上去尝试一下, 于评论区交流交流你的实际测试体验, 觉得具有用处的情况点击个赞分享赠送给在一旁搞开发的身旁友伴。

相关文章