Grok4.7发布:编程最强AI,速度翻倍价格减半
发布页开头只有一句极具“攻击性”的定位:面向编程与知识工作的最强模型,速度达可比模型两倍,价格仅一半。马斯克发推称,Grok4.7在智能水平、运行速度和成本之间取得了“很有竞争力的平衡”。Grok4.6一致;快速版速度翻倍。成本,换来了相当接近、并在个别专业任务上领先的性能。
它被宣传为是针对编程任务和知识性工作而打造的最强大模型, 名为Grok4.7的这个事物刚刚才出现, 马上就让网友们讨论了个不停地。它使用了只有一半的那种费用, 以及达到了两倍快速度的方式去挑战行业里现有的标杆标准, 然而那些网上的朋友们直接就说出来不敢加以称赞的意思。
长任务处理成为核心战场
这次升级不再是一味地只去追求那个跑分的数据成绩了, 它反而把主要的精力和重心, 都转移到了对长时间持续进行的那些任务的处理能力上面。
因为基础的那个模型的规模变得更大之后, 所以在训练的整个过程里面, 强化学习的那个执行周期被拉长了不少, 这种做法是让模型能够在长达数小时的连续不间断的作业当中, 依然能够维持住那种高度的专注状态。
至于那些极其复杂的软件项目, 它们往往需要先去读取整个庞大的代码库, 接着把这些巨大的需求拆解开来, 然后再反反复复地进行测试, 而新的架构在管理上下文窗口这方面表现得更好, 从而有效地减少了在执行链条运行过程当中的目标发生偏移的情况。

根据官方的测试数据, 长文本编码的得分已经从百分之四十点四提升到了百分之四十六点三。同时, 高推理强度的指标也达到了百分之七十点零。这样的改进直接回应了开发者心中的痛点。
模型现在不仅具备一次性生成代码的能力。而且它还能在漫长的调试过程当中, 实现自我纠错的功能。这样一来, 人工复核所需要的成本就大幅降低了。
专业领域评测全面铺开
根据显示的评分体系, 该模型在通用智能榜单上取得了一千六百五十七分的成绩。其Elo评级已经上升至一千六百九十五。这一成绩表明它正在紧跟那些主流的旗舰产品。
除了基础层面的对话能力以外, 文档撰写与演示制作等具体场景也被纳入了重点考核的范围当中。这种情况清楚地说明, 现有的技术路线已经从单轮问答的模式转变成了多步骤协作的新模式。
在垂直行业的测试环节同样呈现出非常出色的成绩, 具体来看, 生物安全这一基准的通过率达到了百分之六十四, 而法律专项以及医疗专项所获得的评分则分别突破到了百分之十九点六和五十六点七, 这也就说明团队是在真实的业务环境当中对模型输出的可用性进行了验证, 从而证明了该模型完全具备可以直接交付合格成果这样的一种能力。
安全防护机制迎来重构
面对当前越来越复杂的提示词攻击情况, 新版系统已经启用了全新的防护架构。这使得系统在实际运行中拒绝回答的概率更高了, 抵御越狱行为的能力也得到了增强。现在, 这两项表现已经达到了目前可获得的最高水平。
在生物安全基准这一块的表现也非常突出, 直接占据了榜单的首位。针对那些存在高风险的双重用途请求, 系统允许放行的比例非常低。具体数字大约在百分之三点三这样的范围内。

因为该机制在对危险内容实行非常严格的控制措施时, 几乎就不会对正常的学术讨论造成误伤的错误结果, 所以研发团队还把红队测试通道的邀请制资格开放给了部分网络安全机构。
这种属于透明化的策略做法, 是有利于持续地对防御边界进行不断的打磨和完善的, 从而能够最终确保企业级应用是完全符合那些相关合规要求的标准的。
成本控制打破行业惯例
开发者们所最关心的定价策略维持着稳定状态, 标准版的起点价格是按照百万次输入来进行计算的, 至于输出端则是收取六美元的費用, 这一收费并没有因为性能得到了提升而增加花费。快速版本提供了两倍于以往的响应速度, 这种设计能够很好地满足那些高频调用场景对于时效性的需求要求。
现在, 用户在进行升级操作的时候, 是不需要额外再去支付那些接口费用的, 而且还能享受到支持更长的上下文内容, 并且能够获得针对专业任务所进行的优化服务这样的待遇。
厂商方面是想要通过这种方式去争取让边际成本变得尽可能低, 以此来换取大规模部署的这种结果, 这种属于是让步让利的策略, 对于初创公司而言以及对技术团队来讲是具有非常强吸引力的。
市场反馈呈现两极分化
虽然官方声称自己在智能、速度与成本方面找到了平衡点, 但是公众舆论并没有完全认可这个说法, 部分在技术社区的用户对这些内容提出了质疑, 他们认为在实际的应用和落地效果上存在不足, 觉得营销方面的话术比重超过了实质性的技术突破, 甚至还直接说了不该在这个阶段推出这个产品。
对该版本的市场定位进行客观评估可以发现, 它并没有在所有的竞争维度上都全面超越竞争对手, 而是选择把重点放在特定的工作流程上以提供一种具有较高性价比的解决方案, 对于那些资金预算不足并且又非常依赖自动化操作流程的工作团队来说, 采取这样一条务实的发展道路反而会带来更加显著的商业价值。
开发者接入路径明确
目前新版本已经同步上线了官方平台与构建工具链, 支持通过标准接口和第三方框架调用。云服务商完成了底层适配后, 企业可以直接将旧有工作流迁移至新环境。
团队建议大家先动手去做常规的代码审查以及文档整理这些任务, 以此来开展验证工作, 接着一步一步地过渡到涉及跨文件修改和自动测试的相关环节中, 等到把经验积累得足够多了以后, 再把力量投入到核心业务的去处理这里面, 这种做法可以有效地避免掉在刚开始互相磨合的时期可能出现的效率方面的损耗, 你的团队目前主要使用的是哪一些类的大模型来处理日常的开发任务呢,你们面对这款主打高性价比的新产品是会尝试去替换现有的方案吗, 欢迎你在评论区分享你自己的看法, 并且点赞转发这篇文章。