AI资讯

谷歌悄悄跑通RSI?AI自我升级时代真的要来了

智能摘要

谷歌跑通RSI了?这条路一旦走通,落后两个月的旗舰模型将不再是痛点,Google将获得降维打击的迭代速度。要知道,这已经是六周内发布的第三个Flash版本了。翻译过来就是,谷歌可能已经实现了「递归自我改进」,然后用它把Gemini提升了0.1。

AI竞赛进入新纪元

一处名叫「rsi-model–-le」条目, 陡然出现于生成式语言API内容返回里的结果之际, 相关业内各处正到处在开始, 全行业包括RSI的各类情形, 是该公开宣布突然, 这个CEO便在相信关于传言成真的、已经被实现的让RSI得到这种结果里。

心思缜密之人瞬间即可瞧出, 三枚被特意大写的字母归拢一块, 正是RSI。这份帖子很快斩获上千点赞, 评论区一半人在问询「他到底晓得什么内情」, 另一半人在查探「此人究竟是谁」。原来说过的话是, 「臆想一下, 若是GDM内部真有一个叫rsi-model–le的物件。」。

RSI是什么

压根儿没有官方说明解释, 可大伙儿在X上形成的普遍共识, 是关乎所谓自带运行时迭代属性的叫Live的在线强化学习, 模型一面在跑业务, 一面又在自我持续的进化, lyra那家伙直接发文章@了AI负责的家伙名叫Logan的这人还说没必要因为担心忌惮我, 把那GDM的那些API密钥, 全部全部回收回去, 紧接着他补锤的说法, 这批密钥是由GDM内部员工所提供, 可以访问超出1000个那样的内部系统。

虽这张截图的真伪未得到第三方验证, 但65536这两个数字与现有系列规格完全吻合, 不排除是内部测试名或恶作剧可能。三天前, 媒体报道称, 谷歌联创Brin对谷歌进展速度不满在上, 并力促员工更专注于递归自我改进

Brin的激进推手

今早先年八月, 路透社很早就已作过一致类同方向方向报道: 盼求谷歌追上最前线的Brin, 正用将资源引向送至RSI方向。据九月九日期的独家专属报道, 九月回归之后的Brin回归办公场所点位, 位于总部楼那一间之改改造后的微小的小的厨房隔间之内!坐于一张U形之表桌旁右侧之人, 则是当下之如今现在的现有负责人就在此处那, 而劈柴哥会每每周都来这一番数次造访。

另一位员工则直言, “这间厨房的存在, 就是为了能直接绕开公司政治。”他直接插手芯片分配, 为团队开辟了一条正式流程之外的「算力特权通道」。他甚至在内部推行了一项激进计划, 监控部分员工的编码过程, 用这些真实数据去训练代码能力。

赌上未来的豪赌

他只有一个核心诉求: 全公司必须以最快速度, 向「递归自我改进(Self- , 简称RSI)」发起总攻。路透社在8月的报道中还提到, Brin早在4月的全员会之上就催促加快大步调, 将资源全线向RSI倾斜。一位前员工更是坦言, 「他非常相信RSI, 他绝对是一个彻头彻尾的AGI信徒。」。

新一代旗舰模型因编码能力不达标, 硬生生被推迟了两个月。若是只靠堆叠算力熬制更大的底座, 等追上的那天, 对手的下一代早就发布了。要让模型自己评估、自己修改自己, 把动辄按月度或季度核算的迭代周期, 强行压缩到按周核算的周期内。

恐怖的迭代节奏

那一条路但凡走通, 落后两月的旗舰款型将再也不是难点, 将赢得降维打击般的更迭速率。但要是走不通, 这便成了一名没了衔头的创始人, 以算力分派权, 把整个赌注压在了一处从没人考证过的方位上。须知, 此现已是六周之内推出的第三輛Flash本版了。

翻译过来的就是, 谷歌可能曾完成了「递归自我改进」之后呢还用它把提升了零点一。在研究RSI智能体的江, 竟是直接断言并乐观预测: 依据于此, DAIR.AI的创始人、网友elvis认为的是: 那这就是递归自我改进飞轮的早期成果。

行业已无法掩盖

可多数多数人都没当成回事儿, 就因为它被藏埋在一篇篇Flash小版本的发布文章里边。瞅瞅这瞧瞧这可怖可可怖的迭代节奏, 三个周才出个版本罢了, 六个周才出三个大跨度的向上跃升。3.8版这Flash的HLE程序上拿拿到了个54.9%的成绩, 而这个Cyber版实实在在的真实漏洞挖掘上边, 成功率的真真更是突破了整整70%。

传统流程是训靠人、评靠人、训再作人, 一轮下来起步季就是一个季度。事后lyra亦一语道破, 「大伙真该去读读这本的官方博客。」瞅瞅近日多个Flash版本的发布间隔, RSI这件事委实已极度明显了。所以, 不管这张截图是真是假, 它所指向的实情, 早就展现在明面上。

范式转移的前夜

仅是, 在一个带名RSI的模型真身泄露之前, 无人将博客的那番话信为真。这部的核心奥义是叫AI自身去调整改动自我的训练代码与门路, 借此训练出更为强悍的下一辈, 下一辈就接着自行更正修正。于本年六月刊登的《从AGI到ASI》里, 此举被列为通往超级智能的四条必途径之一。

去年夏季, IAPS研究员Field曾让身处字节跳动、谷歌等大厂的共二十五位研究员预测「AI自动化研究」的数项里程碑, 斩获奥赛金牌、AI自行写出同行评审论文、AI独立跑完训练循环、AI为生产软件编写核心代码。本年七月Field公开表示, GPT-5.6 Sol已然能够协助后训练一个规模更小的模型, 替研究员省去了数周功夫。

谁在真正突破

在6月更是直接发表了一篇题为《当AI构建自身》的博客。今天, Dario正式宣布, RSI已经开始在整个行业发生, 包括在内部。其他两家说的还停留在「AI辅助我们做研究」, 而这家的博客直言「循环在递归地蒸馏模型」, 正在X上流出的更是带着RSI命名的正式模型标签和训练槽位。

每周三更如果Flash的该节奏真真是靠这类循环运转在催动, 那么此刻手里捏着的东西实体实体, 比起一个旗舰模型来说的话可怕不知道要多得多得多。假如三周等时间过去以后要是要是让3.9Flash还能准时出现的话话, 博客里边的那句内句「递归地去评估和精炼底层层面的模型」就断然就不再是一类修辞了说辞, 那个Flash对外发布的日程规划日历计划表转而去变为一个时刻在不断倒数去推进的计时装置, 以及每一条每一空格格项也全都是纯粹纯粹的模型亲自一步步运转自己独立走成型的啊。

从比谁更强到比谁转得快

过去三年的AI竞赛, 比的就是谁的模型强。这个算不算强, 中途跟着循环转了一圈, 就会自动刷新一回。先是不用写代码, 再是不用跑实验, 最后只剩下看结果和按确认。如果那张截图是真的, 那AI研发史上头一个, 由模型自己训出来的模型, 已经在那机房里跑着了。

各位对这件事怎么看? RSI真的要改变AI行业格局了吗? 你们觉得是? 欢迎留下你在评论区长点看法, 要是别忘记点赞和分享给更多人看到, 觉得有收获。

相关文章

OPPO陈明永谈AI不是替代人 是解决难题以人为本

AI资讯 # AI # CEO # OPPO