AI资讯

张一鸣督导!实时空间视频生成AI模型下月或发布

智能摘要

创始人张一鸣正亲自督导这款新模型的研发工作,该模型计划最早于下月发布。其中一位知情人士指出,发布时间尚未最终确定,计划仍可能发生变动。头显用户语音或动作的虚拟世界。毫秒)的极低延迟按需生成视频流,并支持空间计算环境及人机交互界面。模型、算力基础设施以及内容分发平台。

字节放大招了

近期有种超大风浪在整个科技圈层里给掀翻啦字节跳动正在攒着一项顶级巨量级大产品, 坊间传言连张一鸣本人都攥死揪住了研发推进节点不放依据彭博社那边放出来的消息, 他们谋划着没准下月头就推出一款完全崭新真实场景空间的视频产出量AI模型哟。

这可不是普通的技术升级, 而是想让AI能直接在虚拟世界里跟你实时互动。你动一下, 那边的虚拟场景就跟着变化;你说句话, AI就立刻回应。整个项目调用了公司庞大到惊人的海量算力和各部门的全部资源, 看来字节这次铁定要下定决心在空间计算这块地盘上硬撕开一道大口子。

什么是空间视频

不少人兴许对这词汇还较生疏。概而述之的话, 空间视频便是使得你处在一个全然靠AI生成的三维虚拟境况里。此种境况非一张静态图像抑或一段视频, 而是能随着你的举止与声响实时变动的互劝世界。

当你游玩VR类游戏期间, 脚下的地面还有周遭的建筑, 都可根据你的走位实现实时生成功能, 你看一个虚拟人物, 这名人物将会依照你的指令做出对应反应, 这项技术与此前观看视频的感受完全不一样, 你是真正“进入”到了那个虚构的世界当中, 绝不止是注视着屏幕在进行观看。

对标谷歌Genie

知情人士透露, 这个项目和谷歌的 Genie 功能类似, 皆是企图使 AI 生成极具沉浸感的三维交互环境。但字节有它自身独有的别样打法。他们并非造出一个孤立的模型, 而是要把这个模型视作整个生态体系的核心驱动力源。

张一鸣把这个空间视频模型定位成了一个飞轮, 就是指这个模型不光能生成内容生产, 还能把字节自研的AI模型体系、智能云计算资源, 以及名下的短视频平台条线、游戏体系业务和Pico头显硬件统统串联起来, 让整体形成协同联动作用。

低延迟是关键

这项技术最使人惊讶的地方在于速度。据透,模型能够在每秒生成20帧画面, 且, 把延迟控制在约50毫秒。这意味着啥? 实是你发出指令后, 虚拟世界几乎是瞬间便能做出反应, 没能感知到任何卡顿。

为达成这般成效, 字节采取了相当关键的架构适配, 他们把生成空间视频这种格外耗费算力的任务, 全数迁移至云端服务终端完成。用户侧的头显器具不需要颇为强劲的晶片, 只需要把控接受画面和传递你的操作指令就可以了。

VR设备要变便宜

此次云端架构改动, 对整个VR行业的影响可能极为巨大。早先VR头显价格居高难下, 一项关键原因为需内置高性能处理器支撑复杂图形运算;当下算力及渲染全在云端完成, 设备本身的要求就可大幅降低。

这暗示着未来或是出现更便宜、设置更简便的头显设备。普通用户无需花大代价购入顶配器材, 也能感应到高品质的空间影片。这对 VR 技术迈向大众消费市场来说, 是一个极重要的关键切入点。

竞争战场变了

拥有这项技术之后, 整个行业竞争的规则或可重写。此前科技公司统统在比拼硬件参数, 谁的分辨率更高、谁的刷新率更快、谁的芯片性能更强。以后争抢用户的战场, 将转去比拼谁能做出更好的AI模型、谁有更充足的算力储备、谁能搭建更高效的内容分发平台。

硬件设备可能会渐渐慢慢变成只是一个显示辅助工具, 真正的核心强劲竞争能力转为移到了云端。谁可运用能最相当低的成本、最快速的方式速度为使用者转为生成最高品质的交互内容, 谁就能够在接下来下一个时代时代中把握战略主动权主导地位。这场没有硝烟的硬仗才才真的才刚刚开始, 才刚起步。

如果你是 VR 爱好者, 你最期待这款空间视频 AI 能带来怎样什么样子全新的体验? 欢迎在评论区大胆聊下你的切实想法。

相关文章