字节跳动筹备实时空间视频模型,张一鸣亲自督战:AI竞赛从平面视频卷向3D世界

来源:互联网 时间:2026-09-09

A5站长网9月9日消息,字节跳动正在憋一个更大的招。据彭博社报道,字节跳动准备推出一款面向实时空间视频生成的AI模型,创始人张一鸣亲自下场督战——他直接出面协调模型研发、云基础设施、Pico硬件和内容业务多条线,算力优先保障。对已经退居幕后多年的创始人来说,这种级别的亲自过问本身就是信号。

模型基于字节现有的视频生成王牌Seedance构建,Seedance已经迭代到2.5版本,能单段直出30秒原生视频。新模型的目标是让用户为直播、短剧和游戏创建可交互的虚拟世界——不再是生成一段预先做好的视频,而是能随用户声音和动作实时变化的环境:往前走视角就推进,转过头四周场景依然连贯。

技术路径上的关键选择是云端渲染。空间内容的计算被搬到云端完成,再把画面串流到终端设备,目标延迟约50毫秒、每秒生成20帧。50毫秒已经贴近人类能感知的交互阈值,20帧每秒则意味着云端渲染加流媒体传输达到了可用的工程水准。这套打法最直接的收益是压低头显门槛——渲染不靠本地算力,Pico这类设备就不必堆昂贵的芯片,可以做得更轻更便宜。

字节盯上的是“世界模型”这块新战场。年初字节给2026年定下四大AI重点,世界模型排在第一位,数据预算据称达到八位数人民币。同赛道的对手个个来头不小:谷歌Genie 3今年1月已开放公测,斯坦福的李飞飞创办World Labs专攻空间智能,Meta前首席AI科学家杨立昆也一直念叨语言模型不够、机器得懂物理世界。字节手里的牌是十年的视频压缩和分发管道——训练世界模型最缺的就是视频数据,而字节最不缺的恰恰是这个。

产品节奏上,最快下月(10月)就可能亮相,但知情人士也留了余地:计划随时可能调整,字节方面未回应置评。Pico Space Pro延期到今年第四季度发布,外界猜测就与这款模型的研发推进有关——如果空间视频模型真能按时落地,VR赛道的竞争焦点可能从硬件参数转向AI模型和内容生态。谁能让虚拟世界像刷短视频一样随手生成,谁就握住下一张船票。

相关文章

标签:

A5创业网 版权所有