50 毫秒延迟生成视频流:字节跳动实时空间视频模型最快下月发布
字节跳动正在开发一款实时空间视频生成 AI 模型,由张一鸣亲自督导,最快下月发布。该模型可在 50 毫秒延迟下按需生成视频流,并将渲染任务转移至云端,为更低成本的 VR 硬件铺路。
SEARCH INTELLIGENCE
从最新动态到实用工具,找到你关心的内容。
字节跳动正在开发一款实时空间视频生成 AI 模型,由张一鸣亲自督导,最快下月发布。该模型可在 50 毫秒延迟下按需生成视频流,并将渲染任务转移至云端,为更低成本的 VR 硬件铺路。
通义实验室突破性开源全模态情感计算框架 R1-Omni,通过 RLVR 技术与三维数据流融合实现可视化推理路径,在 DFEW/MAFW 数据集取得 65.83% UAR 值及 35% 性能跃升。该模型 0.8 秒精准捕捉微表情声调组合信号,预判 89% 潜在冲突,推动多模态 AI 进入可解释智能新纪元。
在“七一”建党节前夕,湖北省郧西县牛郎织女虚拟数字人体验馆推出“红心向党、数字传承”红色主题教育VR展厅。通过虚拟党建展厅、VR历史场景再现等现代科技手段,参观者可以沉浸式体验党的光辉历程,感受红色革命文化的魅力。