热点事件历史事件
Audible World Models提出可听世界模型框架
1 篇报道1 个报道来源4 天前更新
先了解这件事
AI 综述
2026年9月30日,论文提出 Audible World Models,一种面向3D世界的 training-free 空间感知声音生成框架。该方法可根据文本提示构建全景3D代理,将声音源锚定到重建几何中,并结合听者视点与运动渲染空间音频。在80个生成场景的实验中,论文称该方法的空间一致性优于文本、视频和全景图条件基线,同时保持有竞争力的语义对齐表现。论文已被 NeurIPS 2026 接收。
AI 根据报道生成 · 1 天前更新
最新进展9月30日 03:37
论文提出可从文本生成3D场景并随听者视点渲染空间音频,已被 NeurIPS 2026 接收。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv · 多模态、视频与世界模型精选Audible World Models 提出面向 3D 世界的空间感知声音生成框架
论文提出 Audible World Models,一种 training-free 框架,可从文本提示构建全景 3D proxy,将声音源锚定到重建几何,并根据听者视点和运动渲染空间音频。对 80 个生成场景的实验显示,该方法在空间一致性上优于文本、视频和全景图条件基线,同时保持有竞争力的语义对齐;论文已被 NeurIPS 2026 接收。