跳到正文
今天10月2日周五
  1. arXiv cs.SD RSS
    发布于 2026-10-02 12:00

    PLACE:基于条件嵌入的位置潜在适配用于双耳音频生成

    PLACE 通过条件嵌入的位置潜在适配方法,扩展预训练任意到音频模型 AudioX,实现由文本、视频及可选音频提示组合生成双耳音频。该方法用 Perception Encoder Core 特征增强视频条件,对齐文本与视频表示以提取空间线索,并对生成潜在施加条件相关低秩变换,以解码音频的双耳声级差与时间差为目标监督适配器。

10月1日周四
  1. arXiv cs.SD RSS
    发布于 2026-10-01 12:00

    Audible World Models:为 3D 世界生成空间感知音效

    Audible World Models 提出一种免训练框架,将声音纳入生成的世界状态。系统从文本提示构建全景 3D 代理,分离语义层,识别发声前景物体与环境背景区域,为每个声音标签合成干音频,再将其锚定到重建几何体,并利用几何声学传播渲染随听者位置变化的空间音频。在 80 个生成场景上的实验显示,其空间一致性优于文本、视频和全景条件基线,同时保持有竞争力的语义对齐。

9月30日周三
9月29日周二
9月28日周一
  1. Production Expert
    发布于 2026-09-28 18:35

    Naturl Audio 发布 AL-1 限制器 1.1 版,新增算法与真峰值限制

    Naturl Audio 发布 AL-1 母带限制器 1.1 版,用新算法替换原算法,并新增独立的真峰值限制级,置于主限制处理之后,用于捕捉真峰值过冲。公司称新算法在谐波失真、互调失真和混叠方面测量更干净,同时保留原有声音特性;界面提高对比度,原先位于菜单中的控制项移至主界面。

9月26日周六
9月25日周五