PLACE:基于条件嵌入的位置潜在适配用于双耳音频生成
PLACE 通过条件嵌入的位置潜在适配方法,扩展预训练任意到音频模型 AudioX,实现由文本、视频及可选音频提示组合生成双耳音频。该方法用 Perception Encoder Core 特征增强视频条件,对齐文本与视频表示以提取空间线索,并对生成潜在施加条件相关低秩变换,以解码音频的双耳声级差与时间差为目标监督适配器。
PLACE 通过条件嵌入的位置潜在适配方法,扩展预训练任意到音频模型 AudioX,实现由文本、视频及可选音频提示组合生成双耳音频。该方法用 Perception Encoder Core 特征增强视频条件,对齐文本与视频表示以提取空间线索,并对生成潜在施加条件相关低秩变换,以解码音频的双耳声级差与时间差为目标监督适配器。
Signal Tools Co. 发布 Pro Knob 系列单旋钮混音插件,首发 17 款,含免费的 Trimmer 与 Unlock,Delay、Plate、Shimmer 各带 Aux 发送版本。
Audible World Models 提出一种免训练框架,将声音纳入生成的世界状态。系统从文本提示构建全景 3D 代理,分离语义层,识别发声前景物体与环境背景区域,为每个声音标签合成干音频,再将其锚定到重建几何体,并利用几何声学传播渲染随听者位置变化的空间音频。在 80 个生成场景上的实验显示,其空间一致性优于文本、视频和全景条件基线,同时保持有竞争力的语义对齐。
MusicTech 按 DJ 混音制作流程推荐了四款软件:DJ.Studio 被列为整体最佳,可从 rekordbox、Serato 导入播放列表并自动生成过渡;Density 记录演奏数据而非音频,事后用原始音频文件重建混音;Ableton Live 适合精修与母带处理;Audacity 则是免费剪辑选择。
Synchro Arts 发布 VocAlign 7,新增多轨工作区,可将任意轨道设为参考轨并同时对齐多条人声,且不限制轨道与参考轨数量。Pro 版独占 SmartPitch 智能音准修正、SynchroLink 2.0 与 Creative Formant Control,标准版和 Pro 版均新增 Visual Energy Analysis 实时能量显示。
Spitfire Audio 发布与 BT 合作的混合合成器 Phoenix,这是双方继 2017 年 Phobos 和 2022 年 Polaris 后的第三次合作。
Segment CPH 推出首款插件 Palora,一款采用全功能减法合成架构的模拟合成器,支持 Windows 和 macOS(含 M 系列处理器),插件格式为 VST3 和 AU,并提供独立软件版本。
Tupos Audio 推出 FM 合成器插件 Tupos MPE FM,采用复音 FM 合成架构,可将触压、滑动和力度等调制源直接分配至每个旋钮,无需独立调制矩阵。
Naturl Audio 发布 AL-1 母带限制器 1.1 版,用新算法替换原算法,并新增独立的真峰值限制级,置于主限制处理之后,用于捕捉真峰值过冲。公司称新算法在谐波失真、互调失真和混叠方面测量更干净,同时保留原有声音特性;界面提高对比度,原先位于菜单中的控制项移至主界面。
Benjamin Dehli 推出免费加法合成器插件 Overtonium,采用 32 个谐波正弦波分音,每个分音可独立调节音高、包络、调制、力度、触后、声像和电平,并配备独立噪声通道。
Native Instruments 为庆祝成立 30 周年发布 Maschine 3 软件重大更新 Maschine 3.7,新增随机音符生成器、欧几里得音序器和音符概率功能,Maschine 3 用户可免费获取,Maschine+ 支持稍后推出。同步推出 Thirty、Paris Heat 和 Rage Circuit 三款扩展包,售价分别为 30 欧元和 49 欧元。