跳到正文
今天10月2日周五
  1. Mix Online
    发布于 2026-10-02 03:45

    Mix Sound for Film & TV 2026 现场报道(下):Google Eclipsa 沉浸式音频系统亮相

    Mix Sound for Film & TV 2026 于 9 月 26 日在索尼影视制片厂举办,超 500 名音频从业者到场。Google 联合三星首次以赞助商身份展示 Eclipsa 沉浸式音频系统,提供面向家庭直播的全带宽沉浸式音频工具与交付规范,现场以三星显示器和 7.1.4 消费级回放系统演示。

  2. Mix Online
    发布于 2026-10-02 03:37

    Austrian Audio 发布 OC616 多指向电容麦克风

    Austrian Audio 推出多指向大振膜电容麦克风 OC616,采用其新 CKR12 音头,最大声压级 157 dB,动态范围 134 dB。该麦克风提供全指向、宽心形、心形、超心形和八字形五种指向,三段可切换高通滤波和 -10 dB / -20 dB 两档衰减,适用于人声、原声乐器、高电平声源及 Mid/Side 等立体声录音。

  3. Mix Online
    发布于 2026-10-02 03:30

    Focusrite Control 2 软件功能解析:为 ISA C8X 提供混音与路由控制

    Focusrite Control 2 是 ISA C8X 的桌面软件控制中心,可将前面板的大部分功能延伸到电脑上。其 Mixer 标签页可把接口的模拟与数字输入同 DAW 播放通道组合,建立多路独立的监听与耳机混音,并远程调整增益、输入选择、幻象电源、阻抗、Auto Gain、Air、Drive、Console 模式、插入与高通滤波。

  4. Production Expert
    发布于 2026-10-02 01:00

    FabFilter Pro-C 3 的 Auto Threshold 功能解析

    FabFilter Pro-C 3 新增的 Auto Threshold 功能可让压缩量独立于输入电平保持稳定,适合创意塑形,若仅用于电平控制则可关闭。启用后会出现 Lock Auto Threshold 按钮以在预设间保持相同压缩量,阈值旋钮周围的环形侧链电平表便于判断阈值设置,Audition Triggering 可单独监听被压缩的信号成分。

10月1日周四
  1. Earth Species Project
    发布于 2026-10-01 23:31

    新研究:机器学习揭示大象合唱声编码行为信息

    一项发表于 Scientific Reports 的研究用机器学习分析大象重叠合唱声,无需分离每头个体的叫声即可预测其行为情境。研究分析1986至2022年间成年雌象的903次隆隆声,发现约60%的隆隆声发生在两只及以上个体的合唱中,并在问候、联络和节奏性隆隆声三类情境中观察到发声趋同现象。

  2. MusicTech
    发布于 2026-10-01 22:40

    本周新音乐插件盘点:Sinee Kikzilla 2、Antares AutoTune Advanced、Zplane Timbre 等

    Sinee 推出低频塑形插件 Kikzilla 2,提供混响、噪声、采样或外部输入四种声源,支持可变形包络与三模式滤波,首发价 €79(原价 €99)。Antares 发布 AutoTune Advanced,搭载更新版 Auto-Mode 音高算法与 DVA 引擎,可自动检测并保留歌手颤音,售价 £398 或每月 £15.50。

  3. UK Acoustics Network
    发布于 2026-10-01 19:42

    结构健康监测技术加速应用研讨会将于 2026 年 10 月在考文垂举行

    BINDT 结构健康监测小组将于 2026 年 10 月 20 日在英国考文垂制造技术中心举办"加速采用结构健康监测技术"研讨会,现已开放注册并征集不超过 200 字的演讲摘要。会议聚焦航空航天、油气、土木工程和风机领域的 SHM 成功案例,探讨如何利用 NDT 与状态监测现有标准规范,并梳理认证、监管与保险等采用障碍。

  4. Headphonesty
    发布于 2026-10-01 18:10

    Dual CS 629Q 全自动直驱黑胶唱机原型亮相 High End Vienna 2026

    Dual 在 High End Vienna 2026 展出 CS 629Q 全自动直驱唱机原型,产品页标注 Preview 2027,未公布量产规格。其草稿手册给出 DIN 计权下抖晃率低于 ±0.06%,支持 33、45、78 rpm,预计售价约 1800 欧元,2027 年第一季度开启预售。该机沿用 CS 529 的机械自动机构与唱臂,将直驱电机重新布置以适配自动机构。

  5. Production Expert
    发布于 2026-10-01 18:05

    tokyomeltdown 发布 EQ Mirror 测量插件,实时显示 EQ 实际频响曲线

    tokyomeltdown 发布其首款插件 EQ Mirror,通过在 EQ 前后各插入一个实例,实时显示均衡器实际施加的频响曲线,无需侧链路由。该插件从轨道音频而非测试音测量,支持多数线性相位 EQ,可显示左右或中侧差异并以单一数值报告失真,不改变音频且不报告延迟。支持 AU、VST3、AAX,适用于 macOS 12 及以上,售价 18 美元,提供 14 天全功能试用。

  6. ASE 美国超声心动图学会
    发布于 2026-10-01 18:00

    ASE 与 AIUM 等联合开展 2026 年医学超声宣传月

    ASE 与 AIUM、ARDMS、CCI、SDMS、SVU 联合开展 2026 年医学超声宣传月(MUAM),聚焦心血管超声从业者。10 月期间 ASE Learning Hub 教育产品可使用优惠码 MUAM10 在会员折扣基础上再省 10%,合计近 30% 折扣;新会员按 12 个月价格获 15 个月权益,会员有效期至 2027 年 12 月 31 日。

  7. Headphonesty
    发布于 2026-10-01 17:51

    YouTuber 用导电性比铜差 57 倍的汞制作 Hi-Fi 线材,听音对比几乎听不出差异

    YouTube 频道 pierogi engineering 用 1983 年的汞灌入四根透明管制成喇叭线,与普通铜线对比试听,称两者差异极小。万用表显示铜线约 0.07–0.08 欧姆,单根汞管约 0.22–0.23 欧姆,差值约 0.15 欧姆。该对比为单人非盲听、未做电平匹配,制作者本人也承认可能存在预期偏差。

  8. Production Expert
    发布于 2026-10-01 16:00

    录音棚助理以 AI 软件形式回归,Production Expert 提醒仍需人工质检

    Production Expert 指出,录音棚助理正以 AI 软件形式回归,可承担多机位素材同步等任务,但不应在无人监督下直接信任。文章强调,响度、相位、同步等可测量指标仍可客观质检,而生成式补音、修复等缺乏明确标准,必须由人实时完整监听判断。文中引用乳腺 X 光 AI 辅助研究,说明经验丰富的放射科医生也会因自动化偏差重复 AI 的错误。

  9. arXiv cs.SD RSS
    发布于 2026-10-01 12:00

    SelfTTS:通过显式嵌入解耦与自增强自优化实现跨说话人风格迁移

    SelfTTS 是一种无需外部预训练说话人或情感编码器的跨说话人风格迁移 TTS 模型,通过梯度反转层(GRL)结合余弦相似度损失显式解耦说话人与情感信息,并引入多正样本对比学习(MPCL)聚类说话人和情感嵌入。该模型还采用基于自增强的自优化策略,利用自身语音转换能力提升合成语音自然度。实验显示其在情感自然度(eMOS)及目标音色与情感稳定性上优于现有基线。

  10. arXiv cs.SD RSS
    发布于 2026-10-01 12:00

    无需训练的神经与嵌入说话人日志亲和融合方法

    研究者提出无需训练的亲和融合方法 TFAF,将神经说话人日志推断的说话人结构融入基于嵌入的日志系统,无需额外训练、共享嵌入空间或说话人标签对齐。在 AMI 和 CALLHOME 上,DER 较两个组成系统均有一致提升;在 AMI 上融合还改善了说话人归属转写。消融实验显示神经说话人划分贡献了大部分增益,保留连续嵌入亲和比硬划分融合额外获益。

  11. arXiv cs.SD RSS
    发布于 2026-10-01 12:00

    基于音频语言模型的精神科临床语音录音角色引导说话人删除验证

    研究针对精神科双人临床对话录音中指定说话人删除的验证问题,构建了确认临床医生语音和患者语音分别被移除的两条对称流水线,先用目标角色音频进行消隐处理,再用音频语言模型和大语言模型扫描残留输出以识别遗漏删除。

  12. arXiv eess.AS RSS
    发布于 2026-10-01 12:00

    PG-SELD:物理引导的声事件定位与检测

    研究者提出 PG-SELD 训练框架,将自由场物理模型作为房间无关参考,通过物理引导知识蒸馏,把混响信号提取的中间表征与匹配声场景下自由场教师模型的表征对齐,以保留事件与定位信息并降低对房间特性的敏感度。在 STARSS23 基准上,PG-SELD 持续提升多种基线 SELD 架构的泛化性能。

  13. arXiv cs.SD RSS
    发布于 2026-10-01 12:00

    MeanVoiceFlow2:联合优化平均流与内容编码器实现快速单步零样本语音转换

    MeanVoiceFlow2 通过联合优化基于流的转换模块与高效内容编码器,实现单步零样本语音转换。该模型采用 MeanVoiceFlow 进行转换蒸馏并结合真实数据重建训练,同时引入扩散-GAN 训练、样本混合与教师引导条件增强。实验显示其感知质量优于 MeanVoiceFlow,推理速度约提升 9 倍,说话人相似度相当。

  14. arXiv cs.SD RSS
    发布于 2026-10-01 12:00

    SCIC:面向说话人自适应表现力 TTS 的范围与码本感知指令条件方法

    研究者提出 SCIC(范围与码本感知指令条件)方法,用于说话人自适应表现力 TTS,通过时间指令路由器实现帧级标签激活,并对残差码本进行标签特定加权。该方法基于 Qwen3-TTS RVQ 码本分析,发现能量集中于早期残差码本、音高在更深前缀中累积,从而改善说话人相对音高与能量控制,并结合多奖励 GDPO 后训练优化控制精度与语音质量。