AssemblyAI Universal-3.5 Pro 与 OpenAI Whisper 对比:准确率、幻觉与代码切换
AssemblyAI 发布 Universal-3.5 Pro 与 OpenAI Whisper 及 GPT-4o-Transcribe 的对比,称其幻觉比 Whisper 少约 30%,代码切换平均 WER 为 7.69,而 GPT-4o-Transcribe 为 44.58。
AssemblyAI 发布 Universal-3.5 Pro 与 OpenAI Whisper 及 GPT-4o-Transcribe 的对比,称其幻觉比 Whisper 少约 30%,代码切换平均 WER 为 7.69,而 GPT-4o-Transcribe 为 44.58。
AssemblyAI 更新了 2026 年 Python 音频处理库清单,指出 Python 3.13 已移除 audioop 模块,导致 pydub 多数操作报错。
Spitfire Audio 与 BT 合作推出软件乐器 Phoenix,这是双方继 Phobos(2017)和 Polaris(2022)之后的第三次合作。Phoenix 内置六个合成引擎,涵盖频谱波表、FM 与深度采样,并配有八个音序器、四个随机发生器和基于 StutterEdit 的概率琶音器。
AudioCodes 指出,语音 AI 应用将语音链路变为 AI 交付链的一部分,网络或媒体故障不再只是通话质量问题,还会影响 AI 应用听取来电者与交互速度。
Kraxton Labs 推出独立应用 AAF Sync,仅凭新旧画面剪辑的 AAF 元数据在 Pro Tools 中自动完成重套剪,无需参考视频、EDL 或音频分析。
POLYN Technology 已交付首批 VibroSense TMS 工程芯片,用于集成到 AI 轮胎监测传感器节点,供轮胎厂商、汽车 OEM 和 ADAS 开发者评估实时轮胎与路面摩擦感知。
Production Expert 刊文讨论生成式 AI 对专业音频创作的影响,作者认为其输出"天生平庸",因模型基于概率猜测最可能的答案,无法产生意外与偶然发现。文章以 gated reverb 的意外诞生为例,并称用 Suno 输入"创作前所未闻的音乐"等提示,得到的是三首平庸流行歌。
Tim Exile 发布 Finalist 2 算法混音工具,从 Native Instruments Reaktor 插件转为独立应用和浏览器版本,支持 Mac 与 Windows。
高通在 Snapdragon Summit 2026 发布 Snapdragon Sound Elite Gen 2,这是其首个面向个人 AI 时代的旗舰音频平台,面向 TWS 耳机、头戴耳机、音频眼镜等形态。