sherpa-onnx v1.13.8 更新兼容性、识别与说话人分离能力
sherpa-onnx 发布 v1.13.8,新增 Android Termux 构建与 Python、Rust API 示例支持,并加入 Intel NPU 的 OpenVINO 支持。
推荐理由:本次更新同时覆盖 Android/Termux 兼容性、语音识别稳定性、说话人分离置信度及新增语言资源,对跨平台语音工具集成与部署维护具有直接参考价值。
sherpa-onnx 发布 v1.13.8,新增 Android Termux 构建与 Python、Rust API 示例支持,并加入 Intel NPU 的 OpenVINO 支持。
推荐理由:本次更新同时覆盖 Android/Termux 兼容性、语音识别稳定性、说话人分离置信度及新增语言资源,对跨平台语音工具集成与部署维护具有直接参考价值。
FunASR 1.4.16 改进混合设备推理,保留 vad_kwargs、punc_kwargs 和 spk_kwargs 的设备配置,运行时覆盖不再修改已加载模型。新版本补充经测试的 Transformers 中英文指南,明确标点后处理需求,并附带 runtime-llamacpp-v0.2.6 的九项预编译运行时资源;测试不代表 CUDA、MPS 或 NPU 性能认证。
推荐理由:更新明确修复重复推理中的设备配置传播问题,并补充 Transformers 使用与标点后处理指南,有助于部署者排查多设备推理和原生运行时的兼容边界。
Spotify推出Fresh Finds Forward,计划每年为约10,000名新兴独立音乐人提供资源、社群与支持,帮助延续早期发展势头。
Voice123分析《Marvel Rivals》的团队制英雄射击玩法:54名角色分为Vanguard、Duelist和Strategist,通过六人组队、定位配合与Team-Up Abilities形成协同。Season 10以Gorr the God Butcher为核心,并以角色差异、赛季扩展、专业配音及休闲与竞技玩家的平衡为重点,为游戏开发者提供参考。
Helgobox 发布 v2.19.0-pre.2,为集成于 REAPER 的 Helgobox App(含 Playtime GUI)增加 Linux 支持。Linux 支持目前仅限 x64,arm64 已经测试;该版本还修复了若干线程相关崩溃,包括 macOS 新建项目时点击保存按钮可能引发的崩溃。
推荐理由:为 REAPER 扩展增加 Linux 支持并修复线程相关崩溃,能直接改善跨平台使用稳定性;当前 Linux 支持仅限 x64,arm64 已测试但尚未说明可用。
Sonarworks Blog 梳理一条音频从声源、机械波和电信号,经麦克风、前级、ADC、DAW、DAC、功放转换为可听声波的完整路径。文章以录制人声并加入压缩为例,解释采样率、位深和各类电平,并指出越早处理信号链前端问题,对最终结果影响越大。
推荐理由:文章按声源、麦克风、前级、ADC、DAW、DAC、功放和扬声器梳理完整信号链,并说明录音源与后期处理的关系,有助于理解参数、排查问题及安排制作时间。
数字处理正改变音乐制作中从麦克风到监听的信号链,录音时可后期调整指向性、音色和频率响应。Polar Designer可让每种极性模式覆盖五个频段,Rode NT-SF1与Core Sound OctoMic等Ambisonic麦克风则提供多声道声场与后期解码能力。
Image-Line News 发布“免费获取 AutoTune Go”的信息。正文内容主要涉及 FL Studio 2025、FL Studio 2024.2 等版本更新,以及 FLEX、FL Cloud 和多项 FL Studio 插件,未进一步说明 AutoTune Go 的领取方式、版本或适用资格。
Pro Sound Effects 发布迷你纪录片《Brazilian Atlantic Forest: Vol. 1》,跟随制作团队在三天行程中记录巴西大西洋森林的声音景观。
Audient 发布 Horizon Thunderbolt 3 音频接口系列,包括 Horizon 8P、Horizon 16 和 Horizon 32,面向专业录音室市场。
推荐理由:以统一 Thunderbolt 3 平台覆盖录音、混合及大型设施,并提供可扩展 I/O、低延迟与数字召回,适合评估专业工作室的系统规划。
作者认为 Audacity 4 经过全面重做后,已成为适合配音工作的免费多轨 DAW。Dark Mode、清晰的波形显示、Linear dB 视图、实时压缩曲线与增益衰减显示提升了编辑体验,并支持非破坏性编辑和第三方 VST 插件;但它仍缺少专用可破坏波形编辑窗口,功能还不如 Adobe Audition。
文章分析共振峰值与相位抵消如何削弱混音能量,并介绍 RESO、FUSER 的处理方法。RESO 可动态处理贝 boom note、主唱尖锐共振、军鼓低中频、镲片高频堆积及全混音 200–500 Hz 浑浊;FUSER 可通过 Automatic Phase Optimization 优化底鼓与贝斯的低频相位。
Buzzsprout 指南说明如何注册账户、完善播客资料、上传首集,并提交至 16 个音频目录。注册可使用 90 天试用,每月最多上传两小时音频;付费计划可使用可自定义的播客网站。创作者还可在统计页查看节目概览、单集下载、收听设备、应用程序和听众所在地。
github-actions 发布 v2.19.0-pre.1 预发行版本,项目将各操作系统的 Flutter 从 3.38.8 更新至 3.47.3。此次版本还新增了修改节拍器输出声道的功能,相关发布包含自上次发布以来合并到 master 的 50 次提交。
Helgobox 发布 v2.18.4,修复由 2.18.2 引入的退出时静默崩溃,并移除 Windows 32-bit 支持。ReaLearn 新增实例标签、当前实例内单位启停控制及 REAPER 7.80 Windows 深色模式支持;插件在所有操作系统上将 Rust 从 1.84.0 更新至 1.98.1。
推荐理由:本次更新修复退出时无提示崩溃,移除 Windows 32-bit 支持,并为 ReaLearn 的实例、单位控制、标签及深色模式带来改进,升级前需核对系统架构与兼容性。
whisper.cpp v1.9.4 已发布,Nightly build 为 b5130。更新调整了语言自动检测与解码器状态管理,使服务端在检测响应中返回语言,并修复 whisper_mel 未初始化读取和空输入等问题。版本还增加 Windows On ARM 发布支持、更新 OpenVINO 模型转换与文档,并调整多个后端和 CI 配置。
推荐理由:此次发布补强语言检测与服务端响应,并修复重复调用、缓存和输入读取问题,同时更新 OpenVINO 支持及多平台构建配置,对语音识别部署与维护有直接参考价值。
whisper.cpp 官方发布 b5130,删除此前集中存放 Metal kernels 的残留 ggml-metal.metal 文件。相关 kernels 已拆分至 ggml/src/ggml-metal/kernels;该残留文件正导致发布检查失败。
whisper.cpp 发布 b5127 预发布版。Windows arm64 CUDA 构建(whisper-bin-win-cuda-*-arm64.zip)使用适用于 Windows on Arm 的 CUDA Toolkit 预览版,被标记为实验性构建。
xcframework 的最新 release 将 SPM 中的 onnxruntime 版本设为 1.27.1。发布页面显示,自此次 release 以来 master 分支已有 86 次提交,相关 commit 在 GitHub.com 创建并通过 GitHub verified signature 签名。
Machinedrum(Travis Stewart)在最新迷你专辑 BL00MS 创作访谈中说明了 Ableton Live、Note 与 Max for Live 的工作流,并分享移动采idea、hocket 编排和插件替代方法。
推荐理由:访谈呈现从 Impulse Tracker 到 Live、Note 与 Max for Live 的工作流演变,hocket、设备替换和 A/B 复现等细节,对电子音乐制作决策较有参考价值。
Pro Sound Effects创始人讲述自己为何在音频行业创办并持续经营一家利基声音素材公司超过22年。他说,持续做这件事是因为热爱声音,而这段经历最初的启发源自亚马逊。
Ableton Blog 发布 KVNDRA 的 melodic house 声音设计与 Ableton Live 现场设置拆解。内容聚焦 bass、hi-hats、filters 的制作技巧,以及为现场演出准备模板时平衡结构与灵活性的方法,并提供 Live Set 下载。
MuseScore Studio 4.7.5 已发布,新增部分指板图和乐器定义。该版本还修复了打开或导入乐谱时可能出现的若干错误和崩溃问题。
Freesound 推出 Collections,用于替代 Bookmarks,并支持将不同用户上传的音效分组管理。收藏可设为公开或私有,指定维护者协作增删音效,也可作为一个压缩文件下载;原有书签已迁移为私有收藏。
推荐理由:Collections 替代 Bookmarks,支持跨用户整理、公开或私有、协作维护与整包下载,为音效检索和项目资产管理提供更直接的工作流。
Tom Frampton 介绍如何借助 STEREOVAULT 诊断并修复混音中的九类立体声问题,包括宽度不足、单声道低频抵消、主歌与副歌空间差异、军鼓相位、耳机到扬声器的宽度变化及混响浑浊等。
推荐理由:提供以 STEREOVAULT 可视化定位九类立体声问题的检查框架,并按频段、Mid/Side 与相位关系给出对应的混音处理动作,适合混音阶段排查与修复。
Podbean 对比自身与五款热门播客托管平台,分析各平台的优点、局限和适用场景。文章围绕发布管理、受众触达、品牌所有权、分析数据和未来变现,梳理成长型播客选择托管平台时应关注的基础能力。
JUCE 9.0.2 发布,默认启用 MP3AudioFormat,并修复读取带 padding 的 MP3 VBR 文件和缺失末尾 pad byte 的 WAV 文件等问题。版本还改进了 OpenGL 渲染性能,修复 CoreAudio、VST3、UMP sysex7 及多目标 Xcode 项目相关问题,并新增 SECURITY.md 和软件物料清单。
推荐理由:这次更新覆盖 MP3、WAV、CoreAudio、VST3、OpenGL 与 Xcode 多目标项目等兼容性修复,并默认启用 MP3AudioFormat;对插件开发、跨平台构建和音频格式处理具有直接维护价值。
LMMS 发布 1.3.0-alpha.2 开发分支版本,新增 8 个原生插件、ARM64 构建、原生 LinuxVST、Tap Tempo、Dispersion 和 SlicerT 等功能。
推荐理由:该开发分支版本新增 ARM64 构建、原生 LinuxVST 与多项制作功能,但明确存在崩溃和项目损坏风险,且系统要求已提高,适合在备份项目后评估试用。
sherpa-onnx v1.13.7 修复 iOS、Windows arm64、CI 构建及在线标点模型初始化问题,并新增 Rust 的 iOS 支持、hello world Tauri 示例和 JavaScript API 的批量解码。
推荐理由:本次更新覆盖多平台构建、Rust 与 JavaScript API、流式识别及模型兼容性,能帮助使用者评估跨平台部署与识别接口调整带来的工程影响。
Piper v1.8.0 新增基于 TLTK 的泰语 phonemizer,训练时可使用 th extra --data.phoneme_type thai,合成时可在 voice config 中设置 "phoneme_type": "thai"。
推荐理由:新增基于 TLTK 的泰语 phonemizer,明确训练配置、语音配置及 IPA warmstart 兼容性,并同步补充安装脚本与 CI 测试,能直接影响泰语 TTS 的训练和合成流程。
Audacity 4.0.0 以 Qt 重建界面并引入新的 clip-editing model,支持多片段联合移动、裁切、变速、分组与拆分,同时保留多数 Audacity 3 工作流。
推荐理由:新剪辑模型、Qt 界面、工作区与项目格式变化涉及迁移和操作调整,发布说明同时列出兼容范围与缺失功能,可供升级前评估。
Voice123 盘点 Netflix 上的代表性动画,涵盖《赛博朋克:边缘行者》《恶魔城》等剧集,以及《Bubble》《龙之家族:巫师之王》等电影,分析人物塑造、动画表现、叙事与配音如何增强作品吸引力。文章还提到日语经典和原创作品,并讨论英文配音如何通过情绪、幽默和人物性格的适配进行本地化。
教程视频逐步演示如何通过自动化 Pad 音量,为下一首 garage track 增添节奏。内容还包括使用 Audio Effect Racks 改善 gain staging,在 Arrangement View 调整 grid divisions,以及塑造 automation curves。
Cinna Peyghamy 发行首张专辑 Music For Tombak & Synth,将传统伊朗打击乐 tombak 与电子制作结合。作品使用 Ableton Live 的 Vocoder、Rings 和 Max for Live 处理 tombak 录音,并以 1010Music Blackbox 采样器把专辑素材转为现场可触发的表演系统。
推荐理由:文章详细呈现传统打击乐与模块合成、Live 制作及现场采样的结合路径,对探索实时变形、编曲自动化和可演奏的电子音乐制作具有参考价值。
Audacity 3.7.9 为 Windows 构建启用 ASIO,并新增 FFmpeg 9 支持。该补丁版本修复了磁盘空间不足、驱动器断开和未保存恢复项目关闭时的项目损坏与数据丢失问题,还处理了实时效果器崩溃、MIDI 播放位置、失败录音、片段速度和字体配置导致的冻结;此前发布的手册因基础设施问题损坏后已替换,不涉及安全风险。
推荐理由:为 Windows 录音链路和项目稳定性提供明确更新依据,尤其适合排查 ASIO、设备记忆、项目损坏、实时效果器崩溃及 MIDI 播放位置问题;FFmpeg 9 支持也影响导入兼容性。
Audacity 4.0.0 Beta 4 发布,新增 Windows ASIO、FFmpeg 9、旧版 Audacity 项目导入及播放与录音设备的“System default”选项。
推荐理由:这次 Beta 4 集中补上 Windows ASIO、FFmpeg 9、旧项目导入及导出控制,并改善剪辑、崩溃检测与离线构建;但 Windows 安装包曾含旧版本,官方明确建议不要用于重要工作并保留备份。
Luis Villa 计划在 Unomusic 即将完工的新混音室安装第二台 Audient ORIA,使两个空间保持一致的监听参考。他已使用 ORIA 一年多,并用 SoundID Reference 生成次级校准配置,与 Dolby Laboratories Spain 的房间校准比较。
John Barron 将参加9月7日至9日在纳什维尔举行的 Sing! 2026,并主持 Dorico 进阶专题活动。9月8日下午5时,他将领讲可复用模板、歌词与和弦符号管理、移调声部和专业乐谱制作,参会者可在 Sing! app 报名。大会期间还提供免费一对一 Dorico 交流,解答版面、回放和入门问题,需自带电脑。
smart:chain 用户指南讲解这款智能通道条插件如何通过共享音频分析,协同运行 EQ、压缩、门限、输入调整与饱和等模块。Auto Leveling、智能深度分层及多实例通信等功能将控制扩展至整个混音,帮助减少重复设置,同时保留所有参数的可控性。
Ital Tek 在第八张专辑《Mind Abandon》中减少以电脑为起点的创作,转而用吉他、人声和其他现场乐器快速记录素材,再导入 Ableton 进行处理。他使用 Granulator III 随机化、重采样人声,用 Sampler 和 Drum Rack 组织乐器、鼓采样及复杂效果链,并将软件作为整理想法和推动创作的草稿板。
推荐理由:文章通过创作访谈呈现从现场乐器、人声采样到Ableton处理的具体流程,说明如何用采样、重采样、效果链和音频化工作流减少预设并保留偶然性。