Dorico 案例访谈:Max Gámiz 如何转录爵士乐
Open Studio 的音乐转录员 Max Gámiz 在 Dorico Showcase 中讲述如何使用 Dorico 完成复杂钢琴转录、课程乐谱及社交媒体内容制作。他借助自动排版、独立声部处理、自定义模板和 VST 乐器预览,提高乐谱清晰度与音频同步效率;Dorico 提供 60-day trial version。
Open Studio 的音乐转录员 Max Gámiz 在 Dorico Showcase 中讲述如何使用 Dorico 完成复杂钢琴转录、课程乐谱及社交媒体内容制作。他借助自动排版、独立声部处理、自定义模板和 VST 乐器预览,提高乐谱清晰度与音频同步效率;Dorico 提供 60-day trial version。
六个采样网站按适用场景完成排名:Splice 综合表现最佳,Loopcloud 主打低价入门,Sample Focus 适合零预算,Cymatics 聚焦 EDM、trap 与 hip-hop。
意大利高性能专业音频定制DAW制造商Project Lead在内部基准测试后,将Audient音频接口正式纳入其参考测试设施。工程团队重点测试了iD44的前级清晰度、AD/DA转换和驱动在高压力录音棚工作负载下的表现,并称赞其驱动稳定性、声音质量、整体性能及性价比。Audient意大利经销商Adagio Italia促成了此次合作。
Tom Frampton 介绍使用 MIXVAULT 进行母带处理的方法:在主总线上播放最具代表性的响亮段落,通过 ANALYZE 生成与曲风匹配的 Smart Preset,再以固定频段进行小幅音调调整。指南还说明 4、6、9 个频段及 Bass 模式的选择,并讨论流行、现代摇滚、嘻哈和参考曲对比流程。
推荐理由:文章以固定频段、相位稳定和电平匹配为基础,提供从 Smart Preset、不同风格处理到参考曲对比的母带工作流,便于创作者理解并执行宽频音调平衡。
sonible 发布 smart:chain,将 EQ、压缩、去毛刺、门控、输入增益调整、饱和等处理整合在一个基于 Sonic Intelligence 的通道条中。
LSP Plugins 1.2.35 现已提供 Windows 官方构建,用户可在 LSP-BUILDS.COM 注册并获取个人版本。该版本主要修复 1.2.34 引入的回归问题,包括 PipeWire 下无法检测的 JACK 连接估算问题,以及多线程构建时可能因二进制依赖导致的构建脚本崩溃。
推荐理由:Windows 官方构建上线并开放个人版本注册,修复了 PipeWire 下 JACK 连接估算问题及多线程构建脚本崩溃,对用户安装和插件维护具有直接价值。
SoundQ 新增将集合导出为 CSV、设置 Watched Folders 扫描偏好、启用或禁用波形区域选择,以及从音效返回原始文件夹或集合的功能。更新还扩展了传入 Media Composer 的元数据字段,并支持登录一次后离线使用;云端集合的整体改版计划于今年晚些时候推出。
推荐理由:新增集合导出、扫描控制、波形选择开关与来源定位,并改善元数据传递和离线使用,直接影响大型音效库的整理、检索与协作效率。
声音设计师 Dave Whitehead 分享如何以鲸歌和喉音塑造《第九区》Prawns 的异星语言,并用人声混合音效,让声音更显 alien。他与合作伙伴 Michelle Child 创作《降临》中 Heptapods 的声音,其方案获得 Denis Villeneuve 的认可;他还参与了《Project Hail Mary》与《Avatar》系列。
whisper.cpp 发布 v1.9.3,修复短音频 log_mel_spectrogram 的堆越界读取,并拒绝张量头中无效维度以防范畸形模型文件导致的栈缓冲区溢出。版本同时更新 CUDA、SYCL、Metal、Vulkan、OpenCL、WebGPU 等后端与 ggml 相关功能;官方注明语义化版本机制仍在完善中。
推荐理由:本次发布包含语音工具的安全修复,以及多后端、量化格式和推理执行方面的兼容调整,对升级排查与部署验证具有直接参考价值。
Side Brain 在 Ableton 分步视频教程中,演示从头制作 R&B 鼓组,包括用 MIDI 编排鼓点、加入人性化处理,并通过总线处理融合鼓声。教程还使用 Drum Sampler 和 Delay 添加质感与律动,在 Drum Rack 混音器视图中完成移调、声像调整和鼓声混音。
Sudan Archives 在 Ableton 短片中展示工作室,并讲解如何将传统弦乐技法与 Ableton Live、Move 和其他设备结合。她使用无线系统、音箱踏板、干声录音、声像与自动化制作多层编曲,也分享了在 AI 时代维持创作意图与技术平衡的看法。
推荐理由:文章通过工作室参观与访谈,具体呈现小提琴、Move、Ableton Live及效果器如何参与写作、录音和混音,为独立音乐创作者提供可参考的技术流程与现场配置思路。
Kokoro ONNX 发布 model-files-v1.1,提供 Kokoro v1.0 与 v1.1-zh 的全精度、FP16 和 INT8 ONNX 文件,以及对应语音包。
推荐理由:三种精度文件及体积、相关性和语音包信息便于部署选择;时长输出、浮点速度输入与图内嵌配置还能直接改善时间戳生成、变速稳定性及分发完整性。
sherpa-onnx 发布 v1.13.6,统一 Flutter 与 Dart CLI 的 init API,并加入 VAD+ASR Flutter 示例。版本还修复 Android、Java 和 iOS SPM 示例及 Dart 软件包发布问题,并在 C API 与语言绑定中开放 pyannote window shift ratio。
sherpa-onnx 发布 Flutter Web 演示及面向 Android、Linux、macOS、Web 和 Windows x64 的可下载资源。内容覆盖 Silero VAD、文件与麦克风输入的 VAD+ASR,以及离线和在线标点恢复,并列出 FireRed ASR、FunASR Nano、Whisper、NeMo Parakeet、Qwen3 ASR 等模型。
推荐理由:集中提供跨平台 Flutter 示例与模型组合,便于开发者按文件、麦克风及标点恢复场景验证 VAD、ASR 和标点处理流程。
Mastering The Mix 介绍如何使用 MIXVAULT 对人声、鼓、贝斯和音乐总线进行 EQ 混音。根据声道类型与曲目风格运行 ANALYZE 后加载 Smart Preset,再通过固定频段进行音色塑形;不同分辨率适用于快速平衡、细节处理及 20–320 Hz 的低频工作。
推荐理由:文章按人声、鼓、贝斯和音乐总线拆解 MIXVAULT 的分析与塑形流程,并说明固定频段、Q 值调整及不同分辨率的选择依据,能帮助混音者减少 EQ 决策时间。
Suno Studio 2.0 支持 Premier 导出无数量限制的 32-bit WAV 或 MP3 多轨及单独 stem,为 AI 音乐进入 DAW 混音提供了更完整的素材入口。文章建议先确认轨道对齐并降低电平,再处理串音、相位抵消和动态冲突;对分离伪影应采用窄带、局部处理,并以参考曲目和实际听感验证最终混音。
推荐理由:文章把 AI stems 导入 DAW 后的增益、相位、串音和分离伪影拆成可执行的处理顺序,并强调用参考曲目校准判断,适合制定混音工作流。
Beatport宣布拒绝销售全部或大部分由AI生成的音乐,Traxsource、Tidal、Deezer和Spotify也分别采取标签、版税、推荐或身份标记措施。文章指出,AI用于母带处理、音频分轨和声音设计目前不在这些平台主要处罚范围内,但“多数人类创作”等标准、自动检测误判和申诉机制仍存在不确定性。
推荐理由:梳理Beatport等平台对AI生成、AI辅助音乐的具体处理方式及模糊地带,为制作人判断披露、推荐、版税和账号风险提供实用依据。
LSP Plugins 发布 1.2.34,新增 Deesser Plugin series,并对静态、动态滤波函数及 AVX-512 滤波级联进行优化。
推荐理由:本次更新覆盖滤波器、插件扫描、架构兼容与多项稳定性修复,并对 VST2 封装和 VST3 路径进行优化,能直接改善跨平台制作环境的兼容性与排查效率。
MIXVAULT 在匹配 FabFilter Pro-Q 3 低架滤波频率响应的测试中,将全范围偏差控制在 ±0.13 dB 内,延迟为 41 ms,而 Pro-Q 3 最大分辨率线性相位模式的延迟为 1,509 ms。测试还显示,MIXVAULT 的瞬态响应呈现相同对称、相干的形状;测量使用 44.1 kHz 的 AU/VST3 版本并进行延迟对齐。
推荐理由:以同响应曲线和瞬态测试比较相位行为、延迟与样本数,并公开测量设置,便于评估线性相位 EQ 在混音流程中的延迟取舍。
Pro Sound Effects呼吁媒体与AI企业合法授权声音,并共同推动专业声音创作者权益保护。自2004年起,其团队已制作超过120万条声音,支持50多位声音艺术家和20人的核心团队。公司指出,AI企业未经许可抓取和盗用专业音频将危及创作者生计,而目前专业声音领域仍缺乏统一联盟。
sherpa-onnx 发布 v1.13.5,更新 Nemotron、Moonshine、Inflect 等模型支持,并改进 QNN、WebAssembly、SPM、Flutter 和多平台构建。此次版本还修复 ScaleSilence、Piper TTS、Paraformer、FireRedASR、Pyannote 及多项崩溃、内存和数值计算问题。
推荐理由:本次更新覆盖模型导出、QNN 与多平台运行时,并集中修复 ASR、TTS、VAD 和音频处理中的稳定性与兼容性问题,对部署和制作流程有直接参考价值。
JUCE 9.0.1 新增用于 WebView 集成的 TypeScript npm package,并增加对格式错误 AudioFormat 输入的保护。该版本还修复 Xcode 12.4 下的 iOS 构建、旧版 Linux 发行版中的 Freetype 编译、macOS 文档图标、Linux GUI 无响应及 CoreAudio 编译问题。
推荐理由:这次更新补充了 WebView 集成包与 AudioFormat 输入防护,并集中修复多平台构建、编译、图标和 GUI 无响应问题,有助于开发者评估升级影响。
Sonarworks Blog教程分析Chorus、Flanger和Phaser如何通过延迟、滤波与相位变化影响混音,并提出针对性的控制方法。处理Chorus时可用Pro-Q 4的Spectral Dynamics或带侧链的多段压缩,针对性避让人声频段;使用Flanger和Phaser时可结合共振控制、额外压缩与单声道检查,兼顾频率平衡、立体声宽度及不同监听环境下的表现。
推荐理由:围绕Chorus、Flanger和Phaser对频率、相位及动态的影响,提供动态均衡、多段压缩、侧链触发和单声道检查等可操作方法,帮助创作者在保留效果特征的同时维持混音平衡与稳定。
FamiStudio 4.5.3 修复部分 PAL VGM 导入过慢及 VGM 导入数据不正确的问题。该版本还修复未选择 arppegio (None) 时右键音符导致的崩溃、Mega Man 2 演示曲中的部分音符与包络,以及 4.5.2 引入的 NSF/ROM 导出问题。
SoundID VoiceAI通过转换创作者亲自录制的人声音色,制作C-pop、Mandopop和Cantopop的风格化参考人声。中文声调与咬字会由源演唱保留,模型不会纠正发音,因此非母语者应让流利演唱者录制引导人声,并匹配模型适合的输入音域。中文人声扩展包提供10个声音,支持DAW内本地免令牌处理;文章还说明了Unison Mode堆叠、授权来源及商业输出规则。
推荐理由:文章围绕华语流行、粤语流行和C-pop的AI音色转换制作,解释声调语言中的演唱录音、输入音域、DAW内迭代及混音处理要点,并说明授权与使用边界,对中文人声制作和前期参考制作具有直接决策价值。
SuperSonic 完整替换 Sonic Pi v5 的 scsynth,音频设备、采样率与缓冲区大小现可在 GUI 中热切换,无需重启或中断正在播放的音乐。新增 link_audio、MIDI 时钟、游戏控制器、会话录像、GUI 改进及多平台支持;set_volume! 改为 0–1,旧配置不会迁移至 v5。
推荐理由:引擎替换会影响音频设置、音量参数与既有工作流;发布说明同时提供迁移映射、平台构建和兼容变更,便于现场编程与维护决策。
sherpa-onnx 发布 v1.13.4,导出 Parakeet、Whisper 和 nemotron-speech-streaming-en-0.6b 等模型至 QNN,并加入对应 C++ 运行时支持。
推荐理由:本次更新覆盖 QNN 模型导出与 C++ 运行时、Windows 路径兼容和 ASR 结果处理,并扩展 JavaScript 非流式 API 的逐流热词支持,对部署与语音识别集成有直接参考价值。
教程演示 LNA Does Audio Stuff 如何在 Note 中采样有肌理的声音素材、叠加人声并即兴创作 FM 合成器旋律,再转入 Live 完成曲目。制作过程中使用了 Erosion、Auto Pan-Tremolo、Wavetable 等设备。
whisper.cpp 发布 v1.9.2,改进了 VAD 语音分段、时间戳映射和参数解析,并使 voice_length() 支持 UTF-8 CJK。版本还涉及 Parakeet、Android 示例推理性能、Ruby 语音分段 API 及 Nix 构建修复。
推荐理由:本次更新覆盖 VAD、CJK 文本处理、Android 推理性能与构建兼容性,并新增 Ruby 的语音分段 API,对语音识别工具的集成和部署维护具有直接参考价值。
品牌管理通过统一品牌声音、信息与客户体验,提升企业认知度、信任和长期忠诚度。启动品牌管理可采取五个步骤:研究受众、定位品牌、建立视觉识别、塑造品牌声音和制定内容策略,并结合 SEO、内容营销及专业声音人才展开推广。Voice123 建议企业可从平台聘请专业配音演员,满足播客、广告、解释视频和培训视频等音频需求。
Voice123 指南建议企业建立 Instagram 商业账户,结合 Reels、Stories、轮播帖和 feed 帖开展营销,并运行定向广告。企业可通过 DM 承接咨询与购买,使用 Instagram Shopping 展示价格和购买选项,再以 Analytics 跟踪触达、互动、主页访问、网站点击和粉丝增长。Stories 默认在 24 小时后消失,除非保存为 Highlights。
FL Studio 项目可保存到云端。正文未说明具体操作步骤、适用版本、价格或使用资格。
Bad Snacks 教程通过 MIDI 模式、音频循环、和弦、低音线、采样与旋律,在 Ableton Live 中从零创作首支曲目。课程还涵盖段落与过渡编排、人声录制及混响和音高校正,并使用音量、EQ、压缩、效果器与自动化完成混音。最终可导出成品,并在 Session View 中设置为现场演出。
Sonarworks推出SoundID VoiceAI的C-Pop Voices Expansion Pack,新增10个面向C-pop、Mandopop和Cantopup制作的男女声。
作者近日在首尔为三组参与者举办 Dorico 活动,内容按专业制谱需求、Dorico 初学者及敬拜音乐场景分别设计。课程涵盖 condensing、cues、cutaway scores、MIDI 编辑、VST 播放、Cubase 文件互操作及敬拜音乐排版,并介绍 PDF、图形导出和免费 Dorico for iPad 共享乐谱的用途。
Christopher Tignor 分享其自定义 Max for Live 设备 Five Finger Discount,并介绍它如何扩展小提琴的实时旋律与复节奏。
推荐理由:内容呈现了 Five Finger Discount 如何把弓法、左手 pizzicato、 Wittner tuning forks 与 MIDI pedal 转为实时旋律和复节奏,适合研究 Max for Live 与现场表演结合的创作方法。
MPG 获提名的 Dolby Atmos 混音师 Kurt Martinez 在自家花园搭建了专业混音室,并以 Audient ORIA 负责房间校准、监听路由和扬声器配置。
推荐理由:文章以实际搭建者经验说明家庭 Dolby Atmos 混音室的房间处理、监听连接和工作流取舍,重点呈现 ORIA、iD48 与设备路由之间的配置关系。
REFERENCE 3 可帮助制作人建立按具体问题选曲的小型混音参考库,而不是反复依赖同一首偏好曲目。方法要求为每首参考曲明确任务,并通过 Mix Descriptors、Smart Loop、Level Match 和 Master Scope 辅助查找、循环和公平比较;文章建议每年只替换两首或三首,以保持曲库稳定且熟悉。
推荐理由:按底鼓重量、人声位置、频段平衡、立体声宽度和目标响度分工建立参考曲库,可让混音决策更直接,并通过 REFERENCE 3 的标记、循环与响度匹配缩短反复试听时间。
Brussels 作曲家兼制作人 Pierre Dozin 推出专辑《Hoarses》声音包,素材取自多首曲目,包含贝斯、鼓片段、人声和氛围声,部分经过再处理。
F5-TTS 1.1.22 修复跨分块分配 fix_duration 的问题,避免总时长膨胀至 N 倍。此次更新由首次贡献者 Wing900 在 #1309 中提交,完整变更记录覆盖 1.1.21 至 1.1.22。