跳到正文

#AI 音频

今日 10 条
8月16日周日
  1. Supernice! DTM机材50

    sonible smart:chain 联动式智能通道条

    sonible smart:chain 可通过逐轨分析自动搭建通道条,并让多个处理模块共享一次音频分析结果、联动工作。用户监听轨道完成“学习”后,可指定类型继续调整,所有参数仍可编辑。去齿、饱和和 Depths Staging 分别用于处理刺耳与数字质感、改善前后层次;项目级自动电平与空间配置依赖多轨实例相互通信。

8月13日周四
  1. Pro Sound Effects38

    为何声音比以往更重要:Pro Sound Effects呼吁保护专业声音创作者权益

    Pro Sound Effects呼吁媒体与AI企业合法授权声音,并共同推动专业声音创作者权益保护。自2004年起,其团队已制作超过120万条声音,支持50多位声音艺术家和20人的核心团队。公司指出,AI企业未经许可抓取和盗用专业音频将危及创作者生计,而目前专业声音领域仍缺乏统一联盟。

8月11日周二
  1. sherpa-onnx 官方发布76

    sherpa-onnx 发布 v1.13.5 更新模型、运行时与多平台支持

    sherpa-onnx 发布 v1.13.5,更新 Nemotron、Moonshine、Inflect 等模型支持,并改进 QNN、WebAssembly、SPM、Flutter 和多平台构建。此次版本还修复 ScaleSilence、Piper TTS、Paraformer、FireRedASR、Pyannote 及多项崩溃、内存和数值计算问题。

    推荐理由:本次更新覆盖模型导出、QNN 与多平台运行时,并集中修复 ASR、TTS、VAD 和音频处理中的稳定性与兼容性问题,对部署和制作流程有直接参考价值。

8月7日周五
  1. Sonarworks Blog60

    用AI制作C-pop、Mandopop和Cantopop人声的指南

    SoundID VoiceAI通过转换创作者亲自录制的人声音色,制作C-pop、Mandopop和Cantopop的风格化参考人声。中文声调与咬字会由源演唱保留,模型不会纠正发音,因此非母语者应让流利演唱者录制引导人声,并匹配模型适合的输入音域。中文人声扩展包提供10个声音,支持DAW内本地免令牌处理;文章还说明了Unison Mode堆叠、授权来源及商业输出规则。

    推荐理由:文章围绕华语流行、粤语流行和C-pop的AI音色转换制作,解释声调语言中的演唱录音、输入音域、DAW内迭代及混音处理要点,并说明授权与使用边界,对中文人声制作和前期参考制作具有直接决策价值。

  2. sherpa-onnx 官方发布73

    sherpa-onnx 发布 v1.13.4,新增 QNN 支持并修复 Windows 路径问题

    sherpa-onnx 发布 v1.13.4,导出 Parakeet、Whisper 和 nemotron-speech-streaming-en-0.6b 等模型至 QNN,并加入对应 C++ 运行时支持。

    推荐理由:本次更新覆盖 QNN 模型导出与 C++ 运行时、Windows 路径兼容和 ASR 结果处理,并扩展 JavaScript 非流式 API 的逐流热词支持,对部署与语音识别集成有直接参考价值。

8月4日周二
  1. whisper.cpp 官方发布64

    whisper.cpp 发布 v1.9.2,更新 VAD 与 CJK 支持

    whisper.cpp 发布 v1.9.2,改进了 VAD 语音分段、时间戳映射和参数解析,并使 voice_length() 支持 UTF-8 CJK。版本还涉及 Parakeet、Android 示例推理性能、Ruby 语音分段 API 及 Nix 构建修复。

    推荐理由:本次更新覆盖 VAD、CJK 文本处理、Android 推理性能与构建兼容性,并新增 Ruby 的语音分段 API,对语音识别工具的集成和部署维护具有直接参考价值。

8月3日周一
  1. Podnews62

    欧盟《人工智能法案》成为法律,AI生成或操纵音视频须明确披露

    欧盟《人工智能法案》今日成为法律,面向欧盟受众的播客需关注其中关于AI音视频内容的披露要求。Article 50要求对生成或操纵音视频内容作出明确披露;引用文章解释,降噪、修复及使用AI编辑工具本身不属于此处所指操纵,但生成声音从未实际录制的完整语句需要披露。今日之前制作的内容无需追溯标注,罚款最高约为4000万美元。

7月30日周四
  1. Podnews31

    播客增长与行业动态:SpotsNow 广告匹配、播客简报与 Blubrry 托管计划

    Podnews 汇总播客增长与行业动态,SpotsNow 以 AI Search 按受众匹配度为广告主推荐节目,Ofcom 调查英国媒体习惯,Blubrry 推出按月发布音频和视频内容计费的新客户托管计划。Sounds Profitable 的研究显示,87% 的播客简报订阅者曾因简报收听过节目,Blubrry 计划最低起价为 7 美元。

7月23日周四
7月15日周三
7月4日周六
6月26日周五
6月19日周五
  1. whisper.cpp 官方发布35

    whisper.cpp 发布 v1.9.1

    whisper.cpp 发布 v1.9.1 版本,由 danbev 提交。此次版本在 Windows BLAS 的持续集成配置中新增 GGML_NATIVE=OFF 和 GGML_BMI2=OFF,并包含从 v1.9.0 到 v1.9.1 的完整变更记录。

6月17日周三
6月2日周二
5月15日周五
  1. Synth and Software56

    u-he Zebra3 软件合成器评测

    u-he Zebra3 是一款无_patch cable_的模块化软件合成器,提供超过1,200个出厂预设,并结合波表/加性混合振荡器、FM、物理建模和多段包络。作者认为其声音设计能力丰富,适合声音设计者和制作人;但不支持采样播放,也没有独立的步进音序器或琶音器,定制预设的学习成本较高。文章列出的价格为€249。

5月11日周一
  1. The REAPER Blog59

    Joel Schwartz 用脚本自动化作曲工作流

    职业作曲人 Joel Schwartz 通过 Python server 让 REAPER 连接 Google Drive、Dropbox、Frame.io 和 Nifty,自动化项目文件、团队文档及 cue 版本更新。他还在访谈中展示分轨渲染、视频项目回传、归档、路由和 cue sheet 脚本,并说明即使没有编程背景,也能借助 AI 完成这些工具。

4月30日周四
  1. Steinberg Blog66

    Dorico 6.2.20 发布并支持 Cantai 人声合成插件

    Steinberg 发布 Dorico 6.2.20,为 Dorico Pro 6、Dorico Elements 6 和 Dorico SE 6 增加对 Cantai 人声合成 VST 插件的支持。Cantai 可通过播放模板或手动添加到 Dorico,并为指定乐器自动渲染、更新人声部分;该更新还包含 25 项以上修复,包括 iPad 项目名称含逗号时无法打开的问题。

    推荐理由:本次更新明确了 Cantai 在 Dorico 6 中的加载、分配与渲染流程,并补充了兼容问题和编辑功能修复,对人声合成与谱曲工作流具有直接配置价值。

4月11日周六
  1. Decent Samples66

    Decent Sampler 1.20.0 新增波表引擎

    Decent Sampler 1.20.0 新增波表引擎,可通过扫描单周期波形帧并交叉淡化来生成复杂、变化的音色。当前支持波形类型、文件路径、位置与帧插值四项参数,其中位置可实时调制;文件格式基于 Serum 兼容的 RIFF WAV。

    推荐理由:明确说明新增引擎的参数、绑定层级与文件格式,能帮助采样乐器开发者配置可实时调制且支持帧插值的波表音色。

4月10日周五
  1. Pro Sound Effects57

    游戏音频工具指南:构建可交付的专业工作流

    Pro Sound Effects 介绍构建游戏音频制作栈的工具选择与组合方法,比较 Wwise、FMOD、Unity、Unreal、Nuendo、Pro Tools 和 Reaper 的工作流特点。文章还覆盖音效资产管理、空间音频、版本控制、项目管理、自动化及 AI 降噪和分轨工具,并给出连接 Wwise、SoundQ、Pro Tools 或 Reaper 的实践路径。

3月11日周三
  1. Image-Line News23

    FL Cloud Pro 有哪些新内容?

    Image-Line News 汇总了 FL Cloud Pro 相关资讯,页面同时列出多条 FLEX 音色包、FL Studio 教程及产品更新。其中 FL Studio 2025 更新包含 500 条 Dynamic Mixer Tracks 和 Loop Starter,FL Cloud 页面则涉及 Sounds、AI-powered Mastering 与 Distribution。

3月10日周二
  1. Fish Speech67

    Fish Audio 发布 S2 Beta 预览版

    Fish Audio 发布 Fish Audio S2 Beta 预览版,采用基于 Qwen3 的 Dual-AR 架构,并结合 GRPO 强化学习对齐生成语音。

    推荐理由:提供 S2 Beta 的架构、推理、部署与微调变更清单,并列出模型参数、采样率、语言范围和流式性能指标,便于技术团队评估升级影响与部署条件。

1月9日周五
1月6日周二
  1. Gravy For The Brain29

    “Droids”到底是什么?Droids 与 Artificial Intelligence 有何区别

    文章借《星球大战》中的 Droids 类比 Artificial Intelligence,认为两者除名称外没有实质区别。Droids 是搭载程序的机器人形态,AI 可有实体,也可只是软件,本身不会思考或拥有通用智能。文章列举 AI Voice 在地图、语音助手、IVR、实时翻译和 TikTok 配音中的应用,但原文内容在讨论部分用途时截断。

12月30日周二
12月10日周三
  1. Image-Line News28

    FL Cloud Pro 有哪些新内容?

    FL Cloud Pro 相关页面汇集 FLEX 音色包、FL Studio 学习与教程,以及 Sounds、AI-powered Mastering 和 Distribution 等内容。页面还列出已发布的 FL Studio 2025,包含 500 条动态混音轨、Loop Starter 等新功能。

11月25日周二
  1. SuperCollider 官方发布57

    SuperCollider 3.14.1 发布

    SuperCollider 3.14.1 正式发布,修复了在类方法中将参数设为关键字参数时出现的错误。版本还更新了部分帮助文件,并改进 Boost 库集成、构建系统和 CI 管线;完整变更记录可在项目的 CHANGELOG.md 中查看。

9月15日周一
  1. plugdata 官方发布73

    plugdata 发布 v0.9.2-test3 最终候选版本

    plugdata 发布 v0.9.2 的最终候选版本 v0.9.2-test3,修复了 FFT、Lua、关闭过程及多项 DAW 与插件问题,并改进渲染性能和资源体积。版本引入 Heavy 对带空格路径的支持、插件商店、实验性 Gem 支持、多项工作流改进及 OWL、WASM Heavy 导出平台,同时包含 [knob] 破坏性变更。

    推荐理由:作为 v0.9.2 的最终候选版本,发布内容覆盖稳定性、渲染性能、资源体积与平台支持,并明确标注破坏性变更,适合升级前评估兼容风险与制作流程影响。

9月9日周二
  1. Music Industry Blog42

    Karra、Bifurcation与YouTube的收益:独立音乐人的平台分化分析

    电子音乐人Karra撤下一张投入10万美元制作的专辑,因流媒体版税仅占制作成本1%出头,转而聚焦YouTube并向音乐创作者销售内容。她解释经历的视频一周收入超过该专辑一年的流媒体收入,而专辑播放量已超过100万次。MIDiA分析称,流媒体困境可能推动更多独立音乐人转向YouTube和社交平台,并强化厂牌及专业团队的价值。

8月6日周三
  1. sonible Blog35

    learn:bundle 正式推出:五款 AI 音频制作工具助力混音学习与实践

    sonible 推出 learn:bundle,以五款 AI 驱动插件、引导说明和视觉反馈,帮助用户进行混音并理解制作流程。learn:EQ、learn:comp、learn:limit、learn:reverb 和 learn:unmask 分别用于均衡、压缩、限制、混响与频谱冲突处理,整套可试用 30 天。首发优惠价为 49,-(原价 199,-),优惠截至 2025 年 10 月 6 日。

7月1日周二
6月6日周五
  1. Music Industry Blog39

    AI未来:文化战争

    MIDiA发布迄今规模最大、最全面的AI报告,涵盖100多家公司和品牌、近30页分析。报告认为,AI正通过创作者、消费者和企业三条路径重塑娱乐业,企业应用已延伸至内容采购、版税与报告等流程,平台需为AI内容建立区隔。创作者关注点也将由内容生成扩展至灵感、协作、端到端创作、收尾及职业发展等完整工作流。

5月9日周五
3月25日周二
  1. Pro Sound Effects60

    游戏音频从业者圆桌讨论 2025 年的行业变化与应对

    游戏音频从业者 Mark Kilborn 与 Ville Sorsa 围绕 AI、预算缩减和玩家习惯变化展开圆桌讨论。两人认为小型核心团队、外包支持及跨部门协作将更受重视,AI 可用于占位配音、重复音效生成和音频修复,但目前尚不能取代人才。

    推荐理由:圆桌覆盖团队缩编、通用型人才、AI 音频工作流与跨部门协作,可供从业者评估组织调整和制作策略。

1月9日周四
  1. Pro Sound Effects47

    行业圆桌:2025年音频与创意媒体趋势

    行业专家与获奖声音艺术家围绕2025年音频及创意媒体趋势发表观点,认为沉浸式与空间音频、AI驱动工具、耳机播放优化和音频后期技能复合化正在塑造创作流程。对话增强工具正提升音频制作可及性,AI则被用于通过关键词或相似声音搜索定位音效。空间音频的广泛采用仍需时日,但相关工具正变得更加易用。

12月12日周四
  1. Pro Sound Effects44

    如何在2025年打造高效能的创意团队

    Pro Sound Effects的Jeremy Siegel与Kirk Wheeler、Paul Nicholson围绕打造高效能创意团队展开圆桌讨论,分享团队目标设定、协作与行业变化等经验。嘉宾认为,AI工具正快速增长,可用于概念构思、创意发想和自动化,但生成式AI在制作中的直接应用仍受法律顾虑限制,产品中的使用应予披露。