跳到正文

#AI 音频

今日 10 条
9月30日周三
9月29日周二
  1. Complete Music Update60

    新闻组织在OpenAI版权诉讼中反驳美国司法部“合理使用”立场

    包括《纽约时报》在内的新闻组织提交法庭文件,反驳特朗普政府司法部在OpenAI版权案中关于AI训练构成合理使用的立场。组织提出四项论点:司法部忽视案件材料与专家意见、以国家安全为政策依据、夸大许可成本,并忽略美国版权办公室的研究。相关争议也可能影响音乐行业针对Suno、Udio和Anthropic等公司的诉讼。

  2. Blubrry Podcasting37

    Podcast Insider 探讨播客制作中如何使用 AI,以及何时应划清界限

    Podcast Insider 的 Mike Dell、Dave Clements 与 MacKenzie Bennett 分享各自在播客制作中使用 AI 的方式,涵盖转录、章节生成、节目摘要、音频清理、研究和图片编辑。嘉宾强调应始终人工审核 AI 输出,并在辅助创作与用 AI 取代创意过程、削弱创作者声音及观众信任之间划清界限。

9月28日周一
  1. MusicRadar29

    Fred Again 批评 AI 音乐:创作过程才是魔法

    英国电子艺人兼 DJ Fred Again 表示,自己完全没有动力尝试 AI 音乐工具,因为创作过程承载着他的身份认同与自我发现,把这一过程交给机器与他所热爱的事物背道而驰。他于 25 日通过 Instagram Stories 分享这些近一年前写下的笔记,并称反复追逐想法才是创作的核心,“过程才是魔法”。

9月27日周日
9月25日周五
  1. DTM Station83

    MOTU Digital Performer 12 实测:新增 Dolby Atmos、AI 声部分离与 MusicXML

    MOTU 的 Digital Performer 12 于9月18日推出,新增 Dolby Atmos 沉浸式混音、AI 声部分离和 MusicXML 导入导出。

    推荐理由:文章实测了六类 AI 声部分离及 MusicXML 对歌声合成器与乐器的联动,并梳理 Atmos、编曲工具、授权价格与系统要求,能为升级和跨软件工作流决策提供直接依据。

9月24日周四
  1. Pro Sound Effects50

    Pro Sound Effects加入Professional Sound Alliance,推动媒体与AI领域专业音效的公平授权

    Pro Sound Effects加入Professional Sound Alliance(PSA),参与推动媒体与AI领域专业音效的公平授权。PSA由音效设计师、艺术家、录音师、混音师及音效库公司等组成,关注未经许可抓取音效库训练商业AI模型,以及影视和游戏中未获授权使用声音的问题;音效专业人士、工具商、软件公司和工作室可在professionalsoundalliance.org签署请愿。

9月23日周三
9月22日周二
9月18日周五
  1. FunASR69

    FunASR 1.4.16 发布:改进混合设备推理与 Transformers 指南

    FunASR 1.4.16 改进混合设备推理,保留 vad_kwargs、punc_kwargs 和 spk_kwargs 的设备配置,运行时覆盖不再修改已加载模型。新版本补充经测试的 Transformers 中英文指南,明确标点后处理需求,并附带 runtime-llamacpp-v0.2.6 的九项预编译运行时资源;测试不代表 CUDA、MPS 或 NPU 性能认证。

    推荐理由:更新明确修复重复推理中的设备配置传播问题,并补充 Transformers 使用与标点后处理指南,有助于部署者排查多设备推理和原生运行时的兼容边界。

9月14日周一
9月11日周五
  1. whisper.cpp 官方发布73

    whisper.cpp 发布 v1.9.4

    whisper.cpp v1.9.4 已发布,Nightly build 为 b5130。更新调整了语言自动检测与解码器状态管理,使服务端在检测响应中返回语言,并修复 whisper_mel 未初始化读取和空输入等问题。版本还增加 Windows On ARM 发布支持、更新 OpenVINO 模型转换与文档,并调整多个后端和 CI 配置。

    推荐理由:此次发布补强语言检测与服务端响应,并修复重复调用、缓存和输入读取问题,同时更新 OpenVINO 支持及多平台构建配置,对语音识别部署与维护有直接参考价值。

9月10日周四
  1. Ableton Blog71

    Machinedrum 谈 BL00MS、Ableton Live 与移动创作流程

    Machinedrum(Travis Stewart)在最新迷你专辑 BL00MS 创作访谈中说明了 Ableton Live、Note 与 Max for Live 的工作流,并分享移动采idea、hocket 编排和插件替代方法。

    推荐理由:访谈呈现从 Impulse Tracker 到 Live、Note 与 Max for Live 的工作流演变,hocket、设备替换和 A/B 复现等细节,对电子音乐制作决策较有参考价值。

9月9日周三
9月8日周二
9月6日周日
  1. sherpa-onnx 官方发布74

    sherpa-onnx v1.13.7 发布更新多平台与语音识别功能

    sherpa-onnx v1.13.7 修复 iOS、Windows arm64、CI 构建及在线标点模型初始化问题,并新增 Rust 的 iOS 支持、hello world Tauri 示例和 JavaScript API 的批量解码。

    推荐理由:本次更新覆盖多平台构建、Rust 与 JavaScript API、流式识别及模型兼容性,能帮助使用者评估跨平台部署与识别接口调整带来的工程影响。

9月5日周六
  1. Piper TTS67

    Piper 发布 v1.8.0,新增基于 TLTK 的泰语 phonemizer

    Piper v1.8.0 新增基于 TLTK 的泰语 phonemizer,训练时可使用 th extra --data.phoneme_type thai,合成时可在 voice config 中设置 "phoneme_type": "thai"。

    推荐理由:新增基于 TLTK 的泰语 phonemizer,明确训练配置、语音配置及 IPA warmstart 兼容性,并同步补充安装脚本与 CI 测试,能直接影响泰语 TTS 的训练和合成流程。

9月2日周三
  1. Sawayaka Trip85

    Native Instruments 品牌归属变化与用户影响梳理

    Native Instruments 集团已拆分,主体归入 inMusic,iZotope 归 Boris FX,Plugin Alliance 与 Brainworx 由 Dirk Ulrich 买回,现有许可和认证据文中说明继续有效。文章整理了开发与支持重编、裁员,以及对 Maschine、Traktor 和 Kontakt 后续发展的不同解读。

    推荐理由:梳理品牌拆分、许可连续性与支持重编等可验证变化,并并列呈现开发承诺、人员削减及社区解读,为现有用户评估长期风险提供决策依据。

  2. Music Technology Policy51

    独立评论要求审查拟议录音制品V Subpart B和解费率的经济依据

    美国版权版税委员会收到CRAE对拟议录音制品V Subpart B和解协议的评论,质疑沿用既有费率是否足以支持2028–2032年费率。文章认为,申请批准和解的各方应提交经济分析、宣誓陈述及重大商业安排披露等补充材料,供委员会判断其合理性;CRAE也提出AI对独立创作者和产业经济的影响等问题。

  3. Bobby Owsinski Production Blog35

    制作人兼工程师Bruce Sugar谈与Ringo Starr、Joe Walsh及Ozzy Osbourne合作

    制作人兼工程师Bruce Sugar在播客中讲述与Ringo Starr建立持续二十多年合作关系的过程,以及Ringo、Joe Walsh和Ozzy Osbourne相关录音经历。他分享工作流从剪带转向盒内制作、Atmos混音和AI辅助写歌,并讨论技术、表演与音乐价值之间的平衡。音频可通过bobbyoinnercircle.com及多个播客平台收听,视频版已在YouTube上线。

8月31日周一
  1. Bobby Owsinski Production Blog52

    Sonible推出智能通道条插件smart:chain

    Sonible推出smart:chain,将输入电平调整、EQ、压缩、门限、去刺耳和饱和等八个智能处理器整合到一个通道条中。多实例可跨会话通信,支持Front、Middle、Back深度分层与全局Auto Leveling。插件支持Mac和PC的VST3、AU、AAX格式及最高192kHz采样率,当前优惠价为99美元,原价179美元。

8月24日周一
8月20日周四
  1. Ableton Blog65

    Sudan Archives 展示传统弦乐与现代制作工具的创作现场

    Sudan Archives 在 Ableton 短片中展示工作室,并讲解如何将传统弦乐技法与 Ableton Live、Move 和其他设备结合。她使用无线系统、音箱踏板、干声录音、声像与自动化制作多层编曲,也分享了在 AI 时代维持创作意图与技术平衡的看法。

    推荐理由:文章通过工作室参观与访谈,具体呈现小提琴、Move、Ableton Live及效果器如何参与写作、录音和混音,为独立音乐创作者提供可参考的技术流程与现场配置思路。

8月19日周三
  1. Kokoro ONNX 官方发布68

    Kokoro ONNX 发布 model-files-v1.1 模型文件

    Kokoro ONNX 发布 model-files-v1.1,提供 Kokoro v1.0 与 v1.1-zh 的全精度、FP16 和 INT8 ONNX 文件,以及对应语音包。

    推荐理由:三种精度文件及体积、相关性和语音包信息便于部署选择;时长输出、浮点速度输入与图内嵌配置还能直接改善时间戳生成、变速稳定性及分发完整性。

8月18日周二
  1. sherpa-onnx 官方发布70

    sherpa-onnx 发布 Flutter 演示与多平台构建资源

    sherpa-onnx 发布 Flutter Web 演示及面向 Android、Linux、macOS、Web 和 Windows x64 的可下载资源。内容覆盖 Silero VAD、文件与麦克风输入的 VAD+ASR,以及离线和在线标点恢复,并列出 FireRed ASR、FunASR Nano、Whisper、NeMo Parakeet、Qwen3 ASR 等模型。

    推荐理由:集中提供跨平台 Flutter 示例与模型组合,便于开发者按文件、麦克风及标点恢复场景验证 VAD、ASR 和标点处理流程。

8月16日周日
  1. Mastering The Mix73

    如何在混音时避免 AI Stems 失去原有平衡

    Suno Studio 2.0 支持 Premier 导出无数量限制的 32-bit WAV 或 MP3 多轨及单独 stem,为 AI 音乐进入 DAW 混音提供了更完整的素材入口。文章建议先确认轨道对齐并降低电平,再处理串音、相位抵消和动态冲突;对分离伪影应采用窄带、局部处理,并以参考曲目和实际听感验证最终混音。

    推荐理由:文章把 AI stems 导入 DAW 后的增益、相位、串音和分离伪影拆成可执行的处理顺序,并强调用参考曲目校准判断,适合制定混音工作流。