F5-TTS 1.1.17新增mmdit Flash Attention支持
F5-TTS 1.1.17为mmdit新增Flash Attention支持,并为preprocess_ref_audio_text增加show_info参数。版本还加入fused AdamW选项,在使用torch attention mask时提示内存用量,完整变更范围为1.1.16至1.1.17。
F5-TTS 1.1.17为mmdit新增Flash Attention支持,并为preprocess_ref_audio_text增加show_info参数。版本还加入fused AdamW选项,在使用torch attention mask时提示内存用量,完整变更范围为1.1.16至1.1.17。
声音艺术家 Dave Whitehead 分享其电影声音设计流程,通过理解导演愿景、遵循直觉,并为场景与角色建立声音身份来塑造作品 sonic identity。参与《Dune: Part Two》《Avatar: The Way of Water》和《A Minecraft Movie》的他,还谈到了技术及声音设计的未来。
REAPER v7.62 更新了 item locking,并全面重做标尺上方的区域与标记 lane。内容还涉及 Ruler Lane Manager、标尺与网格偏好、lane timebase、鼠标修饰键、插入与编辑时的 lane 选择,以及区域和标记管理器变化。
参考轨能通过持续对照,帮助混音者校正耳疲劳、房间染色和响度偏差,并减少无目的的反复调整。文章建议制作时每隔不超过15分钟进行一次A/B对照,混音比较前用LUFS短时值匹配感知响度;REFERENCE可自动更新匹配,CARBON Q则可分析参考曲的声调与音量平衡,并生成覆盖人声、音乐、鼓和贝斯的整曲预设。
Cardinal 于 2 月 28 日发布 26.02,修复部分 AU 主机中界面全黑、部分系统无法加载此前状态或补丁,以及少数模块颜色错误的问题。此次版本还更新了 Autinn 和 ZZC。
Scott LaBonte 与妻子 Kathleen 创办 Sheboygan Stories,以播客让无家可归者及服务人员讲述经历并持续回访。自2025年6月起,他已按双周更新22期;承载相关工作的日间中心关闭后,播客仍计划推动公众从理解无家可归问题转向实际行动,可通过网站、Apple Podcasts 和 Spotify 收听。
FLEX 推出 Drift Phonk,现已可用。原文未说明其具体内容、版本、价格或获取方式。
plugdata 发布 v0.9.3-1 补丁版,修复影响稳定性和项目加载的多项问题。更新涵盖 Windows 全局缩放崩溃、Linux 商店下载故障、GM synth、图节点文本渲染及 pdlua setmultiout,并处理 DAW 工程加载、补丁版本迁移和文本/代码编辑器异常。
混音冲击力不足通常源于频率冲突、过早压缩、动态对比不足或缺少参考,而非单纯音量不足。教程建议先用 REFERENCE 与 LEVELS 核验,再用 FUSER 处理动态遮蔽,以 FASTER MASTER 的 Transients 少量塑形,并通过段落留白建立对比;同时介绍这些工具在 CARBON Q 中的配置与操作。
Ableton Live 12.2 更新后,作者制作了 Resonators 音频效果器的完整使用演示,并分享5种声音设计示例。教程涵盖将鼓组变为旋律打击乐、为 vocal 或主奏添加尾音、重塑 bass、模拟复古录音,以及制作闪烁的 drone;还结合 Envelope Follower、LFO、Reverb、Saturator 和 Limiter 等设备说明具体设置与用途。
SBP_ReaWhoosh 是用于生成 Whoosh 音效的免费 ReaScript/JSFX,提供直观的参数调整、试听与随机化功能。安装后可在 Action list 中运行脚本,建立时间选区并点击 Generate,满意后通过 Bounce 将音频渲染到新轨道;该脚本还需要通过 ReaPack 安装 ReaImGui。
sonible 推出免费饱和插件 puffer:fish,通过 Puffiness 调节施加的压力,让声音变得更密实、饱满且饱和。Character 提供 Tinyfin、Spikeskin 和 Twitchgill 三种声音特征,分别侧重柔和温暖的泛音、粗粝锐利的失真,以及由温暖逐步转向强烈多变的饱和效果。
F5-TTS 1.1.16通过在 mel 域处理修复语音编辑边界伪影,并新增拉脱维亚语模型。该版本还支持 CLI 使用 hf:// 链接,调整训练样本的 GT mel 频谱尾部 padding、YAML 配置 wandb 参数,并优化 DiT 文本嵌入处理。
plugdata 发布 v0.9.3,新增 Windows ASIO、Arch 与 openSUSE arm64 构建,并更新 heavylib 0.4.1。版本主要修复 Heavy、iOS、对象、插件与 DAW 兼容问题,包括 Heavy→Daisy 导出、Logic 键盘焦点、Ableton Live 保存 MIDI 片段崩溃及高于 48kHz 采样率稳定性。
推荐理由:本次更新覆盖平台、Heavy、iOS、预制插件及多种 DAW 兼容性,集中修复导出、参数、延迟、崩溃和界面缩放问题;对插件开发与跨平台使用具有直接维护价值。
游戏玩家会敏锐注意声音细节,并据此评判音效质量。合理运用音效能够影响玩法体验与沉浸感,但原文未进一步说明具体方法。
Jes Ankarfeldt 的 ReaScript 项目可自动检测视频中的镜头切换,显示切换前后画面,并支持命名、着色及批量导入 REAPER 标记、区域或 take markers。
Csoun 7.0.0-beta.13 修复了 UDO 弹出问题,并解决 mp3len 中文件被重复关闭的错误。版本还更正了 sc_lagud 别名条目的拼写,更新 MIDI 默认乐器,并修复了 newstyle 按值传递问题。
REAPER Blog 围绕Joey Sturgis分享的粉红噪声钹声技巧,演示其在混音中的用法,并尝试多个插件。视频包含SmoothOperator演示、其他插件测试及一个免费的REAPER专属替代方案;作者说明其使用的SmoothOperator版本已不再提供,并引导观众了解Smooth Operator Pro。
White Tie 推出 WT Graphical Sends Script,用于管理 REAPER 所选轨道的 sends 和 receives。脚本可通过快捷键快速向最近使用的轨道发送信号,需 REAPER v7.53 或更高版本,并将窗口停靠于 TCP 左侧;脚本免费,可下载最新版。
文章批评将一切艺术与娱乐统称为“内容”的观念,认为创作者和权利方因此受制于平台算法与商业模式。“双重V”模式持续推动创作、发布和传播,却主要让平台受益,并使创造力被简化为流程和算法。
文章讨论在配音试音和样带开头加入姓名及录音目的的 slate,认为它能让选角导演识别身份、了解录音意图,并立即展示自然声音与另一种表演之间的范围。文章建议通常使用自然声音报出姓名和目的,但若客户、选角导演或 P2P 网站要求使用角色声音、特定口音或禁止 slate,应优先遵守要求。
Cardinal 发布 26.01,新增 3 个由 nooneknowspeter 制作的示例补丁和 1 个由 SpotlightKid 制作的示例补丁。版本修复了连接 OSC remote 时的崩溃问题、wasm 音频输入质量问题,并重做文档与配置目录查找流程;macOS 构建已签名并公证。
推荐理由:这次更新补充示例补丁并修复 OSC、wasm 音频输入等问题,同时改进文档与配置目录查找;对插件使用和跨平台构建维护具有直接参考价值。
Piper TTS v1.4.0 新增基于 g2pW 的中文音素化支持,并使用原始模型的动态量化版本。中文音素化可指定 pinyin,也可直接使用 IPA phonemes,不经过 espeak-ng;训练新增预生成 phoneme ids、音素映射与符号数量配置,并支持仅恢复 vocoder params。
Freesound 发布 2025 年社区统计:全年上传 47,068 个声音,总时长 1,494 小时;平台累计托管 714,671 个声音,下载量达 23,729,327 次。团队基于新推出的 Broad Sound Taxonomy 分析上传内容,指出 Sound Effects 是最大类别,Speech 最少;2025 年新上传声音的 CC0 许可占比达到 72%。
FLEX Beat Scene现已推出,Image-Line News发布该产品上线消息。原文未说明其预设数量、声音类型、适用平台、价格或获取资格,也未提供进一步功能介绍。
Freesound Team现已发布Freesound Day演讲视频,供 interested participants 在线观看。活动于2025年10月28日在巴塞罗那Campus Poblenou举行,并同步开放线上参与,内容包括演讲、聆听和声音实践交流。演讲视频涵盖艺术家、研究者、开发者和声音爱好者的分享;参赛作品计划于未来几周陆续发布。
Csound 7.0.0-beta.11 发布,修复 UDO、全局 UDT 变量、性能回归及数组表达式等问题。该版本新增 Windows 32 位 MinGW 与 MSVC 构建,修复 WebAudio 麦克风输入和 WebMidi,并移除 ScriptProcessorNode 支持。
推荐理由:更新涉及 WebAudio、WebMidi、UDO、OSC 与多平台构建等兼容修复,可帮助使用方评估测试、部署和现有代码迁移风险。
Mark Mulligan认为,生成式AI音乐正在扩大创作人群并改变音乐产业的生产与消费结构。2025年,AI音乐用户已占音乐创作者的10%,相关付费用户数量翻倍;文章同时指出,AI引发的授权争议仍在持续,行业需要决定参与还是与其分离。
Production Advice 制作视频,对比本周英国 Top 20 中三首歌曲,探讨响度强化对音乐声音的影响。视频以 K-Pop Demon Hunters 原声中的“Golden”为例,比较其现有响度处理与改善动态后的听感差异。
Drive On Podcast主理人Scott DeLuzio通过Zapier、Calendly和SquadCast建立自动化流程,在嘉宾预约后自动创建录音室并发送提醒,同步日程安排。自2019年6月以来,节目已持续推出550期;其网站还提供聊天机器人,帮助退伍军人按困扰查找相关节目。
Helgobox 发布 v2.18.3-pre.1,修复 2.18.2 引入的退出时静默崩溃,并更新 ReaLearn。新版本支持添加实例标签、让“Enable/disable instances”目标使用这些标签,并新增“Enable/disable units”目标以控制当前实例内的 units。
DecentSampler 1.15.2 新增基于 Karplus-Strong 算法的 Pluck Oscillator,可在无需音频采样的情况下生成拨弦声音。该振荡器提供 Damping 和 Pluck Type 两个可绑定参数,并支持通过 ADSR 包络控制余响;相关实现以 MIT 许可证开源,预设需指定 minVersion="1.15.2"。
推荐理由:Karplus-Strong 拨弦振荡器为采样制作提供新的物理建模路径,Damping 与 Pluck Type 的映射方法及 MIT 开源信息对音色设计和预设开发有直接参考价值。
Polyphone 2.5.1在合成器模式中让通道10使用 bank 128,并更新波兰语翻译。该版本修复了异常长注释导致崩溃、GUI 与 MIDI 信号交互导致崩溃的问题,同时移除了可能不适用于所有 CPU 的构建优化。
Polyphone 2.5.0 新增“play with”功能,可同时演奏多个乐器或预设,并加入循环点交叉淡化、合并预设内全部乐器或采样生成 sample、sfz 的 release 触发以及 MIDI bank/preset 选择支持。该版本还改进自动循环精度、键盘与录音器窗口状态恢复、sf2/sf3 按 preset 导出、声音引擎溢出处理、多标签页管理和多处树视图显示问题。
推荐理由:版本更新覆盖多乐器与预设播放、循环点交叉淡化、release 触发及 sfz 支持,并改进自动循环、导出、溢出处理与状态恢复,对采样制作和预设管理有直接工作流价值。
Ubuntu Studio 25.04“Plucky Puffin”已于1月15日停止支持,所有 Ubuntu 25.04 版本均不再获得包括安全更新在内的任何更新。用户应尽快按官方指引升级至 Ubuntu Studio 25.10;中间版本支持期为9个月,而官方 Ubuntu flavors 的 LTS 版本支持期为三年。
sonible 与 Solid State Logic 推出 autoSeries 插件系列,将 SSL 4000 E 建模与 sonible 智能音频分析结合,用于生成可编辑的混音处理起点。系列包括 autoEQ、autoDYN 和 autoBUS,现已提供优惠 introductory pricing、个人永久授权、完整套装及 SSL Complete Access 订阅包含版本。
Castos在第二期Creator Spotlight中介绍Laura Edralin与制作人Heidi Cullip共同打造的《The Life of Letters Podcast》。节目围绕书法、历史字母、手写信与慢生活展开,对话也涉及可持续创作、职业倦怠及长期实践。Laura建议提前规划、遵守截止日期,并通过批量制作提升播客制作效率。
Ableton Live 12.3 改进了多剪辑音频编辑、空白 MIDI 填充、标签搜索与侧栏显示等细节功能。文章还提供 Windows 上尝试加速高质量 stem separation 的 Options.txt 命令,但仅表述为可能提升性能。
文章建议仅在商业广告等明确需要的配音中去除呼吸声,并先向雇主、客户或委托方确认。处理时应区分将呼吸声静音与删除其占用的音频时间,保留自然停顿和表演的人性特征。噪声门或扩展器在清理环境噪声时也可能误删呼吸声,文章因此建议改善录音环境而非依赖这类工具。
Gravy For The Brain 按预算评测适用于初学者、中级及高级配音创作者的麦克风,并将 Sennheiser MK4 列为工作配音演员的首选推荐。文章比较 USB、动圈和大振膜电容麦克风的音质、耐用性与使用成本,同时说明 cardioid 等指向性、幻象供电、XLR 平衡连接及音频接口等录音配置。