跳到正文

全部动态

今日 4 条
9月7日周一
  1. JUCE 官方发布65

    JUCE 9.0.2 发布,修复音频格式与多平台兼容问题

    JUCE 9.0.2 发布,默认启用 MP3AudioFormat,并修复读取带 padding 的 MP3 VBR 文件和缺失末尾 pad byte 的 WAV 文件等问题。版本还改进了 OpenGL 渲染性能,修复 CoreAudio、VST3、UMP sysex7 及多目标 Xcode 项目相关问题,并新增 SECURITY.md 和软件物料清单。

    推荐理由:这次更新覆盖 MP3、WAV、CoreAudio、VST3、OpenGL 与 Xcode 多目标项目等兼容性修复,并默认启用 MP3AudioFormat;对插件开发、跨平台构建和音频格式处理具有直接维护价值。

9月6日周日
  1. sherpa-onnx 官方发布74

    sherpa-onnx v1.13.7 发布更新多平台与语音识别功能

    sherpa-onnx v1.13.7 修复 iOS、Windows arm64、CI 构建及在线标点模型初始化问题,并新增 Rust 的 iOS 支持、hello world Tauri 示例和 JavaScript API 的批量解码。

    推荐理由:本次更新覆盖多平台构建、Rust 与 JavaScript API、流式识别及模型兼容性,能帮助使用者评估跨平台部署与识别接口调整带来的工程影响。

9月5日周六
  1. FunASR61

    FunASR v1.4.14发布并配套runtime-llamacpp-v0.2.6跨平台运行时

    FunASR v1.4.14发布,修复Git归档和源码安装的便携源码包问题,并更新MOSS-Transcribe-Diarize文档与实时、工业部署指南。

    推荐理由:本次发布同时提供FunASR Python包、llama.cpp跨平台预编译运行时及SHA-256校验信息,并更新部署文档,对语音识别模型的安装、部署和资源核验流程有直接参考价值。

  2. Piper TTS67

    Piper 发布 v1.8.0,新增基于 TLTK 的泰语 phonemizer

    Piper v1.8.0 新增基于 TLTK 的泰语 phonemizer,训练时可使用 th extra --data.phoneme_type thai,合成时可在 voice config 中设置 "phoneme_type": "thai"。

    推荐理由:新增基于 TLTK 的泰语 phonemizer,明确训练配置、语音配置及 IPA warmstart 兼容性,并同步补充安装脚本与 CI 测试,能直接影响泰语 TTS 的训练和合成流程。

9月4日周五
  1. Podnews59

    Apple Podcasts 更新网站嵌入式播放器

    Apple Podcasts 更新了网站嵌入式播放器,支持嵌入单集或整档节目,并兼容视频和预告片。来自 Apple Podcasts 网页嵌入的播放不会显示在 Apple Podcasts Connect Analytics 中,但会出现在播客托管方的统计中。

9月3日周四
  1. Audacity 官方发布76

    Audacity 3.7.9 补丁版本更新 Windows ASIO 与 FFmpeg 9 支持

    Audacity 3.7.9 为 Windows 构建启用 ASIO,并新增 FFmpeg 9 支持。该补丁版本修复了磁盘空间不足、驱动器断开和未保存恢复项目关闭时的项目损坏与数据丢失问题,还处理了实时效果器崩溃、MIDI 播放位置、失败录音、片段速度和字体配置导致的冻结;此前发布的手册因基础设施问题损坏后已替换,不涉及安全风险。

    推荐理由:为 Windows 录音链路和项目稳定性提供明确更新依据,尤其适合排查 ASIO、设备记忆、项目损坏、实时效果器崩溃及 MIDI 播放位置问题;FFmpeg 9 支持也影响导入兼容性。

9月2日周三
  1. Blubrry Podcasting61

    Blubrry Publisher支持单次上传MP4并生成HLS与MP3播客

    Blubrry Publisher现可让托管客户上传一个MP4视频单集,并自动生成适配Apple Podcasts的1080p HLS视频、保留原视频及生成MP3音频,三种格式共用同一RSS feed。该工作流适用于Blubrry hosting客户,暂不支持PowerPress;使用前需将Apple Podcasts Connect API key关联至Blubrry,发布后需等待处理完成。

    推荐理由:Blubrry Publisher将单次MP4上传转为HLS、原视频和MP3并纳入同一RSS,能减少双版本发布流程;对播客制作、托管及音视频分发人员有直接参考价值。

  2. FunASR66

    FunASR v1.4.13 发布,新增 n8n OpenAI 音频转写支持

    FunASR v1.4.13 新增服务端对 n8n OpenAI 音频转写的支持,并修复 ONNX 依赖错误、实时 VAD 部分结果超时及 NumPy 2 ABI 不匹配等问题。该版本配套当前预构建 llama.cpp / GGUF 运行时,提供 Linux、macOS 和 Windows 多平台资源;Python 用户可安装 funasr==1.4.13。

    推荐理由:新增 n8n OpenAI 音频转写支持并修复运行时、VAD 与依赖问题,配套多平台预编译资源,对语音转写流程集成和部署维护有直接参考价值。

9月1日周二
  1. MLX Audio61

    MLX Audio 发布 v0.5.1,更新多款 AI 语音模型与音频处理

    MLX Audio 发布 v0.5.1,加入 Breeze-TTS-2、Phonon-1 STT、Granite Speech 5.0 STT、Audio8-TTS-Preview-0.1b 等模型支持,并为 VibeVoice 增加流式生成。版本还修复 Qwen3-TTS、Whisper、Qwen3-ASR、CAF 解码及 log-mel 频谱图等相关处理逻辑。

    推荐理由:本次版本更新集中修正 TTS、STT、音频解码与采样流程,并新增多种语音模型和流式生成支持,对 AI 语音制作与模型部署流程具有直接参考价值。

8月30日周日
8月24日周一
8月22日周六
  1. Pro Sound Effects65

    SoundQ 更新:优化音效库工作流与离线使用

    SoundQ 新增将集合导出为 CSV、设置 Watched Folders 扫描偏好、启用或禁用波形区域选择,以及从音效返回原始文件夹或集合的功能。更新还扩展了传入 Media Composer 的元数据字段,并支持登录一次后离线使用;云端集合的整体改版计划于今年晚些时候推出。

    推荐理由:新增集合导出、扫描控制、波形选择开关与来源定位,并改善元数据传递和离线使用,直接影响大型音效库的整理、检索与协作效率。

8月21日周五
8月20日周四
  1. whisper.cpp 官方发布73

    whisper.cpp 发布 v1.9.3 更新

    whisper.cpp 发布 v1.9.3,修复短音频 log_mel_spectrogram 的堆越界读取,并拒绝张量头中无效维度以防范畸形模型文件导致的栈缓冲区溢出。版本同时更新 CUDA、SYCL、Metal、Vulkan、OpenCL、WebGPU 等后端与 ggml 相关功能;官方注明语义化版本机制仍在完善中。

    推荐理由:本次发布包含语音工具的安全修复,以及多后端、量化格式和推理执行方面的兼容调整,对升级排查与部署验证具有直接参考价值。

8月19日周三
  1. Kokoro ONNX 官方发布68

    Kokoro ONNX 发布 model-files-v1.1 模型文件

    Kokoro ONNX 发布 model-files-v1.1,提供 Kokoro v1.0 与 v1.1-zh 的全精度、FP16 和 INT8 ONNX 文件,以及对应语音包。

    推荐理由:三种精度文件及体积、相关性和语音包信息便于部署选择;时长输出、浮点速度输入与图内嵌配置还能直接改善时间戳生成、变速稳定性及分发完整性。

8月18日周二
  1. Podnews67

    YouTube改变视频“播放次数”的计算方式

    YouTube将从8月24日起,在视频从首帧开始播放时计入公开view,创作者仍可使用“engaged views”。YouTube Studio及创作者分析、报告API保留engaged views,但公众页面和YouTube Public Data API不再提供,第三方数据公司也难以获取。Spotify同时表示,示例中不可跳过的15秒广告是错误,Free和Premium用户均可跳过。

8月14日周五
8月13日周四
8月12日周三
  1. Blubrry Podcasting47

    如何根据发布方式选择合适的 Blubrry 托管方案

    Blubrry 推出按每月内容发布时长计费的新托管方案,创作者可结合单集时长与月更频率选择套餐,并随节目增长升级。音频、视频或音视频节目均适用同一计费模式,还可使用 Vid2Pod 将 YouTube 视频转为播客;多档节目、无限存储及 Dynamic Ad Insertion 等需求可考虑 Professional Hosting。

8月11日周二
  1. sherpa-onnx 官方发布76

    sherpa-onnx 发布 v1.13.5 更新模型、运行时与多平台支持

    sherpa-onnx 发布 v1.13.5,更新 Nemotron、Moonshine、Inflect 等模型支持,并改进 QNN、WebAssembly、SPM、Flutter 和多平台构建。此次版本还修复 ScaleSilence、Piper TTS、Paraformer、FireRedASR、Pyannote 及多项崩溃、内存和数值计算问题。

    推荐理由:本次更新覆盖模型导出、QNN 与多平台运行时,并集中修复 ASR、TTS、VAD 和音频处理中的稳定性与兼容性问题,对部署和制作流程有直接参考价值。

  2. Podnews69

    YouTube将合作伙伴计划广告收入资格门槛翻倍

    YouTube宣布,新创作者申请YouTube Partner Program需在最近一年获得8,000个合格观看小时,或在最近90天获得2,000万次合格Shorts观看,两个门槛均为此前要求的两倍。文中还提到,Acast正私下与Spotify沟通广告跳过功能的推出与定位,Magellan AI则报告播客广告收入同比增长23%,平均广告占比升至8.75%。

  3. MLX Audio59

    MLX Audio v0.4.8 更新语音与音频处理能力

    MLX Audio 发布 v0.4.8,更新 Nemotron VoiceChat 编解码器并改进 Nemotron ASR 流式处理。版本还修复 Whisper generate 未知解码选项、Qwen3-TTS 非预期 float32 升精度、Higgs Audio v3 模型类型解析等问题,并调整 Kitten TTS 五条解码路径以匹配 PyTorch 参考语义。

8月10日周一
  1. JUCE 官方发布66

    JUCE 9.0.1 更新 WebView 集成并修复多平台问题

    JUCE 9.0.1 新增用于 WebView 集成的 TypeScript npm package,并增加对格式错误 AudioFormat 输入的保护。该版本还修复 Xcode 12.4 下的 iOS 构建、旧版 Linux 发行版中的 Freetype 编译、macOS 文档图标、Linux GUI 无响应及 CoreAudio 编译问题。

    推荐理由:这次更新补充了 WebView 集成包与 AudioFormat 输入防护,并集中修复多平台构建、编译、图标和 GUI 无响应问题,有助于开发者评估升级影响。

8月7日周五
  1. sherpa-onnx 官方发布73

    sherpa-onnx 发布 v1.13.4,新增 QNN 支持并修复 Windows 路径问题

    sherpa-onnx 发布 v1.13.4,导出 Parakeet、Whisper 和 nemotron-speech-streaming-en-0.6b 等模型至 QNN,并加入对应 C++ 运行时支持。

    推荐理由:本次更新覆盖 QNN 模型导出与 C++ 运行时、Windows 路径兼容和 ASR 结果处理,并扩展 JavaScript 非流式 API 的逐流热词支持,对部署与语音识别集成有直接参考价值。

8月6日周四
  1. Synth and Software48

    Ravine DSP 发布 Inter::State V1.3 插件宿主

    Ravine DSP 发布 Inter::State V1.3 插件宿主,用于集中承载已有效果器并减少浮动窗口和零散 MIDI 映射。新版 Slot Scenes 每个插槽可保存八个音色状态,并在状态间切换、变形或按速度交叉淡化;效果链、宏控制与调制可在任一 DAW 和工程中恢复至原有状态。

8月5日周三
  1. Podnews62

    Acast 与 Buzzsprout 扩展播客视频服务

    Acast 开放所有创作者向 Apple Podcasts 发布视频,Buzzsprout 将视频托管扩展至 Apple Podcasts、YouTube 和 Spotify。Acast 称加入视频后 Apple Podcasts 周会话数估计增加约 25%;Acast 视频方案年付起价为每月 39.99 美元,Buzzsprout 音视频方案年付起价为每月 25 美元。

8月4日周二
  1. whisper.cpp 官方发布64

    whisper.cpp 发布 v1.9.2,更新 VAD 与 CJK 支持

    whisper.cpp 发布 v1.9.2,改进了 VAD 语音分段、时间戳映射和参数解析,并使 voice_length() 支持 UTF-8 CJK。版本还涉及 Parakeet、Android 示例推理性能、Ruby 语音分段 API 及 Nix 构建修复。

    推荐理由:本次更新覆盖 VAD、CJK 文本处理、Android 推理性能与构建兼容性,并新增 Ruby 的语音分段 API,对语音识别工具的集成和部署维护具有直接参考价值。

8月3日周一
  1. MLX Audio63

    MLX Audio v0.4.7 更新模型支持与响度校准

    MLX Audio 发布 v0.4.7,新增 arktts(Audio8-TTS-Preview-0.6b)和 Chatterbox Multilingual v3,并加入按类型分类受支持音频模型的 registry。版本还修复 BS.1770 响度计算遗漏 997 Hz 校准锚点的问题,修正 MLX 服务器模型加载线程归属,并更新 transformers 依赖至 5.14.0。

8月1日周六
7月29日周三
  1. Zrythm 官方发布67

    Zrythm v2.0.0-alpha.2 增加和弦编辑与节拍拉伸功能

    Zrythm v2.0.0-alpha.2 新增支持预设与音阶的 Chord pad、可放置和编辑和弦对象、和弦建议引擎及和弦轨录音,并可离线拉伸音频片段以跟随项目速度。 版本加入力度渐变工具、插件通用参数编辑器、实时安全显示系统和音频线程自动化处理,也修复了自动化曲线失真、插件实例化失败及 Linux ALSA 长时间运行崩溃等问题。

    推荐理由:该版本更新 Chord pad 和弦编辑、节拍拉伸、MIDI 力度编辑及插件参数窗口等制作流程,并修复音画同步、自动化曲线、插件实例化与界面布局问题,对 DAW 用户评估兼容性有价值。

7月27日周一