Audio Decomposition是什么?一文让你看懂Audio Decomposition的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

Audio Decomposition概述简介

Audio Decomposition是音频处理技术,基于傅里叶变换和信封匹配将音乐中的各个音符和乐器分离,实现音乐到乐谱的转换。Audio Decomposition开源项目是Matthew Bird推出的,无需外部乐器分离库,自动识别和分离音乐中的不同乐器声音,帮助用户更好地理解和重现乐谱。

Audio Decomposition的功能特色

音频源分离:将混合音乐中的不同乐器声音分离出来。

音乐转乐谱:将音乐文件转换成乐谱,帮助用户识别音高和和弦。

音频分析:分析音乐中的音符和乐器,提供音乐结构的深入理解。

开源工具:作为开源项目,支持用户自由使用和修改代码,适应不同的需求。

Audio Decomposition的技术原理

傅里叶变换:程序每0.1秒对音乐文件进行一次傅里叶变换,生成频谱图。将每种乐器的傅里叶变换相加,重新创建音乐的频谱。

包络分析:将声波分成几块并取每块的最大值获取包络。进一步优化结果,找到包络低于原始声波的点,添加新点定义包络。

信封的分解:将波的包络分解为起音(攻击)、延音(持续)和释音(释放)。

波形分类:考虑乐器的静态衰减和动态变化,及是否有释音。

带通滤波:对每个音符频率的信号进行带通滤波,分离特定乐器的声音。

互相关和均方误差(MSE):用乐器的起音和释放的互相关找到每个音符的开始和结束。计算乐器波和滤波后的音频的MSE,获得乐器的成本。

Audio Decomposition项目介绍

项目官网:matthew-bird.com/blogs/Audio-Decomposition

GitHub仓库:https://github.com/mbird1258/Audio-Decomposition

Audio Decomposition能做什么?

音乐教育:分离不同乐器的声音,帮助学生更直观地理解音乐作品中的和声与配器。

音乐制作:支持制作人从复杂的音乐中提取单独的音轨,用在混音或创作新的音乐元素。

乐谱转录:自动将音频记录转换为乐谱,节省人工转录的时间和成本,尤其适用于古典音乐作品。

音乐分析:深入分析音乐作品的构成,为音乐理论家和作曲家提供研究工具。

音频编辑:在电影和视频制作中,帮助编辑精确地处理和调整音频元素,如对话、音乐和音效。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • Felvin
    Felvin Felvin是一个AI的无代码市场,您可以使用现有的应用模板,也可以为自己独家构建一个应用。Felvin提供强大的AI工具和直观的平台,让您轻松设计、...
  • Empatyzer
    Empatyzer Empatyzer是一个人工智能辅助系统,可以帮助提升团队内部的沟通效率和质量。它通过对每个团队成员的性格和文化特征进行分析,给出个性化的沟通建议,让...
  • 团子AI
    团子AI 团子AI是一款在线的人工智能工具箱,提供伴奏人声提取、任意乐器分离、无损升降调等实用功能。基于云计算,使用简单,无需下载安装就可以随时随地使用。通过深...
  • Qwen2.5-Coder-32B-Instruct-GGUF
    Qwen2.5-Coder-32B-Instruct-GGUF Qwen2.5-Coder 是针对代码生成的模型,在代码生成等方面显著提升,参数规模多样,支持量化。免费,面向开发者提高效率和质量。...
  • Model Muse AI
    Model Muse AI Model Muse是一个为电子商务服装品牌提供虚拟时尚模特的平台。它利用最新的人工智能图像生成技术,为品牌创造独特的模特形象,以代替传统高成本的拍摄...
  • Spok
    Spok Spok是一个AI驱动的营销工具,旨在帮助营销人员通过数据驱动的洞察来发现潜在的增长机会。它利用人工智能技术,从互联网这一最大的数据集中提取信息,协助...
  • Reve
    Reve Reve 是一款创新的设计工具,旨在帮助用户将创意和想法以可视化的形式呈现。它支持多种设计风格和灵活的操作方式,使得用户无论是专业设计师还是普通用户,...
  • Base Chat
    Base Chat Base Chat 是一款基于 Ragie 强大 RAG 引擎构建的企业级知识库聊天工具。它能够整合公司知识库中的数据,支持从 Google Driv...