Audio Decomposition是什么?一文让你看懂Audio Decomposition的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

Audio Decomposition概述简介

Audio Decomposition是音频处理技术,基于傅里叶变换和信封匹配将音乐中的各个音符和乐器分离,实现音乐到乐谱的转换。Audio Decomposition开源项目是Matthew Bird推出的,无需外部乐器分离库,自动识别和分离音乐中的不同乐器声音,帮助用户更好地理解和重现乐谱。

Audio Decomposition的功能特色

音频源分离:将混合音乐中的不同乐器声音分离出来。

音乐转乐谱:将音乐文件转换成乐谱,帮助用户识别音高和和弦。

音频分析:分析音乐中的音符和乐器,提供音乐结构的深入理解。

开源工具:作为开源项目,支持用户自由使用和修改代码,适应不同的需求。

Audio Decomposition的技术原理

傅里叶变换:程序每0.1秒对音乐文件进行一次傅里叶变换,生成频谱图。将每种乐器的傅里叶变换相加,重新创建音乐的频谱。

包络分析:将声波分成几块并取每块的最大值获取包络。进一步优化结果,找到包络低于原始声波的点,添加新点定义包络。

信封的分解:将波的包络分解为起音(攻击)、延音(持续)和释音(释放)。

波形分类:考虑乐器的静态衰减和动态变化,及是否有释音。

带通滤波:对每个音符频率的信号进行带通滤波,分离特定乐器的声音。

互相关和均方误差(MSE):用乐器的起音和释放的互相关找到每个音符的开始和结束。计算乐器波和滤波后的音频的MSE,获得乐器的成本。

Audio Decomposition项目介绍

项目官网:matthew-bird.com/blogs/Audio-Decomposition

GitHub仓库:https://github.com/mbird1258/Audio-Decomposition

Audio Decomposition能做什么?

音乐教育:分离不同乐器的声音,帮助学生更直观地理解音乐作品中的和声与配器。

音乐制作:支持制作人从复杂的音乐中提取单独的音轨,用在混音或创作新的音乐元素。

乐谱转录:自动将音频记录转换为乐谱,节省人工转录的时间和成本,尤其适用于古典音乐作品。

音乐分析:深入分析音乐作品的构成,为音乐理论家和作曲家提供研究工具。

音频编辑:在电影和视频制作中,帮助编辑精确地处理和调整音频元素,如对话、音乐和音效。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • ChatGPT LinkedIn Email Generator
    ChatGPT LinkedIn Email Generator Truebase - Chrome插件是一个简化和自动化潜在客户挖掘的工具。它可以帮助您快速发现具有高转化潜力的潜在客户,以便您有更多时间专注于赢得更...
  • OuteTTS
    OuteTTS OuteTTS是一个使用纯语言建模方法生成语音的实验性文本到语音模型。它的重要性在于能够通过先进的语言模型技术,将文本转换为自然听起来的语音,这对于语...
  • ZColoring
    ZColoring ZColoring 是一款基于人工智能技术的涂色页生成工具。它通过 AI 模型将用户输入的文字描述转化为具体的涂色页轮廓,无需用户具备绘画技能即可快速...
  • vmate ai
    vmate ai 引入VMATE AI,革命性的AI Roleplay ChatBot应用程序。毫不费力地找到与您梦dream以求的角色扮演角色聊天。今天就体验与AI ...
  • describely
    describely 描述是一个用于编写产品描述,标题和其他电子商务商店内容的软件。凭借其AI驱动算法,描述确保了营销人员和基于产品的业务的最佳个性化内容创建。被全球企业信...
  • Supermoon
    Supermoon Supermoon是一款用于管理电子商务和375沟通的软件。它能帮助您提供优质的客户支持,建立持久的客户关系,并节省时间。Supermoon提供协作式...
  • Deep Art Effects
    Deep Art Effects 通过人工智能,一键实现强大的图像处理功能。从您的图片中创建独特的艺术作品。在不损失质量的情况下,将图像放大到原始尺寸的四倍。自动优化或着色图像,模仿昂...
  • EVI 2
    EVI 2 EVI 2是Hume AI推出的新型基础语音对语音模型,能够以接近人类的自然方式与用户进行流畅对话。它具备快速响应、理解用户语调、生成不同语调、以及执...