Audio Decomposition是什么?一文让你看懂Audio Decomposition的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

Audio Decomposition概述简介

Audio Decomposition是音频处理技术,基于傅里叶变换和信封匹配将音乐中的各个音符和乐器分离,实现音乐到乐谱的转换。Audio Decomposition开源项目是Matthew Bird推出的,无需外部乐器分离库,自动识别和分离音乐中的不同乐器声音,帮助用户更好地理解和重现乐谱。

Audio Decomposition的功能特色

音频源分离:将混合音乐中的不同乐器声音分离出来。

音乐转乐谱:将音乐文件转换成乐谱,帮助用户识别音高和和弦。

音频分析:分析音乐中的音符和乐器,提供音乐结构的深入理解。

开源工具:作为开源项目,支持用户自由使用和修改代码,适应不同的需求。

Audio Decomposition的技术原理

傅里叶变换:程序每0.1秒对音乐文件进行一次傅里叶变换,生成频谱图。将每种乐器的傅里叶变换相加,重新创建音乐的频谱。

包络分析:将声波分成几块并取每块的最大值获取包络。进一步优化结果,找到包络低于原始声波的点,添加新点定义包络。

信封的分解:将波的包络分解为起音(攻击)、延音(持续)和释音(释放)。

波形分类:考虑乐器的静态衰减和动态变化,及是否有释音。

带通滤波:对每个音符频率的信号进行带通滤波,分离特定乐器的声音。

互相关和均方误差(MSE):用乐器的起音和释放的互相关找到每个音符的开始和结束。计算乐器波和滤波后的音频的MSE,获得乐器的成本。

Audio Decomposition项目介绍

项目官网:matthew-bird.com/blogs/Audio-Decomposition

GitHub仓库:https://github.com/mbird1258/Audio-Decomposition

Audio Decomposition能做什么?

音乐教育:分离不同乐器的声音,帮助学生更直观地理解音乐作品中的和声与配器。

音乐制作:支持制作人从复杂的音乐中提取单独的音轨,用在混音或创作新的音乐元素。

乐谱转录:自动将音频记录转换为乐谱,节省人工转录的时间和成本,尤其适用于古典音乐作品。

音乐分析:深入分析音乐作品的构成,为音乐理论家和作曲家提供研究工具。

音频编辑:在电影和视频制作中,帮助编辑精确地处理和调整音频元素,如对话、音乐和音效。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • Voxa
    Voxa Voxa是一个智能语音助手,旨在通过简单的语音命令简化用户的日常生活和工作流程。它集成了任务管理、日程安排、笔记记录和提醒功能,通过与Google T...
  • Inquir
    Inquir Inquir是一个强大的工具,用于创建个性化的搜索引擎,根据您的数据量身定制。它解锁了诸如自定义搜索解决方案、数据组合、AI驱动的检索增强生成(RAG...
  • narrator
    narrator narrator是一款Python应用,通过使用OpenAI和ElevenLabs的API,能够让David Attenborough来为您的生活进行...
  • Whautomate
    Whautomate Whautomate是一款旨在帮助企业提升客户参与度的客户参与平台。它提供了丰富的功能和优势,包括自动化的营销和375、实时互动、智能分析和报告等。产...
  • 知我AI
    知我AI 知我AI是一个个性化、专业的AI个人知识管理助手,旨在帮助用户回忆知识、解答问题、创作内容、生成摘要和思维导图。它通过全能知识采集、AI知识处理、AI...
  • GenAgent
    GenAgent GenAgent是一个框架,它通过创建工作流来构建协作AI系统,并将这些工作流转换为代码,以便大型语言模型(LLM)代理更好地理解。GenAgent能...
  • Cantor
    Cantor Cantor是一个多模态链式思维(CoT)框架,它通过感知决策架构,将视觉上下文获取与逻辑推理相结合,解决复杂的视觉推理任务。Cantor首先作为一个...
  • Podcastle
    Podcastle Podcastle是一款简单易用的专业音频处理与编辑工具。它提供多轨录音、音频剪辑、智能降噪等功能,让您能够创建高质量的播客节目。同时,它还支持AI语...