Audio Decomposition是什么?一文让你看懂Audio Decomposition的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

Audio Decomposition概述简介

Audio Decomposition是音频处理技术,基于傅里叶变换和信封匹配将音乐中的各个音符和乐器分离,实现音乐到乐谱的转换。Audio Decomposition开源项目是Matthew Bird推出的,无需外部乐器分离库,自动识别和分离音乐中的不同乐器声音,帮助用户更好地理解和重现乐谱。

Audio Decomposition的功能特色

音频源分离:将混合音乐中的不同乐器声音分离出来。

音乐转乐谱:将音乐文件转换成乐谱,帮助用户识别音高和和弦。

音频分析:分析音乐中的音符和乐器,提供音乐结构的深入理解。

开源工具:作为开源项目,支持用户自由使用和修改代码,适应不同的需求。

Audio Decomposition的技术原理

傅里叶变换:程序每0.1秒对音乐文件进行一次傅里叶变换,生成频谱图。将每种乐器的傅里叶变换相加,重新创建音乐的频谱。

包络分析:将声波分成几块并取每块的最大值获取包络。进一步优化结果,找到包络低于原始声波的点,添加新点定义包络。

信封的分解:将波的包络分解为起音(攻击)、延音(持续)和释音(释放)。

波形分类:考虑乐器的静态衰减和动态变化,及是否有释音。

带通滤波:对每个音符频率的信号进行带通滤波,分离特定乐器的声音。

互相关和均方误差(MSE):用乐器的起音和释放的互相关找到每个音符的开始和结束。计算乐器波和滤波后的音频的MSE,获得乐器的成本。

Audio Decomposition项目介绍

项目官网:matthew-bird.com/blogs/Audio-Decomposition

GitHub仓库:https://github.com/mbird1258/Audio-Decomposition

Audio Decomposition能做什么?

音乐教育:分离不同乐器的声音,帮助学生更直观地理解音乐作品中的和声与配器。

音乐制作:支持制作人从复杂的音乐中提取单独的音轨,用在混音或创作新的音乐元素。

乐谱转录:自动将音频记录转换为乐谱,节省人工转录的时间和成本,尤其适用于古典音乐作品。

音乐分析:深入分析音乐作品的构成,为音乐理论家和作曲家提供研究工具。

音频编辑:在电影和视频制作中,帮助编辑精确地处理和调整音频元素,如对话、音乐和音效。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • Kokoro TTS
    Kokoro TTS Kokoro TTS是一款专注于文本转语音的AI模型,其主要功能是将文本内容转换为自然流畅的语音输出。该模型基于StyleTTS 2架构,拥有8200...
  • yatter
    yatter Yatter可以通过WhatsApp&Telegram上的AI帮助您实现目标。其个性化的学习旅程,职业成长见解,无缝协作和高效的任务管理使其易于井井有...
  • SoraVids
    SoraVids SoraVids是一个基于Hugging Face平台的视频生成模型Sora的存档库。它包含了87个视频和83个对应的提示,这些视频和提示在OpenA...
  • InboxDone
    InboxDone InboxDone 是一家专注于电子邮件管理的虚拟执行助理服务,旨在通过专业的助理团队帮助客户回复电子邮件和管理日历,从而释放客户的时间,让他们能够专...
  • GoDiary
    GoDiary GoDiary是一款能够自动跟踪运动的健身应用。它结合了GPS和专有的机器学习算法,以省电的方式监测用户的健身活动。通过GoDiary,用户可以轻松追...
  • TALKR
    TALKR TALKR是一款无代码平台,用于创建聊天机器人、电话机器人和语音机器人。它提供了智能对话生成器、多渠道和全渠道支持、对话分析等功能。TALKR使用户能...
  • Outtloud
    Outtloud Outtloud是一款AI语音助手,可以将用户文档或文本转换成自然流畅的高保真AI语音。它支持超过10种语言和口音,提供100多种AI高级人声。用户可...
  • Fellow.app
    Fellow.app Fellow.app 是一款集成了人工智能技术的会议笔记与摘要工具,旨在帮助用户从会议中快速获取洞察并作出决策。它通过'Ask Copilot'功能,...