AI音频-AI声音生成-AI录音转文字-免费AI音频合成软件[96]

首页 > AI音频生成

全部所有文字转语音语音转文字 AI音乐创作 AI语音识别 AI声音降噪 AI声音克隆 AI音频编辑

ElevenLabs Conversational AI

ElevenLabs Conversational AI是一款能够快速部署在网页、移动设备或电话上的语音代理产品。它以低延迟、全配置性和无缝扩展性为特...
Dial8

Dial8是一款AI驱动的语音转文字软件，专为Mac用户设计。它支持100多种语言的语音转文字，并优化了本地处理，确保用户数据的隐私性。Dial8的本...
AI Podcast Generator

AI Podcast Generator是一个在线服务，能够将PDF文件和网页内容快速转换成高质量的音频格式，使用专业的AI语音和可定制的说话风格，以...
Coval

Coval是一个专注于AI代理测试和评估的平台，旨在通过模拟和评估来提高AI代理的可靠性和效率。该平台由自主测试领域的专家构建，支持语音和聊天代理的测...
ClearerVoice-Studio

ClearerVoice-Studio是一个开源的AI驱动语音处理工具包，专为研究人员、开发者和最终用户设计。它提供了语音增强、语音分离、目标说话人提...
Paper-to-Podcast

Paper-to-Podcast是一个将学术论文转换成播客形式的工具，通过模拟三个人的讨论来让听众以更自然和人性化的方式理解论文内容。它不仅使复杂的信...
Shortcut by Poised

Shortcut by Poised是一个基于语音的AI助手，旨在通过自然对话的方式提升用户的工作效率。它允许用户通过语音输入快速获得答案、整理思路、...
Desk-Emoji

Desk-Emoji是一个真正的开源AI桌面机器人，它集成了表情屏幕、双轴控制台和大型语言模型（LLM）的语音聊天功能。这款产品以其独特的设计和开源特...
CosyVoice语音生成大模型2.0-0.5B

CosyVoice语音生成大模型2.0-0.5B是一个高性能的语音合成模型，支持零样本、跨语言的语音合成，能够根据文本内容直接生成相应的语音输出。该模...
Megrez-3B-Omni

Megrez-3B-Omni是由无问芯穹研发的端侧全模态理解模型，基于大语言模型Megrez-3B-Instruct扩展，具备图片、文本、音频三种模态...
OmniAudio-2.6B

OmniAudio-2.6B是一个2.6B参数的多模态模型，能够无缝处理文本和音频输入。该模型结合了Gemma-2B、Whisper turbo和一个...
CosyVoice 2

CosyVoice 2是由阿里巴巴集团的SpeechLab@Tongyi团队开发的语音合成模型，它基于监督离散语音标记，并结合了两种流行的生成模型：语...

AI爱好者的一站式人工智能AI工具箱，累计收录全球10,000⁺好用的AI工具软件和网站，方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用，力争做全球排名前三的AI网址导航网站，欢迎您成为我们的一员。

隐私策略免责条款服务协议关于我们

AI TOOL