跳转到主要内容
ToolPotion

最佳 音频、语音与音乐 AI工具

737 个工具

探索最佳的音频、语音与音乐——从AI语音生成器和音乐创作者到播客平台、转录服务和AI模型,这里是音频爱好者寻找增强项目的工具的地方:生成逼真的配音、创作原创音乐曲目、转录口语内容以及制作引人入胜的播客。 浏览 737 个最佳 音频、语音与音乐 AI工具,涵盖 AI 应用, AI 移动应用, AI 播客, AI 模型AI GitHub 仓库 等——每个条目上线前都经过人工审核,并以11种语言发布。

AI 移动应用

此 Chrome 扩展程序利用语音识别技术将口语转换为屏幕上显示的文本。它使用户能够免提创建笔记,通过消除打字需求来提高工作效率。该扩展程序旨在简化笔记记录并提高用户效率。

AI 转录工具

WhisperUI 提供由 OpenAI 的 Whisper 模型驱动的经济实惠的语音转文本服务。轻松将音频文件转换为文本和 SRT 格式。支持各种音频类型和高达 25MB 的文件大小,并提供高级功能以实现无限上传和批量处理。

AI 转录工具

Transkriptor 提供超过 100 种语言的 AI 驱动音频和视频转录服务。快速准确地将录音转换为文本,适用于会议、访谈和讲座。功能包括自定义词汇、说话人分离和 AI 驱动的摘要,使其成为专业人士和学生的通用工具。

AI 转录工具

这款 Chrome 扩展程序使用 Azure Speech 服务将选定的文本转换为语音。它支持多种语言,需要 Azure Speech Service API 密钥。Azure Speech 服务的免费套餐已足够,每月提供 0.5 百万个字符。它集成了 Chrome 的实时字幕功能。

文字转语音

AI 应用

F5-TTS 是一款免费的在线人工智能文本转语音工具,可将文本实时转换为自然、富有表现力的语音。它具有零样本语音克隆、多语言支持和情感控制功能,非常适合寻求轻松生成高质量、多功能音频的内容创作者。

AI 语音生成器

DesiVocal 提供免费的文本转语音和 AI 语音生成服务。支持印地语、英语、泰米尔语、德语和法语等多种语言,可创建高清 AI 配音。非常适合希望快速高效地为内容添加自然 AI 语音的 YouTube 用户、出版商和媒体公司。

文字转语音

Vaanee Labs 提供先进的 AI 语音克隆和生成语音技术。创建逼真、人性化的配音,具有情感深度,支持 50 多种语言和口音。非常适合内容创作者、电影制作人和寻求高质量、多语言旁白和配音解决方案的企业。

AI 语音生成器

这款在线工具可将文本转换为自然发音的语音,支持超过 20 种语言。它提供快速的转换速度,并允许用户选择偏好的语音。该服务免费使用,无需任何注册,可满足各种内容创作需求。

文字转语音

Microsoft TTS Downloader 允许您使用 Microsoft 的文本转语音服务轻松地将文本转换为听起来自然的语音。一键下载合成音频,无需具备云服务技术专长。它专为需要快速高效地生成语音音频的用户而设计。

文字转语音

AI 应用

LoveVoice AI 是一款先进的 AI 驱动语音生成工具,可将文本转换为自然流畅的语音。它提供广泛的语音和自定义选项,非常适合内容创作者、企业和寻求高质量音频输出的个人用户。轻松体验逼真的配音。

文字转语音

SpeechGen 提供一款由 AI 驱动的文本转语音转换器和语音生成器,拥有超过 5,000 种逼真语音,支持 150 种语言。轻松创建配音,以 MP3、WAV 或 FLAC 格式下载音频,并自定义语速和音调等语音参数。非常适合内容创作者、教育工作者和企业。

AI 语音生成器

Narrly 是一款直观的文本转语音阅读器,适用于 PDF、网页和文档。它提供自然的语音、离线收听以及注重隐私的设备端处理。享受免提阅读,并通过语速控制和书签功能自定义您的体验,以提高生产力和可访问性。

文字转语音

AI 应用

Txt Voice 提供即时语音转文本服务,旨在快速高效地将音频转换为文本。该工具旨在简化转录流程,使需要将语音转换为书面内容的用户能够更快、更便捷地完成。

AI 音频编辑器

AI 移动应用

Woord 是一款 Chrome 扩展程序,可将网页文章和文本转换为自然流畅的语音或音频播客。它提供 10 种语言的 60 种语音,用户可以选择不同的性别或中性音调。此工具非常适合辅助功能、内容消费和各种应用程序集成。

文字转语音

Voice Remaker 是一款 Chrome 扩展程序,它是一个强大的 AI 语音生成器和逼真的文本转语音助手。它能将文本转换为听起来自然的音频,媲美付费服务,并提供一种经济高效的创建类人语音的解决方案。用户可以下载 MP3 格式的音频文件。

文字转语音

Speaktor 是一款由 AI 驱动的 Chrome 扩展程序,可将文本转换为音频。它支持 100 多种语言和方言,并提供丰富的语音选项。可在几秒钟内轻松将来自 URL、图片和文档的文本合成为语音音频文件,从而提高可访问性和生产力。

文字转语音

AI 移动应用

Natiq 是一款文本转语音 (TTS) 技术,旨在将阿拉伯语文本转换为自然流畅的语音。它允许用户通过单击即可收听网页上的选定文本,支持新闻、博客和教育材料等各种网站。此工具增强了阿拉伯语使用者的可访问性和内容消费体验。

文字转语音

AI 移动应用

这款 Chrome 扩展程序利用 AI 将书面内容转换为自然流畅的音频。它非常适合创建播客、有声读物、增强视障用户的可访问性以及支持语言学习。该工具提供免费的 AI 语音生成器,并可无缝集成到各种项目中。

文字转语音

VanillaVoice 提供免费的文本转语音工具,可将书面文本转换为自然、逼真的人声。它提供多种多样的语音选择,包括男声、女声和童声,并带有各种口音和特征以满足不同需求。该服务旨在为专业视频、演示文稿和解说视频增强音频内容。

文字转语音

Voices AI 是一款移动应用程序,可将您的文本转换为逼真的 AI 生成语音。它提供多样化的名人及政治人物声音库,非常适合内容创作者、娱乐及个性化消息。该应用还提供语音克隆和 AI 音频增强功能,以获得专业级音质。

AI 语音生成器

AudiOverFlow 提供免费的文本转音频AI工具,可将书面内容转换为自然流畅的语音。操作简单:输入文本,选择语音,合成AI音频,预览,然后下载。非常适合内容创作者、教育工作者和寻求便捷语音旁白的各类企业。

文字转语音

AI 应用

Article Audio 将文章转换为自然流畅的人声内容。支持超过 140 种语言,让用户可以通过听觉而非阅读来获取信息。该工具非常适合偏好音频消费或需要在旅途中处理信息的用户,从而提高内容的可访问性。

文字转语音

Leelo AI 利用先进的 AI 技术将书面文本转化为逼真的语音。为演示文稿、视频和有声读物生成高质量音频。从 142 种语言的 800 多种声音中选择,并提供情感表达选项。使用这款强大的文本转语音解决方案简化内容创作并扩大您的影响力。

文字转语音

Xpeacho 提供一个基于 AI 的文本转语音平台,面向创作者、营销人员和企业。在 80 多种语言和 880 多个声音中,将任何文本瞬间转换为工作室级、听起来像真人的配音。非常适合视频制作、播客和电子学习,它提供即时渲染和商业许可。

文字转语音

Beepbooply 提供 AI 语音生成器,可将文本转换为语音,拥有超过 900 种逼真语音,支持 80 多种语言。轻松为各种个人和商业项目创建和下载自然发音的音频内容,节省配音和旁白的时间和资源。

文字转语音

AI 应用

Audyo 将文本转换为人声质量的 AI 音频,使语音创作像编辑文档一样简单。编辑单词而非波形,轻松切换说话人,并使用音标微调发音。这是一个直观的工具,供创作者为各种项目生成专业音频。

AI 语音生成器

Binaural Beats Factory 提供一款由 AI 驱动的音频生成器,可用于个性化潜意识信息、肯定语、自我催眠、睡眠故事、引导冥想和祈祷音频。用户可以输入目标来创建自定义音轨,从而增强个人发展并达到期望的状态。它提供免费试用,让您体验其变革性的能力。

AI 音乐生成器

AI 应用

AudioBot 使用 AI 将文本转换为听起来自然的西班牙语语音。为视频、播客和电子学习生成专业音频。下载无水印的 MP3 文件。提供免费字符数和商业用途。

文字转语音

AI 应用

TTSLabs 为主播提供可定制的文本转语音服务,适用于 Twitch 等平台。通过独特的声音、声音片段和脏话过滤器增强您的直播。与 Streamlabs 和 StreamElements 无缝集成以控制捐赠,为您的观众提供引人入胜的体验。

AI 语音生成器

TTSVox 是一款在线文本转语音工具,可即时将书面文本转换为自然流畅的音频。它提供无限使用、多种逼真语音和多语言支持,非常适合增强视频、电子学习和可访问性。

文字转语音

免费在线语音生成器,可将文本转换为逼真的音频,支持 129 种语言的 409+ 种语音。提供语速、音调和音量控制,支持 MP3 和 WAV 下载。非常适合内容创作者、专业人士和辅助功能需求。

文字转语音

AI 应用

Verbatik AI 是一个全面的创意平台,提供由 AI 驱动的语音、视频、音乐和图像生成。它支持超过 200 种语言的文本转语音和语音克隆,以及 AI 视频创作、音乐创作和音效。用户可以通过免费套餐开始创作。

AI 语音生成器

使用 AI 将文本转换为逼真的英语语音。此在线工具提供多种声音和情感,可实现自然流畅的配音。它速度快、易于使用,非常适合为视频、演示文稿等创建音频内容,并提供免费下载选项。

文字转语音

AiVOOV 是一款由人工智能驱动的文本转语音和语音生成器,可在几秒钟内将文本转换为逼真的人工智能配音。它提供 155 种以上语言的 2300 多种语音,非常适合视频、营销、电子学习和播客,与传统的配音录制相比,可节省时间和金钱。

文字转语音

AI 应用

SteosVoice 提供超逼真的 AI 生成语音合成,拥有超过 800 种语音的庞大库。它专为内容创作者、企业和游戏开发者而设计,用于配音视频、创建播客、为角色配音,并通过高质量的 44.1KHz WAV 文件将其自身的声音才能变现。

文字转语音

Speechify 是一款语音 AI 生产力助手,可将文本转换为自然流畅的语音。它提供语音输入、摘要和播客创建功能,支持多设备,帮助用户更快地阅读、更高效地写作,并轻松吸收信息。超过 5500 万用户受益于其辅助功能。

文字转语音

AI 应用

Databass AI 是一家专注于音乐制作的创新型 AI 音频公司。它提供先进的、可通过浏览器访问的音频处理工具,专为创作者设计。凭借强大的用户基础和行业认可,Databass AI 已为生成式 AI 音乐技术的未来发展做好准备。

AI 音乐生成器

AI 应用

WhisperBot 使用先进的 AI 将 WhatsApp 语音消息转换为文本。只需转发您的语音笔记,WhisperBot 几乎可以即时转录。它支持 57 种以上语言,并为长消息提供 AI 驱动的摘要,为忙碌的用户增强了可访问性和便利性。

AI 转录工具

Altered Studio 提供专业的 AI 变声器软件和服务。通过独特的语音到语音变声技术,实时或后期制作转换您的声音。非常适合内容创作、游戏、呼叫中心和声音恢复,可实现引人入胜的专业语音表演。

AI 语音生成器

AI 应用

VocBot Turbo 是一款由人工智能驱动的语音处理和转录应用程序。它提供先进的功能,能够高精度地将音频转换为文本,适用于各种专业和个人应用。该工具旨在通过提供高效可靠的语音转文本解决方案来简化工作流程。

AI 转录工具

AI 移动应用

Serenade for Chrome 允许您仅通过语音即可浏览网页和输入文本。此扩展程序将 Serenade 桌面应用程序的功能扩展到您的浏览器,从而在许多基于网络的任务中无需使用鼠标或键盘。它专为寻求免提网页交互和内容创作的用户而设计。

AI 转录工具

GenSFX 是一款免费的在线 AI 工具,可将文本描述即时转换为专业音效。只需输入您所需的内容,即可为任何项目创建自定义音频。以多种格式下载高质量的 SFX,可立即用于您的创意作品。通过先进的 AI 轻松生成独特的声音。

AI 音乐生成器

AI 应用

AI Mastering 是一款自动化的在线音频母带处理服务,旨在提升音乐品质。它利用人工智能使音质更接近商业标准,并提供响度及动态范围平衡等功能。用户可免费试用该服务。

AI 音频编辑器

AI 应用

HANCE 是一家专注于音频增强技术的公司,开发了先进的语音处理模型和深度学习解决方案,以应对复杂的真实世界音频。他们专注于将技术授权给硬件制造商,但未能获得继续运营所需的资金或短期收入。

AI 音频编辑器

AI 应用

HeardThat 将您的智能手机转变为助听设备,利用 AI 降低背景噪音。它可与您现有的蓝牙耳机或助听器配合使用,让您在嘈杂的环境中也能进行清晰的对话。享受社交场合,避免孤立,尽在这款易于使用的应用程序。

AI 音频编辑器

AI 应用

Dubbing AI 是一款面向游戏玩家和主播的实时 AI 变声器,提供超过 500 种 AI 语音和海量表情包音效。它为 Discord、Zoom 和 OBS 等平台上的游戏、直播和通话提供低延迟语音转换,通过富有创意的音频选项增强在线互动。

AI 语音生成器

AI 移动应用

Sarv NC Lite 是一款 Chrome 扩展程序,旨在增强您在视频通话中的音频体验。它通过消除背景噪音来确保更清晰的沟通。此插件对于 Sarv Wave 视频会议应用程序的用户特别有用,有助于提高在线互动的整体质量。

AI 音频编辑器

AudioStrip 是一款在线工具,用于从音乐中分离人声,提供免费和付费套餐。它使用 AI 分割音轨,允许用户提取人声或器乐。该服务提供近乎完美的分离效果,并提供降噪和母带处理选项,可满足音乐家和音频专业人士的需求。

AI 音频编辑器

Splitter.ai 提供先进的 AI 音频处理,包括音乐中的音轨分离。全球数百万用户使用它,为制作人、艺术家和工程师提供免费和付费服务。利用强大的机器学习技术,增强您的音乐制作和分析音频工作流程。

AI 音频编辑器

Sunoify 是一个由 AI 驱动的音乐创作平台,可在几秒钟内将您的想法、图像或歌词转化为独特的免版税音乐。描述您的愿景、上传视觉素材或提供文本,让 AI 为您量身定制原创配乐,非常适合寻求定制音频的创作者。

AI 音乐生成器

uJam AI 将您的文本创意转化为独特的音乐创作。只需输入您的歌曲概念,选择时长,然后让 AI 生成一首独特的曲子。下载、分享和收藏您的创作。非常适合希望以简单方式将旋律变为现实的词曲作者和音乐爱好者。

AI 音乐生成器

AI 应用

MyVocal AI 提供强大的语音克隆和文本转语音解决方案。它使用户能够生成超过 100 种语言的逼真语音,克隆自己的声音,甚至创作 AI 音乐。该平台专为快速、自然和多语言语音生成而设计,支持创意内容制作。

AI 语音生成器

Voicemy.ai 使用户能够创建独特的 AI 语音并创作旋律。克隆现有语音或训练自定义 AI 模型。分享您的创作,用 AI 语音和歌曲的力量激励他人。文本转语音功能即将推出。

AI 语音生成器

Songburst 是一款 AI 音乐生成器,可将您的文本描述转化为原创歌曲。为视频、播客或游戏创作音乐,并以 WAV 或 MP3 格式无限下载曲目。使用 Songburst Prompt Enhancer 增强您的提示,以获得更具描述性的结果。在任何内容中自由使用您的音乐。

AI 音乐生成器

Splash 是一个交互式在线音乐创作平台,使用户能够协作并共同创作音乐。它提供了一个庞大的音效包库、一个节拍器乐器以及一个用于现场表演和音乐发现的 Roblox 虚拟世界,从而推动了全球创意运动。

AI 音乐生成器

AI 应用

AI Singing 是一款免费的在线工具,可根据文本描述或歌词生成专业品质的 AI 歌声和音乐。它提供多种风格、实时生成和自定义歌词支持,让音乐创作人人可及。体验免费的 AI 驱动音乐制作。

AI 音乐生成器

使用 MakeBestMusic 的 AI 音乐生成器,在几秒钟内创作免版税歌曲和配乐。通过文本提示生成音乐,添加人声,并混音音轨。非常适合需要自定义音频且无需许可费的内容创作者、音乐家和企业。免费开始创作。

AI 音乐生成器

DiffRhythm AI 是一款免费的音乐生成器,可在几秒钟内创作包含人声和伴奏的完整歌曲。它利用潜在扩散技术,将歌词和风格提示转化为工作室品质的音乐,提供了一种快速简便的方式来制作完整曲目的音乐。

AI 音乐生成器

AI 应用

Soundry AI 提供面向音乐人、制作人和 DJ 的生成式工具。Groove 允许用户将任何歌曲混音成任何风格,深受 DJ 和 TikTok 创作者的欢迎。Sample Planet 为音乐制作人提供创建独特、可混音样本的工具,赋能人类创造力。

AI 音乐生成器

Voqul是一款由AI驱动的工具,能够改变录音中的声音。用户可以上传或录制音频,并从100多种声音中选择,以创建独特的AI音乐或修改现有音频文件。它提供高级定制功能,以实现个性化的音乐体验。

AI 语音生成器

Overtune 是一款专为录音艺术家和创作者设计的简易节拍制作应用程序。它允许用户轻松创作自己的节拍和器乐音轨,且无版税或限制。该平台提供大量专业制作的循环乐段,并支持无限制导出,使用户能够完全掌控自己的音乐。

AI 语音生成器

Voice-Swap 提供面向音乐人和创作者的 AI 语音转换功能。您可以构建自定义语音模型,访问精选艺术家声音,并为音乐制作、内容创作和媒体转换音频。它提供工作室级 AI 语音,并拥有以权利为先的基础设施,可实现安全可控的语音身份。

AI 语音生成器

AI 应用

Music AI 提供最先进的道德 AI 音频模型,旨在增强人类在音乐创作方面的创造力。他们的技术每天处理数百万分钟的音频,为全球音乐家和音乐行业提供创新动力。他们专注于支持艺术家的直觉、情感和愿景。

AI 音频编辑器

AI 应用

Covers.ai 提供 AI 驱动的工具,帮助艺术家、音乐团队和创作者生成病毒式粉丝内容。轻松大规模创建 AI 翻唱、歌词替换和 TikTok 视频。利用自定义 AI 声音和流派替换,将您的音乐转化为吸引粉丝和营销活动的引人入胜的内容。

AI 音乐生成器

AI 应用

Blakify 是一款文本转语音软件,可将书面文本转换为听起来自然的音频。它提供由 AI 驱动的、涵盖 70 种语言和口音的超过 700 种语音库。用户可以生成 MP3 和 WAV 格式的音频文件,使内容在各种应用中都易于访问且引人入胜。

文字转语音

AI 应用

PodRoll enables podcast cross-promotion through dynamic feed drops, placing your episodes directly into established podcast feeds. It offers real downloads and followers by…

AI 播客工具

AI 应用

SpeechPulse 提供适用于 Windows 和 macOS 的高级语音识别和翻译功能。它支持所有应用程序中的语音输入,为保护隐私而支持离线使用,并包含由 AI 驱动的标点符号和文本摘要功能。非常适合通过语音输入提高工作效率和可访问性。

AI 转录工具

Instant Singer 允许您在短短两分钟内通过 AI 克隆您的声音,成为一名歌手。然后,您只需粘贴 YouTube 链接,即可在任何歌曲中用自己的声音替换任何歌手的声音。它提供免费入门套装,包含声音克隆和四个转换后的样本。

AI 音乐生成器

Clonemyvoice.io 提供 AI 语音克隆服务,适用于播客和演示文稿等长篇内容。只需一小段音频样本即可生成专业的配音,与竞争对手相比节省 80% 以上,与真人配音演员相比节省 99%。支持任何语言的输入音频,生成带有自然口音的完美英语语音。

AI 语音生成器

Sound Effects AI 可根据文本描述或图像生成独特的、由 AI 驱动的音效。该工具无需从视频中提取音频,为创作者节省了时间,并为各种项目提供即时、免版税的音频生成。它旨在简化全球内容创作者的音频制作流程。

AI 音乐生成器

OptimizerAI 可根据文本提示生成无限的高质量 AI 音效。它非常适合创作者、游戏开发者、艺术家和视频制作者,提供最先进的文本到声音生成体验,支持各种变化和魔术提示,让您的内容栩栩如生,拥有自定义音频。

AI 音乐生成器

Bleepify 是一款由 AI 驱动的脏话过滤器,可自动检测和审查视频和音频中的脏话。它提供哔哔声、静音或用 AI 生成的干净替代词替换脏话的选项,帮助创作者避免 YouTube 广告收入被取消,并保持内容对广告商友好。

AI 音频编辑器

AI鼓生成器是一款在线工具,利用人工智能为您的音乐创作独特的鼓点模式。用户可以轻松修改BPM和创意度等设置来生成自定义节奏。这款AI驱动的解决方案可帮助音乐家和制作人快速为他们的歌曲添加充满活力且原创的鼓点。

AI 音乐生成器

ChordCreate 的 AI 驱动生成器可帮助音乐人轻松创作独特的和弦进行。输入您想要的风格、调式和情绪,即可激发音乐灵感,将更多时间用于创作。非常适合寻求灵感和更快速工作流程的词曲作者和制作人。

AI 音乐生成器

EVOKE Connexion 是一个用于活动音乐生成的专业空间。它允许用户访问他们的账户来创建和管理活动音乐。该平台提供账户创建和登录功能,并提供密码恢复选项,从而简化了生成活动特定音乐的过程。

AI 音乐生成器

SpeedyAudios 在 10 秒内将您的 WhatsApp 音频消息转录为文本。只需将音频转发到他们的 WhatsApp 机器人,即可收到转录文本,从而无需收听即可更轻松地搜索、审查或共享语音笔记中的信息。

AI 转录工具

使用 OpenAI API 将麦克风音频转换为文本。非常适合高精度转录会议、快速笔记、讲座和访谈,并支持多语言。一款提高生产力和可访问性的直观工具。

AI 转录工具

Replica Studios 已正式停止运营。该公司以其 AI 语音技术和创意项目而闻名,对社区在其发展历程中的支持表示感谢。这标志着其服务的结束,目前没有迹象表明会重新启动。

AI 语音生成器

AI 模型

MusicLM 是一个 AI 模型,可以根据文本描述生成高保真音乐。它可以生成长达 24 kHz 的音乐,并在数分钟内保持一致性,在音频质量和文本遵循度方面优于之前的系统。它还支持旋律条件生成。

AI 音乐生成器

Jukebox 是一个神经网络,可以生成包括初步人声在内的原始音频音乐。它可以创作各种流派和艺术家风格的音乐,为人工智能驱动的音乐创作提供了一种新颖的方法。模型权重和代码已发布,并附带一个用于探索生成样本的工具。

AI 音乐生成器

这是一个 Parallel WaveGAN 及相关音频生成模型的非官方演示页面。它展示了包括 MelGAN、Multiband-MelGAN、HiFi-GAN 和 StyleMelGAN 在内的各种实现生成的音频样本,涵盖英语、日语和普通话。可将生成的音频与真实音频进行对比。

文字转语音

AI 模型

AudioLDM 是一个利用潜在扩散模型进行文本到音频生成的框架。它将各种模态转换为统一的“音频语言”(LOA),用于生成语音、音乐和音效。这种方法支持上下文学习,并利用自监督预训练模型进行多功能音频创作。

AI 音乐生成器

AI 模型

Make-An-Audio 是一个文本到音频生成系统,采用提示增强的扩散模型。它通过伪提示增强和频谱图自编码器来解决数据稀缺和音频复杂性的问题。该系统取得了最先进的成果,并提供了从各种输入生成高清、高保真音频的可控性。

AI 音乐生成器

AI 模型

Voicebox 是一款生成式语音 AI 模型,能够跨多种任务泛化,并达到最先进的性能。它能够合成语音、去除噪音、编辑内容、转换风格,并以六种语言生成多样化的样本,性能优于单一用途模型。

AI 语音生成器

MT3 是一个基于 T5X 框架构建的多乐器自动音乐转录模型。它使用预训练的钢琴或多乐器音乐检查点,使用户能够转录音频文件。该项目提供了转录资源,并概述了模型训练的潜在步骤。

AI 音频编辑器

AI GitHub 仓库

Audiocraft 是一个用于深度学习音频生成和处理的 PyTorch 库。它提供了像 MusicGen(用于可控音乐生成)和 AudioGen(用于文本到声音)这样的最先进模型。该库还包含 EnCodec 音频压缩器和用于研究的训练代码。

AI 音乐生成器

AI GitHub 仓库

Bark 是 Suno AI 开发的开源、基于 Transformer 的文本到音频模型。它能根据文本提示生成逼真、多语言的语音、音乐和音效。Bark 支持多种语言、语音预设,并能生成非语音声音,如笑声和叹息,使其在创意音频生成方面用途广泛。

文字转语音

XTTS 是 coqui 在 Hugging Face 上提供的一个 AI 应用,用于从文本生成语音。它支持多种语言,并允许用户提供音频文件或麦克风录音作为参考声音。该应用旨在通过语音克隆能力创建听起来自然的语音。

AI 语音生成器

AI 智能体

Soundverse AI 是一个由人工智能驱动的平台,专为音频创作和处理而设计。它提供了生成、编辑和增强声景的工具,使其成为内容创作者、音乐家和声音设计师寻求通过创新的 AI 功能提升其音频项目的宝贵资源。

AI 音乐生成器

AI 智能体

LMNT 提供快速、逼真且经济实惠的 AI 文本转语音服务。只需 5 秒录音即可生成工作室级音质的语音克隆。享受低延迟流媒体,非常适合对话式应用、游戏和代理,支持 31 种语言和句子中切换。

AI 语音生成器

AI 应用

AudiowaveAI 将任何文本转换为自然流畅的音频,非常适合有声读物和随时随地学习。它提供引人入胜、逼真的人声,超越了传统的机器人文本转语音。轻松将文章、PDF 等内容转换为可听内容,以提高工作效率和愉悦度,减少屏幕时间。

文字转语音

AI 应用

Landrific AI 是一款专为录音艺术家和唱片公司设计的先进 AI 工作室。它通过生成歌曲创意、完整歌曲和专辑封面,使用户能够以 10 倍的速度创作热门内容。该平台提供分级订阅计划和终身访问选项,使全球用户都能使用专业的 AI 音乐工具。

AI 音乐生成器

Say My Name! 是一款由人工智能驱动的发音指南,可帮助用户掌握任何姓名或单词的正确发音。它提供准确的音频播放,并支持多种口音选项,是清晰沟通和学习的宝贵工具。

文字转语音

MP3 转换器 AI 是一款基于网络的工具,旨在利用人工智能将音频文件转换为 MP3 格式。它旨在提供快速高效的转换过程,使音频文件能够跨各种设备和平台访问。该服务专注于简洁性和用户友好性,以实现快速的音频转换。

AI 音频编辑器

此 Web UI 利用 OpenAI 的文本转语音 API 将书面文本转换为自然流畅的语音。用户需要提供自己的 OpenAI API 密钥才能使用此免费前端来生成各种支持语言的音频内容。

文字转语音

MusicGen 是 Meta 开发的一款免费 AI 音乐生成工具。它利用单个语言模型,根据文本提示、旋律或音频样本创作高质量音乐。这项先进技术实现了多功能且可控的音乐创作,使其能够满足各种创意需求。

AI 音乐生成器

LANDR Composer 是一款由 AI 驱动的插件,可生成和弦进行、贝斯线、旋律和琶音。它无需音乐理论知识,提供智能 MIDI 生成和无缝 DAW 集成,以加速音乐创作并打破创意障碍。

AI 音乐生成器

CurseCut 是一款由 AI 驱动的工具,可自动从视频和音频文件中移除脏话和冒犯性语言。它支持多种格式,提供批量处理功能,并支持超过 30 种语言。通过本地处理保护隐私,自定义过滤和哔哔声方法,使内容适合广大受众。

AI 音频编辑器

AI 应用

SFX Engine 是一款免费的 AI 音效生成器,用户可以为视频、游戏、播客和音乐制作创建自定义音频。它提供无限的变体和详细的文本描述以实现精确定制,对专业人士和初学者都非常友好。立即开始创作独特的音效。

AI 音乐生成器

Drumless.app 提供一个由 AI 驱动的工具,可以轻松地从任何歌曲中分离鼓音轨。上传您的音频文件,将鼓声部分与其他乐器分离。非常适合希望练习、混音或创建高质量鼓伴奏音轨的鼓手、音乐家和制作人。

AI 音频编辑器

AI 应用

Sonnet AI 是一个旨在协助用户生成各种书面内容的平台。它通过提供写作、编辑和润色文本的工具来简化创作过程。该应用程序专注于为希望提高内容创作工作流程并高效生成高质量书面材料的个人和团队提供用户友好的界面。

AI 转录工具

AI 应用

SpeakDocs 是一个由 AI 驱动的平台,旨在将文档转化为引人入胜的音频体验。它允许用户将文本文件转换为语音,使信息更易于访问和消化。非常适合希望通过音频扩大影响力和参与度的内容创作者、教育工作者和专业人士。

文字转语音

FileSpeech 将各种文件转换为自然发音的语音。轻松上传文档、网站链接或扫描文本,选择您偏好的语言和声音,然后收听或下载音频。它旨在提高可访问性和内容创作效率。

文字转语音

DictationDaddy 是一款由 AI 驱动的 Chrome 扩展程序,可在任何网站上实时将您的语音转换为文本。它提供先进的语音识别功能,支持 50 多种语言和口音,转录准确率极高,速度远超手动输入。

AI 转录工具

Yapping 是一款 Chrome 扩展程序,旨在通过启用语音输入来增强您与 Claude.ai 的交互。您无需打字,即可直接向 Claude 发送提示和问题,从而更快、更便捷地向 AI 助手提供详细信息。

AI 转录工具

ClearCypher LLC 提供先进的机器学习解决方案,专注于人工智能驱动的语音和语言技术。他们提供自动语音识别、神经机器翻译和说话人识别,用于将语音转换为文本、本地化内容以及通过语音识别个人。他们的平台专为跨各种应用的实际、可扩展部署而设计。

AI 转录工具

AI 应用

OmMuse 是一个由 AI 驱动的平台,专为音乐人设计,用于管理、协作和分发他们的音乐。它提供 AI 音乐组织、Dolby AI 母带处理、版本控制以及各种音频和项目文件的安全存储,从而简化了全球艺术家的整个音乐创作工作流程。

AI 音频编辑器

AI 应用

Voice Vector 提供先进的语音克隆、文本转语音和语音转文本人工智能技术。用户可受益于灵活的按需付费模式,注册即可获得免费积分和语音克隆。非常适合寻求个性化音频解决方案的开发者、播客和内容创作者。

AI 语音生成器

AI 应用

DeckBird.ai 将演示文稿转换为自动运行的交互式网络研讨会。它提供多种语言的自动语音旁白、AI 驱动的问答以及可嵌入电子邮件和网站的内容。通过可扩展、引人入胜的演示文稿来提升您的销售、营销和培训效果,从而带来潜在客户并减少现场通话。

文字转语音

AI 应用

CassetteAI 提供设备端实时生成音频,拥有 3 亿参数模型,支持音乐、音效和 TTS。其延迟低于 50 毫秒,并提供单一 SDK,每月处理超过 10 万次请求,无需服务器,非常适合游戏和创作者应用。

AI 音乐生成器

SunoPrompt 提供免费的 AI 音乐生成器和创意工具包。通过文本、歌词、图像或视频创作歌曲。生成 AI 音乐提示,在四个质量等级中制作音轨,移除人声,并分离音轨。这是一个用于 AI 辅助音乐创作的综合平台,可免费开始。

AI 音乐生成器

Algochat.io 提供终极 AI 聊天机器人,专为主播设计,旨在提升观众参与度。这些智能机器人提供交互式、动态的实时聊天响应,兼容主流平台。自定义响应和表情符号以匹配您的直播风格,即使在不活跃时也能保持聊天活跃。

AI 转录工具

AI 移动应用

Birdsong 将您的 Twitter Feed 转化为独特的合成器音景。这款 Chrome 扩展程序可与 TweetDeck 配合使用,以您的推文和通知为素材生成环境音频。即使您切换到其他标签页,它也会继续播放,提供一种新颖的信息获取和娱乐方式。

AI 音乐生成器

Relevant 通过在录制时提供实时内容建议来增强播客制作。它会自动从 Reddit、YouTube 和新闻源等来源拉取相关网络内容到一个仪表板中。专业算法可检测和过滤讨论的主题,Pro 用户还可使用实时转录等高级功能。

AI 播客工具

AI 应用

Amped Studio 是一款免费的在线音乐制作器和 AI 歌曲创作者。它提供了一个基于浏览器的数字音频工作站 (DAW),内置虚拟乐器、原创采样和 AI 工具,可用于生成乐曲、改变人声音色以及分离歌曲的音轨。非常适合初学者和经验丰富的创作者。

AI 语音生成器

AI 应用

SplitSong.com 利用人工智能将歌曲分离成独立的乐器音轨。用户可以上传音频文件或链接到 YouTube 视频,AI 将分离出鼓、人声、贝斯和伴奏等元素,并提供可下载的音轨以供进一步编辑或分析。

AI 音频编辑器

Audio AI Dynamics 提供免费的在线 AI 工具,面向音乐家和制作人。分析歌曲以查找调式、BPM 和情绪。功能包括音乐分析器、流派查找器、音频修剪器、录音机和 BPM 敲击器,可提升所有技能水平的音乐制作和分析。

AI 音频编辑器

AI 应用

Stems ST-02 是一款易于使用的音频分离器,可提供高质量的人声和乐器分离。它利用 Facebook 的开源 Demucs 库,为 DJ、制作人和音乐学习者提供了直观的控件,用于从歌曲中提取特定的音频组件。

AI 音频编辑器

Stable Audio Open 是一个域名,它会重定向到有关域名过期的信息。它以前与汽车、金融、健康、购物、旅游、电影、电视、商业、图书、家庭、人际关系和新闻等类别相关。该域名不再活跃。

AI 音乐生成器

使用CPAIT这款AI驱动的移动应用,掌握普通话发音。即时获得音节、声调和发音的反馈。支持离线练习,提供结构化课程,涵盖拼音、实用短语和文章。非常适合希望获得自信、地道发音的初学者到高级学习者。

AI 转录工具

Vertate 的 AI 采样生成器可在几秒钟内创建独特、免版税的音频采样。音乐制作人可以根据文本提示或现有音频生成循环、旋律和独一无二的声音。所有生成的采样均可永久商用,为创作者提供即时、原创的音频素材。

AI 音乐生成器

AI 移动应用

AI Voice Cover 是一款 Chrome 扩展程序,它使用 AI 模仿名人或角色的声音。录制您的声音,选择一个模板,即可即时生成具有可自定义音高、音色和风格的新声音,用于娱乐、音频编辑和语言学习。

AI 语音生成器

AI 移动应用

Audio SpeechScribe 是一款 Chrome 扩展程序,可将会议、讲座、歌曲和播客的音频转换为文本。它提供与手动方法相当的准确转录,支持多种音频文件格式。该工具旨在成为内容创作的经济高效解决方案,并提供免费试用供用户测试其功能。

AI 转录工具

口音识别器是一款由人工智能驱动的工具,可分析语音模式以识别口音特征。它为个人改进、沟通增强和语言探索提供快速、准确的见解。通过这款用户友好的应用程序,发现您独特的语音模式并探索全球口音。

AI 转录工具

Speech Lab 是一款由 AI 驱动的移动应用程序,可将您的声音转换为逼真的名人、卡通或怪物角色。它还可以将文本转换为高质量的 AI 配音,并生成自定义音效,为内容创作者和声音实验者提供全面的工具。

AI 语音生成器

AI 应用

GetSound.ai 提供实时、天气响应式音景,旨在增强深度专注并最大限度地减少干扰。其创新技术每次使用都提供独特的音频体验,促进持续的生产力和放松。免费试用,解锁您工作流程中的巅峰表现。

AI 音乐生成器

Chillify 提供由 AI 精心打造的 Lo-fi 音乐流,专为放松、专注和提高效率而设计。探索 Jazzy Cafe、亚洲风情和 Soft Indie DnB 等多样化流派,更有为学习、工作和氛围感精心策划的播放列表。通过独特的 AI 生成的音景,提升您的专注力并放松身心。

AI 音乐生成器

FineVoice 提供免费、无需注册的 AI 语音生成器,可即时生成逼真的文本转语音音频。在几秒钟内为播客、视频和有声读物创建工作室品质的配音、音乐和音效。功能包括语音克隆、自定义语音设计和多语言支持。

AI 语音生成器

AI 移动应用

ChatGPT Read It! 增强您的 ChatGPT 体验,将文本响应转换为语音。此 Chrome 扩展程序添加了交互式“朗读”和“停止”按钮,支持听觉学习和多任务处理。它无缝集成到 ChatGPT 界面中,提供易于使用的解决方案,以提高生产力和可访问性。

文字转语音

Character Lingo 提供了一种与著名角色互动的方式,允许用户用他们的语言表达自己。这款 Chrome 扩展旨在通过基于角色的沟通赋予用户力量和尊重,从而增强在线互动和创意表达。

AI 语音生成器

StarVoice AI 是一款名人语音和视频生成器,用户可以克隆自己的声音或使用精选的名人声音。以任何语言创建自定义音频和视频片段,非常适合娱乐和个性化消息。每日新增角色。

AI 语音生成器

AI 应用

Klangio 是一款 AI 音乐转录套件,可以在几秒钟内将音频和 YouTube 视频转换为乐谱、吉他谱、MIDI 和 MusicXML。它为各个技能水平的音乐家而设计。

AI 转录工具媒体与娱乐

AI 应用

Dictanote 是一款内置语音转文本的笔记应用,支持50多种语言的语音输入、语音命令,并通过 AudioScribe 将口述的想法转化为简洁的总结文本。

AI 转录工具

AI 应用

InsMelo 是一个免费的 AI 歌曲生成器,可以将歌词、文本或图像转化为完整的原创免版税歌曲,涵盖 400 多种风格,支持可定制的声音和 MP3 或 WAV 导出。专为创作者、营销人员和音乐人打造。

AI 音乐生成器媒体与娱乐

AI 应用

Nafy AI 是一个免费的 AI 音乐生成器,可以将文本或歌词转换为免版税的专业音轨,提供封面、扩展、编辑、歌词生成和人声去除等工具。为创作者、营销人员和制作人而打造。

AI 音乐生成器媒体与娱乐

AI 应用

Singify 是 Fineshare 开发的 AI 音乐和歌曲生成器,可以将文本提示、歌词、图像和音频转换为完整的歌曲,提供 AI 人声、翻唱和免版税曲目,适合创作者、音乐家和爱好者。

AI 音乐生成器媒体与娱乐

AI 应用

Meloflow 是一个 AI 音乐和歌曲生成器,可以将文本提示、歌词和创意转化为原创曲目,提供封面、扩展、添加人声和音轨分离的工具,旨在满足需要免版税音乐的创作者。

AI 音乐生成器媒体与娱乐

AI 应用

Jammable(前身为Voicify AI)是一个AI翻唱平台,允许您使用数千个社区创建的AI语音模型重新演唱任何歌曲,或训练您自己的声音,几秒钟内生成翻唱。

AI 音乐生成器媒体与娱乐

AI 应用

Lyria 3 AI 是一个在线 AI 音乐生成器,可以将文本提示和歌词转化为完整的歌曲,包括人声和乐器,以及曲目扩展、人声翻唱和供创作者和营销人员使用的音轨导出。

AI 音乐生成器媒体与娱乐

AI 应用

Anymelo 是一个 AI 歌曲和音乐生成器,可以将文本描述或歌词转换为各类免版税曲目,提供扩展歌曲、AI 翻唱、分层和人声分离的工具。

AI 音乐生成器媒体与娱乐

AI 应用

GoAISong 是一个 AI 歌曲生成器,可以将提示、歌词、诗歌或故事转化为完整的可下载歌曲,配有 AI 人声,同时生成歌词、AI 翻唱和用于礼物、视频和内容的伴奏节拍。

AI 音乐生成器媒体与娱乐

AI 应用

Lalals 是一个全方位的 AI 音频平台,提供语音、音乐制作、音轨分离和母带处理,拥有超过 3,000 种可直接使用的语音,用于语音转换和文本转语音。

AI 语音生成器媒体与娱乐

AI 应用

AirMusic 是一个 AI 音乐生成器和音频工具包,可以将文本提示或歌词转换为原创歌曲,提供人声去除、声音克隆、AI 翻唱、音乐视频和为创作者提供的唱歌照片工具。

AI 音乐生成器媒体与娱乐

AI 应用

BeMusic AI 是一个文本转音乐生成器,可以在几秒钟内将书面描述转换为完整的曲目,并提供 AI 人声,此外还有封面、音轨、音乐视频和付费计划的免版税商业许可工具。

AI 音乐生成器媒体与娱乐

AI 应用

音乐特效是一个AI音乐生成器,可以在几秒钟内从文本创建免版税的歌曲和节拍,提供文本到音乐、自定义生成以及适用于创作者和商业项目的声乐或器乐模式。

AI 音乐生成器媒体与娱乐

AI 应用

MusicMake.ai 是一个 AI 音乐生成器,可以根据提示、歌词或音频在大约一分钟内生成两条曲目,并配备音乐代理,可以扩展、混音、翻唱和分离人声,以完成真实项目的曲目。

AI 音乐生成器媒体与娱乐

AI 应用

MuseGen 是一个全能的 AI 音乐生成器,可以将文本提示转换为完整的歌曲,包括旋律、歌词和人声,然后让您进行精细调整、母带处理,并以 MP3、WAV 或 MIDI 格式导出,适用于任何音乐风格。

AI 音乐生成器媒体与娱乐

AI 应用

Mubert 是一个 AI 音乐生成器,可以将描述情绪、风格或场景的文本提示在几秒钟内转化为完整的免版税曲目,并提供人声去除、翻唱、混音和音轨分离等工具。

AI 音乐生成器媒体与娱乐

音乐AI工作室是一个AI音乐生成器和歌曲创作工具,可以在几分钟内将提示和歌词转化为可发布的歌曲,提供扩展、混音、声乐分离和翻唱的工具,以及供开发者使用的API。

AI 音乐生成器媒体与娱乐

AI 应用

Storyship 是一个在线 AI 语音合成工具,适用于视频。上传视频,编辑或撰写旁白脚本,选择 AI 语音,并导出同步的语音合成视频,适合屏幕录制、静音视频和无脸 YouTube 内容。

AI 语音生成器媒体与娱乐

常见问题

知道一个在音频、语音与音乐中出类拔萃的工具吗?

ToolPotion是人们浏览以寻找最佳音频、语音与音乐的AI工具目录。免费列出,每个提交都经过编辑审核——将您的工具放在搜索的起点。

提交适用于音频、语音与音乐的AI工具