AI.ADK.WANG DIRECTORY

AI工具分类聚合库 [949 个收录]

全网最全的 AI 生产力工具雷达。包含大语言模型、图片生成、智能音频、视频渲染及自动化编程开发工具,一键直达官方及评测详情。

已收录 AI 工具 949 个
覆盖行业分类 22 种
匹配结果:949 款工具
0
KR

Krisp

Krisp

Krisp是人工智能驱动的音频处理软件,提升通话和会议的语音质量。通过先进的AI技术,能实时消除背景噪音和人声干扰,让通话更加清晰。Krisp支持双向降噪,能消除你听到的噪音,能确保对方听不到你的背景杂音。具备人声分离功能,能突出主讲人的声音,让会议记录更加准确。Krisp提供会议转录和摘要功能,支持多种语言,帮助用户快速整理会议内容。最新版本增加了口音转换功能,能将不同口音的语音转换为标准发音,进一步提升沟通效率。Krisp适用于多种场景,包括远程办公、在线会议和播客制作等。支持Windows、Linux、Mac、Android和iOS等多种操作系统,确保用户在不同设备上都能使用。

5
免费+付费
#降噪功能:消除背景噪音和人声干扰,确保通话清晰。 #人声分离:突出主讲人声音,提升会议记录的准确性。 #口音转换:将不同口音的语音转换为标准发音,增强沟通效率。
0
SO

Soundraw

Soundraw

Soundraw是专为创作者打造的AI音乐生成器,能根据用户设置的参数(如流派、情绪、乐器、时长等)快速生成背景音乐。用户可以通过简单的操作,选择音乐风格(如流行、嘻哈、古典等),调整节奏、音量、乐器组合等,生成符合需求的音乐片段。Soundraw 的优势是生成的音乐是免版税的,用户可以将这些音乐用于视频创作、播客、广告等多种场景,无需担心版权问题。

5
免费+付费
#AI 音乐生成:Soundraw 能根据用户选择的情绪、流派、乐器、长度等参数,快速生成高质量的音乐作品。支持多种音乐风格,如流行、电子、古典、爵士、嘻哈等。 #个性化定制:用户可以根据需求调整音乐的长度、速度、节奏、调式等参数。可以对生成的音乐进行进一步的个性化调整,例如缩短前奏、重新排列副歌、改变曲调等。 #音乐编辑与调整:Soundraw 提供丰富的音乐编辑功能,包括音频剪辑、混合、变速、变调等。用户可以像编辑视频一样编辑音乐,完美适应视频内容或其他需求。
0
BO

Boomy

Boomy

Boomy是AI驱动的音乐创作平台,支持用户通过选择不同的音乐风格和流派,快速生成原创音乐作品。平台提供直观的界面和强大的编辑工具,支持音乐的个性化定制和分发。用户能轻松将创作上传至主流流媒体平台。Boomy适合专业音乐人,音乐爱好者和初学者,能降低音乐创作的门槛,让音乐创作变得更加便捷和普及。

5
付费
#AI音乐生成:基于先进的AI算法快速生成不同风格的原创音乐作品。 #音乐风格定制:提供多种音乐流派选择,用户能根据个人喜好调整旋律、乐器和效果。 #合作工具:促进用户之间的合作,共享创意和思想,共同提升作品质量。
0
LE

Lemonaid

Lemonaide

Lemonaid是一款AI音乐生成工具,专为专业音乐人设计,能自动生成具有旋律、和声和节奏的音乐作品。提供多种风格的音乐生成模式,用户可以根据个人喜好选择音乐类型和节拍,自定义音乐生成过程。Lemonaid的生成效果逼真,音乐质量高,适用于背景音乐、电影配乐、游戏音效等领域。Lemonaid提供Mac和Windows软件下载。

5
付费
#智能化音乐生成:Lemonaid基于人工智能学习大量音乐作品的模式,通过深度学习合成出全新的旋律和和声,缩短了创作时间,拓宽了音乐人创作的可能性 。 #用户友好的界面:Lemonaid的设计注重用户体验,提供直观的界面,让非专业的音乐爱好者也能轻松驾驭,只需通过简单的指令操作,可产生个性化的音乐作品 。 #多样化的音乐风格:Lemonaid适用于传统的音乐风格,可以根据不同的音乐需求,生成包括流行、古典、电子、爵士等多种风格的音乐,满足用户多样化的艺术表达需求 。
0
LA

LALAL.AI

Lalal

LALAL.AI是AI音乐音频处理工具,能快速、精准地将音频或视频中的人声、伴奏、鼓、贝斯等不同音轨分离,支持多种音频和视频格式(如MP3、WAV、MP4等)。工具提供免费的批量上传功能,用户能上传多达20个文件进行处理。LALAL.AI具备去除回音、混响和降噪等功能,能有效提升音频处理质量。工具提供数字声音克隆功能,帮助用户创建个性化的数字声音副本。

5
付费
#音频分离:支持将音频或视频中的人声、伴奏、鼓、贝斯、钢琴、吉他等不同音轨分离,支持多达10种音轨的分离。 #高质量处理:基于先进的 AI 技术,确保分离后的音质清晰且无损,提供高保真音频输出。 #批量上传:支持一次性上传多达20个文件进行批量处理,适合批量操作需求。
0
AU

Audo Studio

Audo

Audo Studio 是AI音频处理工具,能快速去除背景噪音、增强语音。工具操作简单,只需一键能完成音频清理,适合播客、YouTube 创作者和音频视频制作人员使用。Audo Studio 提供多种计划,用户能根据需求选择。工具核心优势在于高效、便捷和高质量的音频处理,能显著提升音频的清晰度和专业性。

5
免费+付费
#高级降噪:自动去除背景噪音,如邻居的音乐、狗叫、鹦鹉的叫声等,让用户无需寻找安静的录制环境,随时随地录制高质量音频。 #回声减少:自动减少录音中的回声(混响),节省购买吸音泡沫板的成本,提升音频的清晰度和专业性。 #自动音量调整:自动调整音量水平,确保音频的音量均匀,避免音量忽高忽低,提供更舒适的听觉体验。
0
AS

AssemblyAI

Assemblyai

AssemblyAI是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#转录和理解语音的AI模型 #音频智能处理(AI音频工具) #AI音频生成处理
0
IB

IBM Watson文字转语音

Ibm

IBM Watson文字转语音是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#IBM Watson文字转语音 #音频智能处理(AI音频工具) #AI音频生成处理
0
RE

RESEMBLE.AI

Resemble

RESEMBLE.AI 是基于人工智能技术生成逼真和个性化语音的平台。通过深度学习算法分析真实人类声音样本,学习其独特的发声模式和语言特征,然后根据用户输入的文本生成相似的语音。可以用于多种应用场景,如内容创作、电影和动画产业、广告行业以及个人使用等。

5
免费+付费
#语音克隆:通过少量的语音样本创建一个与原声音相似的人工智能模型。 #语音参数调整:可以调整语音的情感、语调、语速、口音等参数。 #配音风格:提供不同的风格模板,改变声音的特性。
0
讯飞

讯飞智作

Peiyin

讯飞智作是科大讯飞推出的一站式AIGC内容创作平台,基于人工智能技术提供文字转语音、虚拟数字人视频制作等服务。用户可以轻松实现音视频内容的快速生成,无需专业技能即可创作出高质量的媒体作品。广泛应用于媒体、教育、企业等多个领域,助力内容创作者提升工作效率,实现创意的快速落地。

5
免费+付费
#AI配音功能:用户可以输入文稿或录音,选择虚拟主播进行配音,支持多语种、多情感、多风格的配音,满足个性化需求。 #虚拟数字人视频生成功能:用户可以通过简单的操作,将虚拟数字人与自己的内容相结合,生成生动有趣的视频。 #PPT生成视频功能:用户可以将PPT文件导入平台,通过智能剪辑和编排,快速生成高质量的视频内容。
0
CL

Clipchamp AI旁白生成器

Clipchamp

Clipchamp AI 旁白生成器是Clipchamp推出的在线AI语音生成工具,能将文本快速转换为逼真的语音画外音。工具支持 400 多种声音和 80 种语言(包括中文),用户能自由调节语调、情感和语速(0.5 倍至 2 倍),添加自然的字幕提升视频无障碍体验。Clipchamp 能轻松满足社交媒体视频、企业演示和教育内容登多种需求,是创作者提升视频质量的利器。

5
免费+付费
#文本转语音:用户只需在文本框中输入或粘贴脚本,能生成高质量的语音画外音。 #多语言支持:提供超过80种语言选择,涵盖全球主要语种,包括西班牙语、日语、印地语、意大利语、阿拉伯语、德语、法语等。 #多样化声音选择:支持400多种声音,用户能选择自然的男性、女性和中性语音,完美配合视频内容。
0
SP

Speechify

Speechify

Speechify 是强大的文字转语音(TTS)工具,支持多平台(如 iPhone、iPad、Android、Mac、网页版、Chrome 扩展等),能轻松朗读任何文档、文章、书籍、PDF和电子邮件。工具通过 AI 技术将文本内容转换为自然流畅的语音,提供 200+ 种语音选择,覆盖 60+ 种语言,支持声音克隆。Speechify 能帮助用户提升阅读速度至 4.5 倍,节省时间。工具适合有阅读障碍的人群,能广泛应用在学习、工作和日常阅读中,助力超过 5000 万用户高效获取信息。

5
免费+付费
#文字转语音:将文本内容转换为自然流畅的语音,支持多种语言和语音风格。 #多平台支持:支持在 iPhone、iPad、Android、Mac、网页版、Chrome 扩展和 Edge 插件等多种设备和平台上使用。 #AI 语音生成器:提供 200+ 种栩栩如生的 AI 语音,支持语音克隆,用户能创建个性化语音。
0
VE

Veed AI Voice Generator

Veed

Veed AI Voice Generator是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#Veed推出的AI语音生成器 #音频智能处理(AI音频工具) #AI音频生成处理
0
TY

Typecast

Typecast

Typecast 是先进的AI语音生成平台,支持将文本高效转化为自然流畅的语音内容。平台提供丰富多样的语音风格,涵盖不同年龄、性别和场景,支持多语言生成,能通过智能情感识别技术,根据文本上下文自动调整语音的情感和语调。支持用户上传音频样本进行语音克隆,实现个性化语音定制。Typecast 操作简单,界面友好,广泛应用在视频制作、音频创作、教育等领域,助力创作者快速生成高质量的语音内容,提升工作效率。

5
免费+付费
#文本转语音:将文本内容快速转换为自然流畅的语音,支持多种语言和方言,满足不同场景需求。 #情感识别与调整:通过智能技术识别文本情感,自动调整语音的语调和语速,使语音更具表现力。 #语音克隆:用户上传短音频样本后,可生成与原声高度相似的语音,实现个性化语音定制。
0
MU

Murf AI

Murf

Murf AI 是多功能的AI语音生成器,专为企业和创作者设计。工具支持 200 多种语音和 20 多种语言,能快速将文本转换为逼真的语音配音。用户能通过语音克隆、风格调整等功能,生成自然流畅的语音内容,适用广告、培训、播客、有声读物等多种场景。Murf AI提供 API 和多平台集成,帮助企业高效制作语音内容,降低制作成本,提升生产效率,是全球众多企业信赖的语音解决方案。

5
付费
#文本转语音(Text-to-Speech):将文本内容转换为逼真的语音配音,支持多种语言和口音。 #语音克隆(Voice Cloning):能够克隆用户的声音,生成与原声高度相似的语音。 #AI 配音(AI Dubbing):支持 30 多种语言的配音,适合视频、音频项目的本地化。
0
LO

LOVO AI

Lovo

LOVO AI是专业的AI文字转语音工具,提供500+声音和100种语言的文本转语音服务。专为营销、培训、社交媒体等视频内容创作设计,支持无缝音频视频同步、自动字幕生成、AI写作辅助和声音克隆技术。LOVO AI通过其易用的界面和强大的编辑工具,帮助用户节省时间和成本,提升内容的全球吸引力和专业度。

5
免费+付费
#AI人声和文本转语音生成工具 #音频智能处理(AI音频工具) #AI音频生成处理
0
PL

Play.ht

Play

Play.ht是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#超真实在线AI语音生成 #音频智能处理(AI音频工具) #AI音频生成处理
0
NA

NaturalReader

Naturalreaders

NaturalReader 是AI文本转语音工具,能将各类文本转换为自然流畅的语音,支持 PDF 等 20 多种格式和 50 多种语言。工具特色功能包括由大型语言模型驱动的多语言语音、语音克隆技术及内容感知能力,使语音更自然、更像人类。NaturalReader 的 AI 语音生成器工作室支持用文本创建旁白音频,适用 YouTube、培训、在线学习、有声读物等多种商业用途,是提升文本可访问性和内容创作效率的强大工具。

5
免费+付费
#AI 文本到语音:支持将任何类型的文本用自然的 AI 语音朗读出来,支持 PDF 和 20 多种格式。 #LLM 多语言语音:提供 50 多种语言和 200 多种 AI 语音,语音更自然、更高质量。 #语音克隆:基于 AI 技术即时克隆任何声音,实现个性化语音合成,满足不同用户需求。
0
FA

FakeYou

Fakeyou

FakeYou 是AI文本转语音平台,用户输入文本,选择喜欢的卡通角色或名人声音,角色能“说出”自己想要的内容。平台支持文本到语音、语音转换、语音克隆等多种功能,且提供零样本语音合成技术,没有大量样本也能生成逼真的声音。FakeYou 拥有丰富的角色声音库,包括米奇、瑞克、比尔·盖茨等,广泛应用在创意视频、音频制作和个人娱乐等领域,深受全球用户喜爱。

5
免费+付费
#文本到语音(Text to Speech):用户输入文本内容,选择喜欢的声音(包括名人或卡通角色的声音),平台能将文本转换为语音音频。 #语音转换(Voice Conversion):用户将自己的声音转换为其他声音,例如让自己的声音变成米奇、瑞克或其他名人的声音。 #语音克隆(Voice Cloning):用户上传特定人物的声音样本,平台能生成该人物的语音克隆。
0
MU

Mubert

Mubert

Mubert 是AI音乐生成平台,通过简单易用的方式为用户提供个性化的音乐创作和使用体验。用户可以通过输入关键词(如音乐风格、情绪、场景等)来生成符合需求的免版税音乐,适用于视频背景、播客配乐、商业项目等多种场景。提供了多个功能模块,包括 Mubert Render(快速生成背景音乐)、Mubert Studio(艺术家上传样本并创作)、Mubert API(为开发者提供定制化音乐解决方案)、Mubert Play(适合生活场景的音乐播放)等。

5
免费+付费
#即时生成音乐:用户可以通过输入文本描述(如音乐风格、情绪、场景等)或选择预设标签,快速生成最长25分钟的高质量音乐。 #多种生成模式:支持音轨(track)、短曲(jingle)、循环(loop)和混合(mix)等多种模式,满足不同使用场景和时长需求。 #风格定制:提供丰富的音乐风格选择,涵盖流行、电子、古典、嘻哈等60多种类型。
0
WE

WellSaid

Wellsaid

WellSaid 是AI 语音生成工具,提供高质量、自然逼真的语音生成服务。工具拥有超过120种自然声音,涵盖多种语言和风格,基于专业配音演员的授权录音,确保语音的高质量和多样性。工具支持团队协作、发音库管理、自定义语音等功能,同时符合 SOC2 和 GDPR 标准,保障数据安全与隐私。WellSaid 提供强大的 API 集成,适用企业级应用,如培训、营销、产品体验等,帮助企业高效生成语音内容,提升工作流程效率。

5
免费+付费
#高质量语音生成:提供超过120种自然声音,涵盖多种语言和风格,基于专业配音演员的授权录音,确保语音自然、逼真且高质量。 #企业级安全与合规:符合SOC2 Type 2和GDPR标准,基于双层内容审核机制,保障数据隐私和AI的道德使用,客户对数据和生成内容拥有完全所有权。 #强大的协作功能:提供团队工作空间,支持项目共享、评论和管理,配备发音库确保品牌一致性和专业术语的准确发音,通过角色基础的访问控制确保内容安全。
0
VO

Voicemod

Voicemod

Voicemod 是强大的AI实时语音变声工具,提供音效控制界面。工具基于先进的 AI 技术,让用户能在语音通话、游戏、直播等场景中轻松改变声音,提供超过150种变声效果和数千种音效。工具支持 Windows 和 macOS 系统,还与 Discord、Steam 等平台无缝集成。用户用热键能快速切换音效,通过 Voicelab 创作个性化声音。Voicemod 简单易用的界面和强大的功能,让语音互动更加有趣和多样化。

5
免费+付费
#实时变声:基于 AI 技术,在语音通话或游戏中实时改变用户的声音,让声音瞬间转换为不同音色。 #丰富的变声效果库:提供超过150种预设变声效果,涵盖不同性别、年龄、风格(如卡通、机器人、外星人等)。 #自定义变声:支持用户通过 Voicelab 调整音高、音色等参数,创造完全个性化的独特声音。
0
LI

Listnr

Listnr

Listnr 是先进的AI语音合成工具,能将文本快速转化为自然流畅的语音。工具支持超过142种语言和1000多种声音风格,支持用户克隆自己的声音。Listnr 生成的语音极为逼真,与真人无异,适合多种场景,如视频配音、播客制作、有声读物创作、社交媒体内容生成等。工具提供情感调整、语速控制等高级功能,操作简单,界面友好,是内容创作者和企业用户的理想选择。

5
免费+付费
#文本转语音:将任何文本内容快速转换为自然流畅的语音,支持多种语言和声音风格。 #语音克隆:用户上传自己的声音样本,能生成与自己声音高度相似的合成语音。 #多语言支持:覆盖超过 142 种语言和多种方言,满足全球用户的多样化需求。
0
VO

Voice.ai

Voice

Voice.ai 是先进的实时AI变声工具,提供高质量的语音解决方案。平台支持文本到语音(TTS)、语音克隆、语音变声等多种功能,能生成高度逼真的语音,支持多种语言和方言。Voice.ai 提供企业级语音Agent,neng 自动化处理电话通话,帮助企业降低成本、提高效率。Voice.ai 强大的 API 和 SDK 为开发者提供灵活的集成方案,适用直播、游戏、培训等多种场景。Voice.ai 以低延迟、高合规性和易于扩展的特点,为企业和个人提供高效、个性化的语音交互体验。

5
免费+付费
#AI语音Agents(Voice Agents):提供多种功能的语音代理,包括通用Agent、客户支持Agent、销售线索资格Agent等,能自动化处理企业与客户的电话通话。 #文本到语音(Text to Speech):将文本转换为高质量、接近人类的语音,支持多种语言和方言,生成工作室级别的音频,适用有声读物、视频、培训等多种场景。 #AI语音克隆(Voice Cloning):仅需10秒音频样本,能克隆出高度逼真的语音,用户能创建独特的语音身份,适用广告、虚拟助手等多种场景。
0
VO

Voicemaker

Voicemaker

Voicemaker.in是功能丰富的AI文字转语音在线平台,支持130+种语言和1000+种AI语音音色。用户可自由调整语速、音调、音量、强调语气等参数,支持SSML高级控制和多语音混合编辑。平台提供语音克隆、Speech-to-Speech转换、RESTful API等高级功能,生成的音频可下载为MP3格式并享有商业使用权。适合播客制作、视频配音、有声读物和电子学习等多种场景。

5
付费
#多语言多音色:支持130+种语言和1000+种AI语音,涵盖男女声及多种风格,包括2025年新增的ProV2印度语言优化引擎 #精细语音调节:可调整语速、音调、音量、强调语气,支持SSML标签进行高级控制和发音编辑器精细调校 #语音克隆:上传几分钟音频即可复制自己的声音,支持30+种语言,所有付费方案均可使用
0
ME

MetaVoice

Themetavoice

MetaVoice是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#AI实时变声工具 #音频智能处理(AI音频工具) #AI音频生成处理
0
PR

Producer.ai

Riffusion

Producer.ai 是AI 音乐创作平台。通过先进的 AI 技术,为用户提供了一个简单易用的音乐创作环境,帮助用户激发创造力并快速生成音乐作品。用户可以通过自然语言与平台的核心功能,Producer 进行交互,生成音乐、歌词,进行混音和替换作品中的部分段落。用户能上传或录制自己的音频,用于进一步的创作。Producer.ai 的界面友好,操作简单,适合所有水平的创作者。平台采用了最新的音乐模型 FUZZ-2.0,能生成高质量的音乐作品。

5
免费+付费
#音乐生成:用户可以通过自然语言指令让 Producer.ai 生成各种风格的音乐,从流行到古典,从电子到爵士,满足不同创作需求。 #歌词创作:平台能根据用户提供的主题、情感或风格生成歌词,帮助创作者快速构思和创作歌词内容。 #混音功能:用户可以上传自己的音频片段,使用 Producer.ai 的混音工具进行调整和优化,提升作品的音质和效果。
0
网易

网易天音

Tianyin

网易天音是网易推出的一站式AI音乐创作工具,为用户提供简单易用的音乐创作。音乐爱好者或者歌手只需输入灵感,AI能辅助完成词、曲、编、唱,生成AI初稿后,支持词曲协同调整。用户无需专业音乐知识,通过选择风格、节奏等参数,快速生成个性化的音乐作品。网易天音丰富的模板和智能生成功能,让音乐创作变得简单又高效,适合音乐爱好者、内容创作者和专业人士使用。

5
免费+付费
#AI 编曲:提供丰富的和弦模板和多种音乐风格,用户能快速选择并生成伴奏。 #极速渲染:快速生成高质量的编曲效果,节省创作时间。 #AI 一键写歌:输入灵感,AI自动完成歌词创作、旋律生成、编曲和演唱,适合零基础用户。
0
NO

Notta

Notta

Notta是语音转文本工具,能将音频和视频内容实时转录成文字,支持多达 58 种语言。工具自动生成会议摘要、提取关键信息和行动项,将重要内容剪辑成片段分享给团队成员。Notta 具备会议录制、日程安排等功能,支持与 Slack、Salesforce、Notion 等多种常用工具无缝集成,极大地提升工作效率。Notta适用任何现代设备,如PC、智能手机和平板电脑,从麦克风转录在线会议、网页音频、音频文件和现场录音,Notta都能处理,是提升会议效率和团队协作的利器。

5
免费+付费
#AI转录:支持58种语言,能将音频或视频内容实时转录为文字,方便用户快速获取会议记录。 #自动翻译:提供AI驱动的翻译功能,帮助用户跨越语言障碍,轻松应对多语言会议。 #AI笔记:自动提取会议中的关键信息、行动项和决策,帮助用户快速总结会议要点。
0
BG

BGM猫

Bgmcat

BGM猫是北京灵动音科技有限公司推出的AI智能生成BGM音乐的工具,用户只需选择音乐时长和对应标签工具能自动生成BGM。工具具提供多种音乐风格和场景选项,如节奏感、爵士、轻音乐、旅行、搞笑等,帮助用户轻松找到合适的背景音乐,提升视频的吸引力和专业度。BGM猫能简化音乐创作过程,让视频制作更加便捷高效。

5
免费+付费
#智能生成:用户输入音乐的时长和相关标签,如场景、风格、心情等,BGM猫能自动生成与之匹配的背景音乐。 #多样化选择:提供丰富的音乐风格,包括古风、电子、R&B、爵士、轻音乐、民谣等,及多种场景标签,如时尚、美妆、旅行、搞笑等,满足不同创作需求。 #个性化定制:用户能根据自己的需求调整音乐的节奏、旋律等参数,实现个性化的音乐定制。
0
AD

Adobe Podcast

Podcast

Adobe Podcast 是Adobe推出的在线AI音频录制和编辑工具,专为播客创作者、声音工作者及内容创作者设计。工具基于 AI 技术优化语音质量,去除背景噪音和回音,让声音清晰且专业。用户无需下载软件,直接在浏览器中即可录制、编辑音频,支持多人远程协作。Adobe Podcast提供转录功能,支持多种语言,可将音频转换为视频,生成字幕,方便在不同平台分享,助力创作者高效产出高质量音频内容。

5
免费+付费
#语音增强:基于 AI 技术去除背景噪音和回音,一键优化音频,让声音清晰且专业。 #录制功能:支持本地和远程多人录制,以高质量的 16 位 48kHz WAV 格式捕捉音频。 #音频编辑:将音频转录为文本,支持像编辑文档一样剪辑音频,智能剪辑静音部分,提升编辑效率。
0
UB

Uberduck

Uberduck

Uberduck是一个开源的AI语音生成和合成的社区,该平台提供了超过5000多种声音帮助用户制作AI配音和语音,用户可以从文本生成逼真的语音、歌唱和说唱,创建自定义语音克隆。支持多种语言,提供API访问,开发者能将这些功能集成到自己的应用程序中。

5
免费+付费
#文本转语音(TTS):将文本转换为自然流畅的语音输出,支持多种语言和语音风格。 #AI歌唱:生成AI驱动的歌唱声音,为音乐创作带来新的维度。 #声音转换:能将一种声音风格转换为另一种,增加创作的多样性。
0
魔音

魔音工坊

Moyin

魔音工坊是一款专业的AI配音工具,拥有800多款声音和1000多种风格,满足从视频配音到有声书的广泛需求。魔音工坊提供丰富的功能,包括语速调整、多音字选择、停顿控制等,确保文字转语音的效果逼真自然。用户可以轻松下载无损音频文件,享受便捷的配音体验。魔音工坊还提供会员服务,带来更多特权和优惠,是内容创作者和专业人士的理想选择。

5
付费
#至臻发音人升级:魔音工坊的至臻发音人经过全新升级,能提供更加情感丰富和自然的声音体验。语调起伏、语速控制和情感渲染都经过精心调整,合成的声音不仅逼真自然,而且充满生命力和情感色彩。 #闲聊发音人:新增的闲聊发音人系列能够精准再现真人般的叹息、笑声以及思考时的自然停顿,营造出轻松愉悦的聊天氛围,对话更加生动和真实。 #小语种能力扩展:魔音工坊支持多种外语,包括但不限于法语、德语、泰语、西班牙语、葡萄牙语、意大利语等,用户能够轻松实现不同语言的自由切换,满足内容出海的本地化需求。
0
BE

BeatBot

Beatbot

BeatBot是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#输入文本提示快速生成歌曲和音乐 #音频智能处理(AI音频工具) #AI音频生成处理
0
BE

beatoven.ai

Beatoven

beatoven.ai是AI音乐生成平台,旨在为视频、播客和游戏制作者提供版权免费的背景音乐。用户只需输入音乐想法,能快速生成超过250种风格的音乐。平台支持个性化定制,包括音乐长度、风格、情绪和乐器选择,满足不同创作需求。beatoven.ai的音乐具有高质量混音和母带处理,适合直接使用。提供灵活的定价方案,包括免费版、标准版和高级版,适应不同用户的预算和需求。

5
免费+付费
#AI音乐生成:基于人工智能技术创作版权免费的背景音乐,适用于视频、播客和游戏等多种媒体内容。 #简易操作流程:用户选择音乐的风格、类型和情绪后,AI系统自动创作音乐轨道,无需复杂的音乐编排或深入的音乐知识。 #用户友好的界面:提供一个无代码平台,易于设置和使用,适合所有技能水平的开发者。
0
悦音

悦音配音

Yueyin

悦音配音是由深圳制片帮网络科技有限公司开发的AI+真人配音平台,已服务超1000万用户、累计合成音频突破3亿条。平台提供数百款发音人和近千种风格选择,涵盖男声、女声、童声、方言及多语种,支持语速调节、多音字处理、停顿调节、情绪选择等精细化编辑功能。输入文字3秒即可生成拟人音频,支持MP3/WAV无损格式导出,是自媒体创作者和商业用户的专业配音工具。

5
免费+付费
#媲美真人的AI智能配音,海量音色库提供不同风格的男声(如磁性浑厚、真实自然、新闻主播等风格)、女声(如温柔甜美、客服女声、电台新闻女声等风格)和童音(如稚嫩可爱、萝莉女声、阳光青春等风格) #支持多种语种和方言的配音,包括普通话、英文、方言(如东北话、四川话、粤语、台湾话、湖南口音等)和其他多语言(如日语、葡萄牙语、韩语、西班牙语等) #AI智能违禁词检测,提供行业内最新广告法,各平台敏感词,通用、新闻等违禁词在线查询检测。
0
AC

ACE Studio

Acestudio

ACE Studio是时域科技推出的免费AI音乐合成工具,基于AI技术帮助用户快速生成专业品质的歌声和乐器演奏。工具提供歌声合成、AI小提琴、声线转换和克隆等功能,支持用户通过简单的MIDI输入或声音样本创建音乐作品。ACE Studio具备音频分离、采样生成等辅助工具,及与数字音频工作站(DAW)的无缝集成能力,极大地简化音乐制作流程,适合音乐制作人、作曲家、教育者及音乐爱好者使用。

5
免费+付费
#歌声合成:基于超过80种免费商用的AI声线,将MIDI和歌词转换成专业品质的歌声,支持多种语言和音乐风格。 #AI小提琴:无需下载庞大的采样库,通过AI技术创作出逼真的小提琴演奏作品,提供轻量级、基于云端的音乐制作解决方案。 #声线转换:支持将歌声转换为其他声线或乐器声线,探索更多音乐创意。
0
网易

网易云音乐·X Studio

Xstudio

网易云音乐·X Studio是网易云音乐与小冰公司联合推出的免费AI歌手音乐创作软件,支持Windows和macOS双平台。用户导入MIDI文件和歌词后,3秒内即可生成专业歌手水准的AI演唱干声,支持滑音、转音、颤音、咬字等多维度参数精细调节。平台提供约27位风格各异的AI歌手(涵盖流行、民谣、国风、电子、摇滚、戏曲等曲风),最高支持30轨AI合唱,面向音乐创作者和爱好者。

5
免费+付费
#支持Windows与macOS双平台,搭载了丰富的前沿性人工智能小冰黑科技,并经过双方深度合作定制调校。 #技术方面,包括小冰歌唱模型、一致性超级自然语音、流式渲染歌声合成和视觉神经网络渲染等技术。 #在演唱方面,可在3秒内生成专业歌手水准的AI演唱干声,还能通过参数实现AI歌手的滑音、转音、颤音、咬字、节奏、音色或强弱变化等,细腻演绎作品效果。
0
EL

ElevenLabs

Try

ElevenLabs 是AI文字转语音平台,为开发者、创作者和企业提供逼真的语音合成解决方案。核心产品包括文本转语音(支持包括中文在内的 29+ 语言、10,000+ 声音)、AI 配音、语音克隆、音乐生成等功能。平台以超低延迟、情感丰富的语音质量著称,广泛应用在有声书、视频配音、客服中心和内容本地化等场景。

5
免费+付费
#文本转语音:ElevenLabs 提供Eleven v3、Multilingual v2 和Flash v2.5三个主要模型,其中 Eleven v3 是情感最丰富的表达模型,Multilingual v2 提供最逼真的多语言一致语音,Flash v2.5 以 75 毫秒超低延迟满足实时对话需求。 #语音克隆:支持用户提供几分钟的音频样本能精确复制任意人声特征,让克隆声音跨越不同语言自然说话。 #语音转文本:Scribe v2 转录模型支持超过 90 种语言,具备 98% 的识别准确率,同时提供说话人分离功能和字符级精确时间戳定位。
0
ST

Stable Audio

Stableaudio

StableAudio 是Stability AI 提供的AI音乐创作平台。平台通过文本生成音乐(Text-to-Audio)和音频生成音频(Audio-to-Audio)的方式,用户只需输入文字描述或上传音频素材,能生成符合要求的音乐。平台支持生成长达3分钟的音频,格式为44.1kHz立体声。平台生成的音乐能用在商业项目。平台适合音乐创作者、制作人及对音乐创作感兴趣的普通用户。

5
免费+付费
#文本生成音乐(Text-to-Audio):支持用户输入详细的文本描述(如风格、乐器、情绪、BPM等)生成音乐。 #音频生成音频(Audio-to-Audio):支持用户上传音频文件,结合文本描述进行风格转换或生成变体。 #多种模型选择:提供不同版本的音频生成模型,用户根据需求选择合适的模型。
0
大饼

大饼AI变声

Dubbing

大饼AI变声(Dubbing.tech)是一款功能强大、免费专业的实时语音变声软件,是国内首款基于AI深度学习的声音引擎,并且支持全场景切入,兼容和支持多种游戏以及语音客户端。该AI变声软件的音色丰富多样,有数百种音色可供选择,并且每期提供免费的变声音色。除了实时变声,大饼声音引擎SaaS版还提供了文字转语音、声音克隆、声音定制、声音转换等功能,全方位地满足对多元声音的需求。

5
免费+付费
#上百种优质音色随心选择:大饼AI变声提供丰富多样的音色,无论是萝莉音还是青叔音,你都可以随时随地更换自己的声音皮肤 #支持海量的应用和游戏:支持快手、斗鱼、虎牙、Steam、Discord、CS GO、刀塔、绝地求生、微信、Zoom等热门的平台和游戏内变声 #个性化声音定制:提供音频样本素材与具体需求,大饼声音引擎在10个工作日内交付专属于你的个性化克隆声音
0
快转

快转字幕

Kzzimu

快转字幕是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#智能语音视频转字幕:上传音视频文件或复制URL,即可快速生成文字字幕 #支持多种语言和方言:可识别和转录超过99种语言、方言 #AI自动识别简介:智能识别音视频内容,自动生成摘要和亮点
0
AU

Audiobox

Audiobox

Audiobox是Meta推出的免费AI语音和声音生成模型,能结合语音输入和自然语言文本提示生成语音和音效。模型包含Audiobox Speech(专注语音生成)和Audiobox Sound(专注音效生成)等专业模型,底层基于共享的自监督模型Audiobox SSL。Audiobox具备语音风格转换等独特功能,是首个实现语音与文本双输入自由语音风格转换的模型。Audiobox能降低音频创作门槛,让任何人都能轻松创作出个性化的音频内容,能用在视频、播客、游戏等多种场景。

5
免费+付费
#克隆用户声音:录制声音按照用户的声音风格或以任意音频样本的风格生成语音。 #文本描述生成人声:使用文本描述声音风格的特征以及声学环境生成人声。 #更改声音风格:可结合声音和文本描述更改现有的声音风格。
0
SU

Suno

Suno

Suno是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。

5
免费+付费
#文本描述生成歌曲:输入简单的歌曲说明和提示词即可快速生成一首完整的歌曲,可自定义歌词 #多样化的音乐风格:支持流行、R&B、嘻哈、乡村、电子、迷幻等多种风格的音乐生成 #支持50种语言的歌曲:包括英文、中文、法语、日语、俄语、西班牙语等50多种语言进行输入和歌曲输出
0
RE

Reecho睿声

Reecho

Reecho睿声是一个超拟真瞬时AI语音克隆平台,利用先进的AI语音技术,允许用户通过上传或录制一段音频样本,来创建并克隆特定的声音角色。该平台的特点是能够快速地从较短的音频样本中克隆声音,而不需要长时间的训练过程。Reecho睿声基于中文领域领先的SOTA语音大模型技术,可一定程度上理解文本上下文,并以与真人几乎无异的表现力、情感、韵律和音色来基于文本生成人声音频,并且支持以5秒极短样本进行瞬时语音克隆。

5
免费+付费
#超拟真语音克隆:用户可以通过上传或录制一段音频样本,快速克隆特定的声音。这个过程中,AI会学习样本的声音特征,以便生成与原声音相似的新声音。 #角色管理:用户可以在平台上创建和管理多个声音角色。每个角色都可以有自己的声音样本和属性,方便用户根据不同的需求选择和使用。 #语音合成:Reecho睿声允许用户将克隆的声音角色分配给不同的文本,AI会使用这些角色的声音来朗读文本,生成语音输出。
0
DE

Deepgram

Deepgram

Deepgram是一个提供先进的AI语音识别和自然语言处理技术的平台,核心功能是强大的语音到文本(Speech-to-Text)和文本到语音(Text-to-Speech)API,让开发者能够快速将语音转录和理解功能集成到他们自己的应用程序和服务中。 Deepgram声称其服务在准确性、成本效益和速度方面都具有行业领先优势,它的GPU基础设施优化了语音和语言模型的性能,提供了高达40倍的转录速度和便宜3~5倍的成本。

5
免费+付费
#语音转文本API:Deepgram 的核心功能之一是将音频数据转换为文本,开发者可以将这一功能集成到他们的应用程序中,以实现自动转录、内容索引和数据挖掘。 #自然语言理解:Deepgram 不仅能够转录语音,还能理解转录文本的含义,提供了一系列自然语言处理功能,如语言检测、文本摘要、说话者识别、情感分析等,帮助开发者从音频数据中提取有价值的信息。 #多语言和方言支持:Deepgram 支持30多种语言和方言的转录,可以服务于全球各地的用户,并且能够理解和处理不同地区的语言差异。
0
蓝藻

蓝藻AI

Aigc

蓝藻AI是云知声公司开发的人工智能内容创作平台,专注于AI声音克隆、文字配音和文案创作服务。用户可以通过该平台训练克隆个性化的语音模型,生成与原音相似的合成音频,或选择多样的AI发音人进行文字配音,同时提供细致的声音调节选项。此外,蓝藻AI还能基于提示词或模板自动生成文案,并辅助用户进行文案编辑。

5
免费+付费
#AI声音克隆:用户可以通过在线工具自助录音并训练一个与自己声音高度相似的AI模型。这一功能分为快速克隆和高级克隆,其中快速克隆需要较少的录音样本,而高级克隆则需要更多的录音样本以获得更佳的发音效果。此外,还提供专业定制服务,以满足用户对更高品质声音克隆的需求。 #AI文字配音:用户可以选择不同的AI发音人来朗读文本,并对朗读的音量、语速和语调进行调节,以达到理想的配音效果。此外,还包括多人配音、数字符号的正确读法、多音字的正确发音选择、发音替换以及字间和段间停顿的调节等功能,以实现复杂的配音需求。 #海量发音人:蓝藻AI内置了海量丰富的发音人,包括不同性别、年龄段(如儿童、少年、青年、壮年、老年等)、适用领域(如影视解说、游戏动漫、纪录片、资讯报道、外语、童声、百科等)、语言(普通话、四川话、粤语、英语、日语、法语等数十种语言和方言)。
0
音虫

音虫

Soundbug

音虫SoundBug是一款由国内团队研发的数字音频工作站(DAW)软件,以其简洁直观的用户界面和易于上手的操作特点,为音乐爱好者和音乐学习者提供了一套完整的音乐制作工具。SoundBug支持Windows和Mac电脑端使用,内置了AI编曲、丰富的音色库和必要的音频编辑功能,致力于帮助更多的音乐爱好者体会音乐创作的乐趣。

5
免费+付费
#资源丰富,激发灵感:丰富的工程模版、经典的和弦进行和节奏乐段,激发你的创作灵感 #简单易用,轻松上手:最大限度的简化不必要的功能,降低软件学习门槛,非常适合学生及音乐爱好者 #AI智能编曲,快人一步:AI编曲极速生成,不会编曲也能快速完成作品,让你的创作原地起飞