AI工具分类聚合库 [949 个收录]
全网最全的 AI 生产力工具雷达。包含大语言模型、图片生成、智能音频、视频渲染及自动化编程开发工具,一键直达官方及评测详情。
支持 GraphQL 与 Redis 缓存,可一键读取 949 个工具的参数:
Udio
UdioUdio是一款由前Google DeepMind研究人员创立的人工智能音乐生成器,旨在让任何人都能够轻松地创作出具有情感共鸣的音乐。该AI音乐生成工具能够根据用户输入的文本提示,包括音乐风格、主题、歌词等信息,快速生成包含人声的完整音轨。Udio不仅支持多种音乐风格和流派,还能够捕捉并表达音乐中的情感,创造出既逼真又具有创意的音乐作品。 Udio的设计理念是作为一个“超级乐器”,放大人类的创造力。适合音乐家和业余爱好者使用,提供了一个平台,让用户可以通过简单的文本输入,体验从零到创作出音乐的“魔法时刻”。Udio拥有与Suno类似的从文本提示创建完整曲目的能力,但具有更好的声音和更自然的声音。
Sonauto
SonautoSonauto是一款基于人工智能技术的免费在线音乐创作工具,能够根据用户提供的文本提示、歌词或旋律,转换成具有特定风格的完整歌曲。该AI音乐生成工具的核心优势在于其强大的编辑功能和用户友好的操作界面,使得音乐创作变得简单而可控,无需复杂的乐理知识和专业的音乐制作技能。 Sonauto由两人团队Ryan Tremblay和Hayden Housen成立于2023年,旨在通过其AI音乐编辑器,让任何人都能创作出任何风格的完整歌曲。目前,Sonauto是向用户免费开放的,无论是专业音乐人还是业余爱好者,都可以通过Sonauto实现快速创作,分享和探索音乐的无限可能。
天工SkyMusic
Tiangong天工SkyMusic是昆仑万维推出的国内首个音乐SOTA模型,采用自研的大模型音乐音频生成技术,能够实现端到端的音乐创作,包括乐器、人声、旋律等元素的一体化生成。该模型在音质、人声自然度等方面声称超越了国际竞争对手SunoV3,是全球领先的AI音乐生成模型。天工SkyMusic还支持参考音乐生成和方言歌曲创作,大幅降低了音乐创作门槛,让不具备专业乐理知识的用户也能轻松创作音乐,同时促进了方言文化的传播。目前,天工SkyMusic已开启免费公测,所有用户都可以免费使用。
OptimizerAI
OptimizeraiOptimizerAI是一款人工智能声音效果生成工具,能够根据文字提示自动创造出适合多种场景的声音和音效,如游戏中的射击声、动画中的雨声环境或地铁到站声等,专为视频创作者、游戏开发者、艺术家和视频制作人员设计。Optimizer AI支持音效改变功能和风格标签指定,能够生成具有一致性的背景音乐和特定氛围的声音效果。
Supertone Shift
ProductSupertone Shift是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
Wondercraft
WondercraftWondercraft是一款多功能的AI音频内容创作平台,通过生成式AI语音技术,允许用户将文本内容迅速转化为播客、有声书、广告等多种音频形式。该平台提供了一系列功能,包括AI脚本助手、超真实声音选择、音乐和音效混合,以及团队协作工具,使得音频内容的创作和管理变得极为便捷。用户可以自定义AI语音,甚至克隆自己的声音,实现个性化的音频输出。此外,Wondercraft AI还支持一键发布到主流播客平台,并提供多语言翻译服务,极大地扩展了音频内容的受众和影响力。
Voicenotes
VoicenotesVoicenotes是由Buy Me a Coffee的创始人推出的一款集成了人工智能技术的智能语音笔记工具,允许用户通过录音来记录想法和信息,并将这些录音自动转录成文本。用户可以利用AI搜索功能快速检索语音笔记中的关键词,实现高效管理。此外,Voicenotes还支持笔记编辑、AI内容创作以及多语言,适用于iOS、Android和Web平台。
听脑AI
Itingnao听脑AI是一款AI音频工具,致力于通过AI技术提升音频效率,为用户带来更优质的音频体验。
海绵音乐
Haimian字节跳动推出的免费AI音乐创作和发现平台
琅琅配音
Lang123琅琅配音是一款智能文本转语音工具,提供语音合成服务。支持中文、英语、德语、法语等30多种语言,以及高兴、悲伤、兴奋等10多种情感风格。平台功能丰富,操作简单,支持SSML标签,实现多音字、多人配音等高级功能。琅琅配音提供真正的免费版本,晓晓、晓辰、麦克阿瑟、云希、云扬等众多知名AI主播,助您轻松完成视频解说、小说推文或广告宣传,满足不同用户的配音需求。
TextToSpeech
TexttospeechTextToSpeech是完全免费的AI文字转语音工具,支持50多个国家的语言和8000多种音色。用户可以轻松输入文本,选择语言和语音风格,调整语速和音量,然后生成听起来自然的高质量语音。TextToSpeech无需登录,支持跨设备使用,包括PC端和手机端浏览器。生成的语音可以用于社交平台等任何地方,且目前完全免费,没有使用次数限制。
TTSMaker
TtsmakerTTSMaker是马克配音(MakVoice)推出的免费AI文字转语音工具,提供多语言和多种语音风格的AI配音服务。用户可以输入文本,选择语言和声音,然后一键转换成自然流畅的语音。平台支持50+语种和300+语音包,满足个性化配音需求。TTSMaker还提供高级设置,如调节语速和音调,以及变声和插入停顿功能。用户可以免费使用,拥有合成音频的100%版权,适用于视频配音、有声读物、教育培训等场景。TTSMaker还提供API服务和用户支持,确保使用便捷和隐私安全。
Fryderyk
FryderykFryderyk是一款AI音乐创作工具,是你的音乐创作智能伙伴。集成了多种乐器声音,包括原声吉他、尼龙弦吉他、电贝斯、钢琴和萨克斯等,为用户提供丰富的音乐元素选择。Fryderyk能够协助音乐人创作旋律、和声或节奏,简化音乐制作过程,激发创意灵感。无论是初学者还是专业音乐家,都能通过这个平台探索新的音乐可能性。
刺鸟配音
Icnpy刺鸟配音是刺鸟科技推出的专业AI配音工具,提供多种配音服务,深受千万用户喜爱。网站提供了热门配音作品,包括动漫、影视作品和萌宠视频等,内容丰富多样。用户可以通过这个平台获取高质量的配音服务,满足不同场景下的配音需求。
MemoAI
MemoMemoAI是免费的AI语音转文字工具,支持YouTube、播客及本地音视频文件转文本。MemoAI具备多语言转录、翻译、语音合成、说话人分离、实时字幕等功能。支持NVIDIA和AMD GPU加速,快速处理媒体文件。提供浮动笔记、剪辑分割、AI摘要和多种导出选项。MemoAI注重隐私,完全离线工作,跨平台支持Windows和macOS。
音疯
Yinfeng音疯是昆仑万维推出的AI音乐创作平台,基于人工智能技术简化音乐创作流程。用户只需输入歌词,即可一键生成原创歌曲,或通过提供参考音乐来创作风格相似的作品。平台支持多种音乐风格,提供创作灵感,并且支持创作者将作品上架销售,获得收益。音疯适合各类音乐创作者,包括初学者、独立音乐人、内容创作者等,旨在激发创意,推动音乐创作的发展。
讯飞听见
Iflyrec讯飞听见是科大讯飞推出的在线AI语音转文字工具,通过先进的人工智能技术,能够实时将语音转换成文字,准确率高达98%,支持多语种翻译,并提供会议记录、文档翻译、实时字幕等多种功能。用户可以利用它在会议、采访、学习等多场景下提高记录和翻译的效率,是提升工作效率和优化工作流程的得力助手。
NotebookLM
NotebooklmNotebookLM 是谷歌推出的 AI 笔记应用,基于大型语言模型(LLM)帮助用户管理和吸收信息。用户可以上传文档、链接和文本,NotebookLM 能理解内容并生成摘要、回答提问,提出创造性想法。AI播客功能能将上传的内容转换成一段对话播客,通过一男一女两位虚拟主播的对话,提供一种新的信息消费体验。NotebookLM 支持生成目录、时间线、学习指南和 FAQ 等,提高个人和专业人士的学习、研究和工作效率。NotebookLM 支持多种语言,在全球200多个国家和地区提供服务。
Lyrics Into Song AI
LyricsintosongLyrics Into Song AI 是一款在线AI音乐创作工具,够将文字歌词转换成完整的歌曲。通过分析歌词的情感和节奏,自动生成旋律、和声和编曲,支持多种音乐风格。用户可以自定义音乐元素,如风格、乐器和节奏,创作个性化歌曲。平台适用于社交媒体内容创作者、播客制作人、视频编辑、广告制作人和游戏开发者等,帮助快速制作出专业水准的背景音乐或主题曲。简单易用,没有音乐背景的用户也能轻松创作音乐。
音剪
Audioeditor音剪是喜马拉雅推出的一站式AI音频创作平台,提供多情感多模态的AI辅助工具,强大的在线剪辑能力,辅助用户轻松创作出优秀的音频作品。音剪集合了多项AI音频创作功能,包括AI音频剪辑、AI配乐、文章转语音、AI小说、音频转文字、AI分段、智能检测以及一键成片等。
天谱乐
天谱乐是趣丸科技唱鸭团队推出的全球首个多模态音乐生成大模型,支持文本、图片和视频等多种输入方式生成音乐。用户可以通过上传文本、图片或视频,生成最长3.5分钟的歌曲或音乐视频。能理解音乐的和弦、旋律、歌词、演唱风格等复杂特征,生成高契合度的视频配乐。天谱乐提供了专家模式,为专业人士提供更高的创作自由度,生成的人声效果接近真实人类的发音。
MiniMax Audio
MiniMax Audio是MiniMax推出的AI语音合成工具,能创建逼真的多语言、多声音和多情感的语音。支持文本转语音(TTS),能将文本快速转换为自然流畅的语音。用户只需提供30秒的音频素材,可将特定人的声音克隆,支持12种语言,包括中文、粤语、英语等。提供六种情绪的语音合成,如开心、生气、悲伤等。MiniMax Audio 具备降噪功能,可剔除背景噪音,提升语音质量。
Mureka
Mureka是昆仑万维推出的 AI 音乐商用创作平台,让专业艺术家和音乐爱好者能在平台上创作个性化音乐。用户在Mureka页面输入歌词,添加参考音乐,用Style功能控制音乐风格,创作出具有稳定性和可控性的AI音乐。平台不仅支持音乐风格和旋律控制,还支持用户自由调整歌曲的各个部分,如前奏、主歌、副歌等。完成创作后,能下载创作证明,申请在Mureka歌曲商店中展示和出售,获得收益。 Mureka搭载最新推出的Mureka V7.6和Mureka O2模型,带来更快、更稳定的音乐生成体验。新模型强化了语义到音乐的映射能力,支持更复杂风格生成,能通过优化声场建模,使音质更接近专业制作标准。升级后的模型更适合实时生成、移动端和高并发调用等商业化场景,推动AI音乐创作进入“专业品质×实时体验”的新阶段。
Noiz AI
Noiz AI 是AI 语音克隆与合成工具,专注于为用户提供高效、个性化的语音解决方案。基于自研的超大语音模型,能在3-10秒内通过简短录音克隆出与真人无异的声音模型,广泛应用于文本生成语音(TTS)、视频配音和多语言视频翻译等场景。
千音漫语
千音漫语是北京熠声科技推出的智能声音创作助手,为用户提供高效、便捷的声音创作解决方案。拥有1200+AI主播,支持全球多种语言,覆盖聊天对话、有声书、广告等多种场景。用户可以基于强大的智能配音功能,通过多音字、停顿、重读等近20个调音工具,打造自然流畅的配音效果。千音漫语提供音视频翻译配音服务,借助大模型技术实现一站式字幕翻译与多语种配音,助力创作者突破语言障碍。语音识别功能准确率高达95%,支持数十种语言,声音克隆功能仅需10秒声音样本即可复刻用户声音,音色逼真。平台配备音频处理“百宝箱”,包括音频提取、格式转换、静音识别等功能,满足用户多样化的声音创作需求。
Tunee
TuneeTunee 是天谱乐团队推出的首个对话式音乐创作Agent。以自然语言交互为核心,用户只需描述音乐需求,如风格、情绪、主题,可生成完整歌曲,包括作词、作曲、编曲及人声演唱。能理解用户模糊需求,生成主歌、副歌结构完整,情感丰富的歌曲,支持多种风格(流行、摇滚、国风等)。Tunee 支持上传图片、视频或音频获取灵感,生成贴合场景的音乐。用户可与Tunee对话调整风格、节奏、歌词等,直至满意。Tunee降低了音乐创作门槛,适合音乐爱好者、创作者及教学场景使用。
音秘
Audiomyst音秘是百度推出的AI播客创作工具,让用户轻松创作个性化播客内容。音秘以“让创作更聪明,让声音更动人”为理念,结合UGC和PGC模式,降低播客制作门槛,赋能创作者。用户无需专业设备或技术背景,能快速生成有温度的播客节目,满足从自媒体创作到企业传播等多场景需求,打造全场景音频内容生态。
音潮
Yinchaoyongxian音潮是全栈自研的AI音乐创作平台,用音乐传递美好瞬间。通过强大的AI技术,支持文本、图片、哼唱等多种输入方式,能快速将用户的灵感转化为高品质的音乐作品。音潮的创作过程极为高效,仅需15秒到1分钟即可生成一首完整的歌曲,适合从新手到专业音乐人的不同用户群体。自研的音乐大模型,采用先进的技术架构,具备强大的多模态表征能力和高保真重建能力。音潮自研了Diffusion Transformer(DiT)模型,能生成具有自然宽度和深度的立体声音频,为用户带来沉浸式的听觉体验。
多维视界
Dwsj多维视界是一站式AI音视频智能分析平台,将非结构化的音视频内容转化为结构化的知识资产。支持本地音视频文件上传和主流音视频网站(如B站、抖音、小红书等)的链接分析,支持高精度语音转录、多语言翻译、智能摘要、思维导图、知识图谱等核心功能,能快速提取音视频中的关键信息,生成结构化笔记、闪卡/测验、公众号图文、小红书笔记等多种形式的内容。
TurboScribe
TurboscribeTurboScribe是强大的AI音视频转文字工具,专为高效处理音频和视频文件设计。采用先进的Whisper技术,能以高达99.8%的准确率将语音内容快速转换为文本,支持超过98种语言,提供翻译功能。TurboScribe可以处理长达10小时、大小达5GB的文件,一次可上传多达50个文件,非常适合需要大量转录的用户。
Nafy AI
NafyNafy AI 是在线 AI 音乐生成器,主打广播级、免版税,支持从一句话到成品的端到端创作,也能对已有歌曲进行扩展、替换或翻唱。输入描述或歌词可生成带人声、伴奏的成品,自动母带处理,可直接商用。可续写桥段、延长尾奏、插入间奏,新段落与原曲情绪、节奏保持一致。上传音频后可单独替换某段歌词或乐器,其余部分原样保留,适合迭代优化。10 秒干声即可训练个人 RVC 声线,秒级换声翻唱,支持无限次复用。
Vemus未音
YVemus未音是腾讯音乐旗下首款一站式AI音乐创作工具,零门槛多模态音乐创作,人人都能玩音乐。把“写歌”压缩成三步:输入一句话、一张图或一段哼唱,AI在几秒内自动完成作词、作曲、编曲、演唱,支持流行、国风、电子等任意风格秒切换。画布式交互让小白也能像聊天一样反复修改歌词、曲风、唱腔,直到满意后一键导出MP3,或直接发行到QQ音乐、酷狗、全民K歌获取流量。零门槛、全链路、可商用,Vemus未音让“人人都能玩音乐”从口号变成两次点击的现实。
讯飞译制
Yizhi讯飞译制是科大讯飞推出的AI音视频本地化平台,专注于视频字幕制作、多语种翻译与智能配音服务。基于科大讯飞在语音识别、机器翻译和语音合成领域的核心技术,可将传统”周级”的译制周期压缩至”小时级”,语音转写准确率达97.5%,1小时音视频最快5-10分钟即可生成字幕。支持中文与英、日、韩、德、法等17种语言互译,提供AI声纹克隆、多情绪配音、口型同步等高级功能。用户可通过”机器字幕”快速出稿,或选择”人工字幕”获得专业译制团队服务,输出支持SRT、ASS、XML等多种格式,无缝对接Premiere、Final Cut Pro等剪辑软件。
音述AI
Yinshu音述AI是全球首个AI音乐社区,致力让每个人都能用音乐表达自我。音述AI提供零门槛AI创作工具,独创GETI法则帮助用户精准定义音乐风格,AI润色功能支持自动优化作品质感。音述AI支持交流讨论、二次创作与价值变现。针对中文用户的语言习惯与文化背景进行专门优化,支持国风融合、C-pop等本土音乐标签,让技术更好地承载人文表达。
轻析 LiteSight
Qx轻析 LiteSight 是 AI 视频内容提取工具,支持抖音、B站、快手、小红书等主流短视频平台链接解析。用户只需粘贴视频链接,AI 可自动完成转录、提炼、结构化,输出纯净文案、结构化大纲和思维导图,全程无需人工干预。产品采用积分制计费,每 15 分钟视频消耗 1 积分,注册即送 3 积分体验,积分永久有效。适用于内容创作者、新媒体运营、教育培训及知识工作者,帮助用户快速将视频内容沉淀为可复用的知识资产,提升内容创作与信息处理效率。
逗哥配音
Douge逗哥配音是广州有码科技推出的一站式AI配音工具,被誉为”抖音爆款配音始发地”。逗哥配音支持智能配音、声音克隆、文案提取、字幕生成、人声分离、视频去水印等,覆盖从文案到成片的完整创作流程。逗哥配音支持微信小程序及Windows/macOS/移动端全平台,与头部创作者合作提供独家授权声音,让短视频制作更高效专业。
All Voice Lab
TopAI音频API,提供文本转语音、语音克隆和声音转换功能。
Tunesona AI Music Agent
TopTunesona是AI音乐代理,可通过自然对话创作和编辑个性化音乐。
MelodyCraft AI
Top21种AI音乐工具集于一体,免费开启,由Suno V5驱动,创作各类音乐。
MusicWave
Top免费AI音乐生成器,根据文本提示创作歌曲,可选风格、下载分享。
Lacuna
TopLacuna是AI音乐生成器,可从文本生成带 vocals 的完整歌曲,免费试用。
Lalals
Top集AI音乐创作、语音转换等多功能于一体的音频工具平台
Somio AI
Top在线AI音乐生成器,几秒将文本或歌词转为全长曲目,免费创作
Photo to music AI matches mood perfectly online
TopBeatBun 是文本到歌曲的 AI 音乐生成器,可将文字转免版税曲目。
Melody Genie
TopMelody Genie是排名第一的AI歌词生成器,有7种专业工具,支持多语言与多位艺术家风格。
讯飞A.I.智能客服解决方案
Top基于科大讯飞语音技术,实现智能客服的多渠道解决方案。
DilGPT
Top掌握任何语言
AI Lego Generator
Top免费的AI乐高生成器,可创建自定义乐高套装、图像和定制包装盒。