首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· Github上Star数最多的大模型应用基础服务:Dify 深度解读
· 了解Kimi必看的26个问题 | Kimi系列文(二)
· 为什么说腾讯22年前的这份神级PPT是立项汇报的天花板?
· AI提示设计技巧剖析 - 29个动词助你获取更好文本生成
· 国内厂商语音识别与Whisper评测:现状与概况对比
· 好看的图片不知道怎么写提示词?用AI读出来
· ComfyUI官方使用手册【官网直译+关键补充】
· 如何从零开始训练专属 LoRA 模型?4600字总结送给你!
· 向量数据库简介和5个常用的开源项目介绍
· SD入门教程二:文生图基础用法(提示词)
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
关于AI声
音
生
成的一切(
语
音
+
音
乐+嘴型)
其实声
音
生
成也有很多革命性的工具,例如高质量的声
音
识别、
文
字转成人声、人声克隆、
音
乐
生
成,已经能组成完整工作流了,其中一些工具甚至已经打包好了,只要下载解压就能用!
声音
视频
栩栩如
生
,
音
色克隆,Bert-vits2
文
字转
语
音
打造鬼畜视频实践
BERT的核心思想是通过在大规模
文
本
语
料上进行无监督预训练,学习到通用的
语
言表示,然后将这些表示用于下游任务的微调。
Bert-vits
语音
工具
AI
文
本转
语
音
工具(TTS):MeloTTS
今天给大家介绍一个效果不错的开源
文
本转
语
音
工具:MeloTTS MeloTTS是一个可以把
文
字转换成声
音
的工具,它支持英
语
、西班牙
语
、法
语
、中
文
、日
语
和韩
语
等多种
语
言。
MeloTTS
语音工具
OpenAI
【
语
音
识别】OpenAI
语
音
力作Whisper
这么多的标注数据使得我们可以直接在 有监督
语
音
识别任务上预训练Whisper,从标注
音
频转录数据中直接习得
语
音
到
文
本的映射。
语音转文字
whisper
开源
语
音
、视频转
文
字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的
语
音
识别模型,它是一种通用的
语
音
识别模型,可以用于
语
音
识别、
语
音
翻译和
语
言识别等任务。
人工智能
大模型
wisper
【进阶】-
文
生
图术
语
解释
黑话# 缩写/术
语
解释 oneshot 一张图
文生图
视频
Wunjo AI: 合成和克隆英
语
/俄
语
/中
文
语
音
,实时
语
音
识别,深度换脸和唇动合成,通过
文
本提示更改视频,分割和修饰
主要特征
语
音
合成:轻松将
文
本转换为类似人类的
语
音
。
AI语音克隆
实时语音识别
Python
Whisper对于中
文
语
音
识别与转写中
文
文
本优化的实践(Python3.10)
阿里的FunAsr对Whisper中
文
领域的转写能力造成了一定的挑战,但实际上,Whisper的使用者完全可以针对中
文
的
语
音
做一些优化的措施,换句话说,Whisper的“默认”形态可能在中
文
领域斗不过
Whisper
语音优化
OpenAI
基于 OpenAI Whisper 模型的实时
语
音
转
文
字工具
· WhisperLive 是一款专注于
音
频处理和创作的开源软件,使用 OpenAI Whisper 模型将
语
音
输入转换为
文
本输出,可以用于转录麦克风的实时
音
频输入和预先录制的
音
频
文
件,为艺术家和
音
乐制作人提供了一个强大的平台
WhisperLive
音频
开源软件
开源
网易(TTS)EmotiVoice:开源
语
音
合成,支持2000多
音
色
你是否曾经想过,如果你能用自己喜欢的声
音
来朗读任何
文
本,那该多好?
EmotiVoice
语音合成
字正腔圆,万国同
音
,coqui-ai TTS跨
语
种
语
音
克隆,钢铁侠讲16国
语
言
本次我们基于coqui-ai TTS的2.0版本来让钢铁侠托尼斯塔克先
生
开口讲16国
语
言。
coqui-ai
TTS
语音
AI+
音
乐|对话 Suno CEO:破圈的
音
乐
生
成产品是如何诞
生
的?
用户可以通过简单的
文
本提示进行创作,
生
成多种
音
乐风格的高质量
音
乐和
语
音
。。
suno
音乐
工具
惊艳推荐!8款好用又免费的
文
本转
语
音
TTS工具
在早期,TTS技术主要依赖于预录制的声
音
样本,通过组合这些样本来
生
成
语
音
。
TTS
Maker
语音
开源
阿里巴巴
语
音
实验室发布开源
语
音
处理框架ClearerVoice-Studio,支持
语
音
增强、分离、目标说话人提取
.01 概述 在日常
生
活和工作中,你是否常因嘈杂的环境、重叠的对话或
音
视频信号的混杂而感到沟通困难?
ClearerVoice-Studio
语音
大模型
“实时”
语
音
翻译!AI
语
音
具有“情绪”!最强开源AI大模型来了
你想把一段
语
音
转成
文
字,或者把一段
文
字转成
语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100