首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· OCR的终极解法——传统算法VS多模态大模型
· Suno音乐新手指南(手把手完整版教程)
· 保姆级教程:Coze 打工你躺平
· 绝对是你的下载神器!AixDownloader可让你从任何网页下载你想要的内容,音乐、视频、图像、文件等!
· 字节跳动最强AI工具 “豆包” ,近1000款应用!一句话自动生成图文,堪比ChatGPT?
· 剪映专业版智能补帧
· 7.1k Star!RAGFlow:最新开源OCR+深度文档理解的RAG引擎、大海捞针测试、降低幻觉、服务化API集成进业务!
· 了解Kimi必看的26个问题 | Kimi系列文(二)
· WeChaty:强大的微信个人号机器人SDK
· 聊天大模型的输出速度应该是多少?单张显卡最多可以支持多少个人同时聊天?来自贾扬清最新的讨论~
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
关于AI声
音
生
成的一切(
语
音
+
音
乐+嘴型)
其实声
音
生
成也有很多革命性的工具,例如高质量的声
音
识别、
文
字转成人声、人声克隆、
音
乐
生
成,已经能组成完整工作流了,其中一些工具甚至已经打包好了,只要下载解压就能用!
声音
视频
栩栩如
生
,
音
色克隆,Bert-vits2
文
字转
语
音
打造鬼畜视频实践
BERT的核心思想是通过在大规模
文
本
语
料上进行无监督预训练,学习到通用的
语
言表示,然后将这些表示用于下游任务的微调。
Bert-vits
语音
工具
AI
文
本转
语
音
工具(TTS):MeloTTS
今天给大家介绍一个效果不错的开源
文
本转
语
音
工具:MeloTTS MeloTTS是一个可以把
文
字转换成声
音
的工具,它支持英
语
、西班牙
语
、法
语
、中
文
、日
语
和韩
语
等多种
语
言。
MeloTTS
语音工具
OpenAI
【
语
音
识别】OpenAI
语
音
力作Whisper
这么多的标注数据使得我们可以直接在 有监督
语
音
识别任务上预训练Whisper,从标注
音
频转录数据中直接习得
语
音
到
文
本的映射。
语音转文字
whisper
开源
语
音
、视频转
文
字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的
语
音
识别模型,它是一种通用的
语
音
识别模型,可以用于
语
音
识别、
语
音
翻译和
语
言识别等任务。
人工智能
大模型
wisper
【进阶】-
文
生
图术
语
解释
黑话# 缩写/术
语
解释 oneshot 一张图
文生图
视频
Wunjo AI: 合成和克隆英
语
/俄
语
/中
文
语
音
,实时
语
音
识别,深度换脸和唇动合成,通过
文
本提示更改视频,分割和修饰
主要特征
语
音
合成:轻松将
文
本转换为类似人类的
语
音
。
AI语音克隆
实时语音识别
Python
Whisper对于中
文
语
音
识别与转写中
文
文
本优化的实践(Python3.10)
阿里的FunAsr对Whisper中
文
领域的转写能力造成了一定的挑战,但实际上,Whisper的使用者完全可以针对中
文
的
语
音
做一些优化的措施,换句话说,Whisper的“默认”形态可能在中
文
领域斗不过
Whisper
语音优化
OpenAI
基于 OpenAI Whisper 模型的实时
语
音
转
文
字工具
· WhisperLive 是一款专注于
音
频处理和创作的开源软件,使用 OpenAI Whisper 模型将
语
音
输入转换为
文
本输出,可以用于转录麦克风的实时
音
频输入和预先录制的
音
频
文
件,为艺术家和
音
乐制作人提供了一个强大的平台
WhisperLive
音频
开源软件
开源
网易(TTS)EmotiVoice:开源
语
音
合成,支持2000多
音
色
你是否曾经想过,如果你能用自己喜欢的声
音
来朗读任何
文
本,那该多好?
EmotiVoice
语音合成
字正腔圆,万国同
音
,coqui-ai TTS跨
语
种
语
音
克隆,钢铁侠讲16国
语
言
本次我们基于coqui-ai TTS的2.0版本来让钢铁侠托尼斯塔克先
生
开口讲16国
语
言。
coqui-ai
TTS
语音
AI+
音
乐|对话 Suno CEO:破圈的
音
乐
生
成产品是如何诞
生
的?
用户可以通过简单的
文
本提示进行创作,
生
成多种
音
乐风格的高质量
音
乐和
语
音
。。
suno
音乐
工具
惊艳推荐!8款好用又免费的
文
本转
语
音
TTS工具
在早期,TTS技术主要依赖于预录制的声
音
样本,通过组合这些样本来
生
成
语
音
。
TTS
Maker
语音
开源
阿里巴巴
语
音
实验室发布开源
语
音
处理框架ClearerVoice-Studio,支持
语
音
增强、分离、目标说话人提取
.01 概述 在日常
生
活和工作中,你是否常因嘈杂的环境、重叠的对话或
音
视频信号的混杂而感到沟通困难?
ClearerVoice-Studio
语音
大模型
“实时”
语
音
翻译!AI
语
音
具有“情绪”!最强开源AI大模型来了
你想把一段
语
音
转成
文
字,或者把一段
文
字转成
语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100