首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 不会PS也能做神图?豆包AI绘画全解析,让你的创意秒变艺术品!
· GitHub星数暴涨,AIPC的开源实现,用AI记录电脑一整天的使用太简单了,功能非常多!
· 了解Kimi必看的26个问题 | Kimi系列文(二)
· 数字人起飞!字节Loopy对口型功能在即梦上线 可根据语境匹配表情和情绪
· 两个案例教你如何用BRTR原则优化Prompt
· 万字长篇!超全Stable Diffusion AI绘画参数及原理详解
· ComfyUI-DDetailer脸部修复
· 我用AI写小说:「素材篇」4种大神写爽文技巧+找素材新思路+三翻四震举例说明
· 文心一言大模型使用指南
· ChatGPT提示词万能模板:BRTR原则,让ChatGPT完美理解你的需求
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
万
字
长
文
-大
语
言模型指令调优综述
在这种方法中,通过使用模板将
文
本标签对
转
换为(指令、输出)对。
大语言模型
大模型
“实时”
语
音
翻译!AI
语
音
具有“情绪”!最强开源AI大模型来了
你想把一段
语
音
转
成
文
字
,或者把一段
文
字
转
成
语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
工具
TTS它又来了!OpenVoice:一款借鉴于TTS实现的强大的AI
语
音
克隆工具!
无论您是想要模仿某位名人的声
音
,还是需要在不同
语
言之间进行
语
音
转
换,OpenVoice都能够满足您的需求。
tts
文本转语音
教程
用so-vits-svc-4.1进行
音
色
转
换的极简教程!
其实歌声
转
换不仅仅适用于歌声,普通讲话也可以,只是歌唱的
音
调基本能覆盖到低、中、高全域声
音
类型,而正常说话可能无法做到全域覆盖,但是如果在录制声
音
的时候能够做到覆盖多种
音
调类型,也可以实现声
音
转
换。
so-vits-svc
音色转换
教程
开源
6个最佳开源TTS引擎
TTS引擎用于实现
文
本到
语
音
的
转
换。
TTS引擎
开源模型
开源
阿里巴巴
语
音
实验室发布开源
语
音
处理框架ClearerVoice-Studio,支持
语
音
增强、分离、目标说话人提取
它集成了先进的
语
音
增强(Speech Enhancement)、
语
音
分离(Speech Separation)和
音
视频扬声器提取(Audio-Video Speaker Extraction)功能,能够在嘈杂环境中清理
音
频
ClearerVoice-Studio
语音
心理
万
字
长
文
,大
语
言模型如何宣告心理学的死亡?
但随着人工智能技术的飞速发展,特别是大
语
言模型(LLM)的兴起,我们似乎站在了一个新的十
字
路口。
大语音模型
实时
语
音
克隆
项目简介 这份内容介绍了实时
语
音
克隆的技术实现,作者通过将说话者验证技术
转
移到多说话人
文
本到
语
音
合成(SV2TTS)来实现
语
音
克隆。
语音
克隆
开源
十大开源
语
音
识别项目
Automatic Speech Recognition(ASR)是一项自动
语
音
识别技术,其目标是通过计算机自动将人类口头
语
音
转
录为
文
本。
语音识别
开源项目
语
音
克隆又又又又又升级了
之前在前面的
文
章中有介绍,克隆你的声
音
,只需要你三秒的录
音
,声
音
克隆又进化了!
Meta
语音生成
数
字
人:从科幻走向现实的技术革命
创建数
字
人需要多方面的技术支持,包括计算机图形学、动作捕捉、
语
音
合成以及人工智能算法等。
数字人
语音
Prompt
硬核Prompt赏析:HuggingGPT告诉你Prompt可以有多“工程”
,它让ChatGPT这样的LLM能够使用HuggingFace社区的各种模型(包括但不仅限于
文
生图、图生
文
、
语
音
转
文
字
、
文
字
合成
语
音
等),从而让LLM能驱动其他智能Agent,实现多模态能力。
提示词
prompt
将任意
文
本
转
换为知识图谱
项目简介 知识图谱,也称为
语
义网络,表示现实世界实体的网络,即物体、事件、情况或概念——并说明它们之间的关系。
知识图谱
转换
文本
教程
用so-vits-svc-4.1进行
音
色
转
换的极简教程
其实歌声
转
换不仅仅适用于歌声,普通讲话也可以,只是歌唱的
音
调基本能覆盖到低、中、高全域声
音
类型,而正常说话可能无法做到全域覆盖,但是如果在录制声
音
的时候能够做到覆盖多种
音
调类型,也可以实现声
音
转
换。
声音
sovits
OpenAI
OpenAI大动作:Whisper large-v3重塑
语
音
识别技术
这款最新的自动
语
音
识别模型不仅在多
语
言识别方面取得了显著进步,而且还将很快在OpenAI的API中得到支持。
Whisper
语音识别
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100