首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 中文开源OCR框架对比及介绍
· TrOCR——基于transformer模型的OCR手写文字识别
· AI换脸工具:facefusion使用心得
· Coze多智能体(Multi-Agents)模式体验!
· 十大开源语音识别项目
· 绝对是你的下载神器!AixDownloader可让你从任何网页下载你想要的内容,音乐、视频、图像、文件等!
· 强大高效的微信爬虫Wechat_Articles_Spider:快速获取公众号文章的利器
· 大模型中的Top-k、Top-p、Temperature详细含义及解释
· 交友神器!AI二维码终极教程,3步做出你的专属艺术二维码!
· AI绘画:stable difussion SD插件之 无限抽卡神器 dynamic prompts(动态提示词)
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
语
音
识别的新拐点:OLMoASR 带来的机会
语
音
识别正在悄悄重塑我们的生活: 内容创作:播客自动生成文字稿;视频自动生成多语言字幕;
AI
主播无缝上岗。
OLMoASR
语音识别
教程
用so-vits-svc-4.1进行
音
色转换的极简教程
这个项目最初是用来进行歌声转换的,github项目地址: https://github.com/svc-develop-team/so-vits-svc/tree/4.1-Stable 关注
AI
声音
sovits
Insanely Fast Whisper:超快的Whisper语
音
识别脚本
项目简介 这篇内容介绍了OpenAI的Whisper Large v2语
音
转录模型的超快速能力。
音频
Whisper
开源
GPT-4o实时语
音
方案提供商Livekit开源voice agent:轻松处理
音
视频流
轻松访问 LiveKit WebRTC 会话并处理或生成
音
频、视频和数据流。
voice
agent
开源
音视频
「语
音
转换新速度」— 探秘Whisper JAX的70倍速提升
在
AI
的众多分支中,语
音
识别技术的突破性进展尤为引人瞩目。
Whisper
语音识别
教程
用so-vits-svc-4.1进行
音
色转换的极简教程!
这个项目最初是用来进行歌声转换的,github项目地址: https://github.com/svc-develop-team/so-vits-svc/tree/4.1-Stable 关注
AI
so-vits-svc
音色转换
教程
OpenAI
基于 OpenAI Whisper 模型的实时语
音
转文字工具
· WhisperLive 是一款专注于
音
频处理和创作的开源软件,使用 OpenAI Whisper 模型将语
音
输入转换为文本输出,可以用于转录麦克风的实时
音
频输入和预先录制的
音
频文件,为艺术家和
音
乐
制作人提供了一个强大的平台
WhisperLive
音频
开源软件
RAG
RAG 2.0来了,它能成为生产落地的福
音
吗?
应引起
AI
应用开发者警惕。
RAG
大模型
开源
【开源项目】Flow Matching 语
音
合成
CFM是一种新技术,已被证明可以改进扩散模型,Meta的Voicebox模型将CFM引入语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
开源
开源免费离线语
音
识别神器whisper如何安装
whisper介绍 Open
AI
在2022年9月21日开源了号称其英文语
音
辨识能力已达到人类水准的Whisper神经网络,且它亦支持其它98种语言的自动语
音
辨识。
wisper
翻译
免费
国内厂商语
音
识别与Whisper评测:现状与概况对比
语
音
识别技术不仅可以应用于智能助手、语
音
控制、自动化客服等领域,还有望为残障人士提供更便捷的沟通工具。
语音识别
Faster-Whisper
GTC大会黄仁勋发言稿
希望你们意识到这里不是
音
乐
会,而是一个开发者大会。
黄仁勋
nvidia
开源
有道开源的国产语
音
库EmotiVoice爆火了!具有情绪控制功能的语
音
合成引擎!
但是近期,网易有道
AI
算法团队也开源了一款国产TTS语
音
合成引擎EmotiVoice,刚上线仅一周时间就暴涨4200颗星,问鼎当周GitHub trending流行榜第一。
EmotiVoice
语音库
开源
有感情的语
音
合成开源模型:ChatTTS安装使用详解
ChatTTS是一个为对话场景设计的语
音
生成模型,专门用于大型语言模型(LLM)助手的对话任务、对话语
音
和视频介绍等应用。
ChatTTS
语音合成
Stable Diffusion
小白设计师福
音
:Stable Diffusion 16款插件测评,好用不?推荐吗?
#11088;️ 易上手程度:⭐️ 使用频率:⭐️ 能做什么:Additional Networks 是一个由 Google
AI
SD
插件
文生图
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100