首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· AI写作不如意?万字长文深度剖析背后原因
· Ollama还是vLLM?深度解析四大顶级LLM服务框架:性能、特性与技术选型指南
· 6.2K Star!MIT出品的多语言语音合成神器,CPU实时推理吊打商业软件!
· 个人从零预训练1B LLM心路历程
· 13.5K Star ! Fish Speech Windows本地搭建,能否达到官方的级别?强烈推荐
· ChatGPT论文润色进阶指令
· 国内外开源大语言模型一览表
· 还没有上手Stable Diffusion XL 1.0 的同学,看这篇文章就够了
· Midjourney AI绘画美女提示词分享二
· Stable Diffusion|提示词高阶用法(三)角色指定
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
开源
阿里巴巴
语
音
实验室发布开源
语
音
处理框架ClearerVoice-Studio,支持
语
音
增强、分离、目标说话人提取
它集成了先进的
语
音
增强(Speech Enhancement)、
语
音
分离(Speech Separation)和
音
视频扬声器提取(Audio-Video Speaker Extraction)功能,能够在嘈杂环境
中
清理
音
频
ClearerVoice-Studio
语音
开源
最新最全的开源
中
文
大
语
言模型列表
在多
语
言翻译、交互翻译、通用任务、标准化考试的测评
中
,百聆在
中
文
/英
语
中
均展现出更好的表现。
大模型
大模型
“实时”
语
音
翻译!AI
语
音
具有“情绪”!最强开源AI大模型来了
你想把一段
语
音
转成
文
字,或者把一段
文
字转成
语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
实时
语
音
克隆
项目简介 这份内容介绍了实时
语
音
克隆的技术实现,作者通过将说话者验证技术转移到多说话人
文
本到
语
音
合成(SV2TTS)来实现
语
音
克隆。
语音
克隆
开源
十大开源
语
音
识别项目
是一个开源、易用、多合一的
语
音
处理工具包,包含
语
音
识别、
语
音
翻译(英-
中
)、
文
本-
语
音
、标点恢复功能。
语音识别
开源项目
语
音
克隆又又又又又升级了
之前在前面的
文
章
中
有介绍,克隆你的声
音
,只需要你三秒的录
音
,声
音
克隆又进化了!
Meta
语音生成
OpenAI
OpenAI大动作:Whisper large-v3重塑
语
音
识别技术
这款最新的自动
语
音
识别模型不仅在多
语
言识别方面取得了显著进步,而且还将很快在OpenAI的API
中
得到支持。
Whisper
语音识别
科大讯飞
哈工大科大讯飞联合推出
中
文
LLaMA-2 & Alpaca-2大
语
言模型
本项目基于Meta发布的可商用大模型Llama-2开发,是
中
文
LLaMA&Alpaca大模型的第二期项目,开源了
中
文
LLaMA-2基座模型和Alpaca-2指令精调大模型。
训练
开源
开源
语
音
大
语
言模型来了!阿里基于Qwen-Chat提出Qwen-Audio!
作为一种重要模态,
语
音
提供了超越
文
本的多样且复杂的信号,如人声
中
的情感、
语
调和意图,自然声
音
中
的火车汽笛、钟声和雷声,以及
音
乐
中
的旋律。
大模型
语音
Insanely Fast Whisper:超快的Whisper
语
音
识别脚本
项目简介 这篇内容介绍了OpenAI的Whisper Large v2
语
音
转录模型的超快速能力。
音频
Whisper
解读wav2lip:探究
语
音
驱动唇部动作的技术原理!
本
文
将深入介绍一下wav2lip的技术原理和细节,了解它是如何实现
语
音
驱动唇部运动的!
wav2lip
语音
开源
【开源项目】Flow Matching
语
音
合成
shivammehta25.github.io/Matcha-TTS/ 在线推理: https://huggingface.co/spaces/shivammehta25/Matcha-TTS
中
文
实现
音视频
Flow
Matching
开源
从声纹模型到
语
音
合成:
音
频处理 AI 技术前沿 | 开源专题 No.45
此外,AudioCraft 还包括深度学习研究
中
使用到的 PyTorch 组件以及开发出来各个模型所需训练流程管道等内容,并提供 API
文
档、常见问题 FAQ 等信息。
AudioCraft
音频
大模型
中
文
版开源Llama 2同时有了
语
言、多模态大模型,完全可商用
s=20
语
言模型之外,继续开源两个
中
文
多模态大模型 在推出首个开源 Llama2
中
文
语
言大模型之后,LinkSoul.AI 团队将目光投向了目前全球尚外于发展初期的
语
音
文
本多模态大模型和图
文
大模型
开源模型
开源
开源免费离线
语
音
识别神器whisper如何安装
whisper介绍 Open AI在2022年9月21日开源了号称其英
文
语
音
辨识能力已达到人类水准的Whisper神经网络,且它亦支持其它98种
语
言的自动
语
音
辨识。
wisper
翻译
免费
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100