首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 最新最强开源模型Qwen3本地运行指南!Windows+ollama+chatwise轻松搞定
· 【CLIP系列Paper解读】CLIP: Learning Transferable Visual Models From Natural Language Supervision
· Stable Diffusion快速生图,LCM-Lora、sd_xl turbo寄养和亲生谁好?!
· 零一万物API开放平台出场!通用Chat多模态通通开放,还有200K超长上下文版本
· 拒绝996,想出海赚美元?这7个GPT方案绝对靠谱!
· 大模型微调数据选择和构造技巧
· 深度|红杉重磅发布:2024 AI 50 榜单 (全网最全)
· 阿里通义实验室薄列峰:从兵马俑跳“科目三”到照片唱歌,四大框架让AI生成的人物活起来丨GenAICon 2024
· Prompt屠龙术-大厂prompt工程指南解析提炼
· 还没有上手Stable Diffusion XL 1.0 的同学,看这篇文章就够了
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
AI绘画:InstantID Win11本地安装记录!
Windows11+Conda+git 1.
克
隆
代码 打开CMD工具,通过CD命令进入到指定目录,然后
克
隆
代码。
InstantID
Win11
安装
开源
字节开源项目MimicTalk:快速打造逼真3D Talking Face的利器
动态表现力:通过上下文风格化的
音
频到运动模型(ICS-A2M),MimicTalk能够「捕捉和模仿目标人物的动态说话风格」,使生成的视频更加生动和富有表现力。
MimicTalk
开源模型
工具
惊艳推荐!8款好用又免费的文本转语
音
TTS工具
在早期,TTS技术主要依赖于预录制的
声
音
样本,通过组合这些样本来生成语
音
。
TTS
Maker
语音
OpenAI
两天star量破千:OpenAI的Whisper被蒸馏后,语
音
识别数倍加速
懂技术的小伙伴也可以寻找其他替代方案,比如语
音
转文字模型 Whisper、文字翻译 GPT、
声
音
克
隆
+ 生成
音
频 so-vits-svc、生成符合
音
频的嘴型视频 GeneFace++dengdeng。
语音
HeyGen
开源
阿里巴巴语
音
实验室发布开源语
音
处理框架ClearerVoice-Studio,支持语
音
增强、分离、目标说话人提取
、分离复杂
声
源并结合
音
频和视觉数据锁定目标发
声
者。
ClearerVoice-Studio
语音
数字人
数字人直播哪家强?百度、硅基、风平与闪剪四大AI数字人横向评测!
另外的一个要点是
声
音
,选用一款适合的AI
声
音
或用真人语
音
驱动,才能让嘴型准确度达到更好的水平。
数字人
数字分身
视频
用AI做郭德纲说英文相
声
的爆款视频(详细教程)
郭德纲用英文说相
声
的短视频火爆全网,单条视频点赞破9.7万,转发量更是高达11.8万,AI的内容形式层出不穷,不断地出爆款,其实这个两周前有出过教程--用这个AI,把视频翻译成30+种语言,丝滑程度,随时能把生意做到全世界
视频
翻译
语言
大模型
“实时”语
音
翻译!AI语
音
具有“情绪”!最强开源AI大模型来了
你想把一段语
音
转成文字,或者把一段文字转成语
音
,但是你不知道怎么操作!
大模型
开源模型
语音
阿里
《嬛嬛朕emo啦》但马斯
克
!阿里这项技术开放试玩
等了7分多钟,刚从北京闪现闪离的马斯
克
,他终于夸我是个人才: ,时长00:03 好了,别骂诈骗,我全都招!
音频
阿里
换脸
除了深度换脸、模拟配
音
,还能口型匹配的AI软件出现了
它的竞争对手包括语
音
克
隆
翻译应用 HeyGen 和Verbalate,以及Spotify和视觉特效工作室Monsters Aliens Robots Zombies等公司推出的新工具
AI
开源
语
音
、视频转文字神器:开源whisper介绍
OpenAI的Whisper是一种基于深度学习的语
音
识别模型,它是一种通用的语
音
识别模型,可以用于语
音
识别、语
音
翻译和语言识别等任务。
人工智能
大模型
wisper
OpenAI
OpenAI大动作:Whisper large-v3重塑语
音
识别技术
这款最新的自动语
音
识别模型不仅在多语言识别方面取得了显著进步,而且还将很快在OpenAI的API中得到支持。
Whisper
语音识别
教程
Suno
音
乐新手指南(手把手完整版教程)
在标记歌曲部分时,尝试一个简短的风格描述和一个名词——应该被听到的乐器或
声
音
。
suno
歌曲
教程
开源
十大开源语
音
识别项目
这项技术在多个领域有着广泛的应用,包括但不限于语
音
助手、语
音
搜索、自动转写以及语
音
命令识别。
语音识别
开源项目
ComfyUI
ComfyUI初学者指南
ComfyUI 管理器 要安装此自定义节点,请转到PowerShell (Windows) 或终端(Mac) 应用程序中的自定义节点文件夹: cd ComfyUI/custom_nodes 并将节点
克
隆
到本地存储
文生图
comfyui
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100