首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 不会PS也能做神图?豆包AI绘画全解析,让你的创意秒变艺术品!
· GitHub星数暴涨,AIPC的开源实现,用AI记录电脑一整天的使用太简单了,功能非常多!
· 了解Kimi必看的26个问题 | Kimi系列文(二)
· 数字人起飞!字节Loopy对口型功能在即梦上线 可根据语境匹配表情和情绪
· 两个案例教你如何用BRTR原则优化Prompt
· 万字长篇!超全Stable Diffusion AI绘画参数及原理详解
· ComfyUI-DDetailer脸部修复
· 我用AI写小说:「素材篇」4种大神写爽文技巧+找素材新思路+三翻四震举例说明
· 文心一言大模型使用指南
· ChatGPT提示词万能模板:BRTR原则,让ChatGPT完美理解你的需求
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
DeepMusic发布“和弦派”2.0:重塑AI
音
乐创作范式,赋予创作者全方位掌控
4月29日,国内领先的人
工
智能
音
乐服务商DeepMusic,发布了自主研发的AI
音
乐
工
作站——“和弦派”2.0正式版。
和弦派
DeepMusic
音乐创作
开源
46.6k星星!最强开源AI集合系统,一键部署全网AI
工
具
都能直接用,UI简直是视觉盛宴!
它开源的
工
具
,UI一样很酷,当然,功能也真的很强,46.6k的星星绝不是虚名。
AI开源
集合
大模型
视
频
大模型训练相关词条解释
Sora是OpenAI公司发布的一款AI视
频
生成模型。
视频生成
sora
词条
教程
郭德纲讲英语相声详细教程
郭德纲用英文说相声的短视
频
火爆全网,同类型的AI短视
频
层出不穷,更有好莱坞明星说中文的短视
频
,不断地出爆款,那么现在我们就开始学习如何制作一个同类型的AI短视
频
吧!
数字人
音视频
开源
F5-TTS:上海交大开源超逼真声
音
克隆TTS,告别ElevenLabs,以后就用它了!实测真的很牛
音
频
克隆的开源项目很多,但是每次项目里要用的时候,总还是惦记着11labs的api。
F5-TTS
音频克隆
鹅厂最新AI
工
具
刷屏!杨幂寡姐多风格写真秒秒钟生成,LeCun点赞 | 可免费体验
前脚字节阿里的
工
具
火了,现在腾讯这个新照片生成应用PhotoMaker直接刷屏,瞧这阵仗…… 只需上传一张或以上照片,无需额外LoRA训练,就能快速可定制。
PhotoMaker
图生图
开源
【开源项目】Flow Matching 语
音
合成
CFM是一种新技术,已被证明可以改进扩散模型,Meta的Voicebox模型将CFM引入语
音
合成领域,下面是voicebox的一个
工
作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
Flowith:革新你的
工
作方式,体验节点式 AI 的超流畅生产力
无论是内容创作者、研究人员、还是企业高管,我们都需要一个能够高效整合信息、提升
工
作效率的
工
具
。
Flowith
GPT
生产力工具
ChatGPT
一个完整Prompt让ChatGPT自动生成短视
频
制作脚本
———————— 把你想象成热门短视
频
脚本撰写的专家。
ChatGPT
Prompt
视频
开源
有感情的语
音
合成开源模型:ChatTTS安装使用详解
ChatTTS是一个为对话场景设计的语
音
生成模型,专门用于大型语言模型(LLM)助手的对话任务、对话语
音
和视
频
介绍等应用。
ChatTTS
语音合成
字正腔圆,万国同
音
,coqui-ai TTS跨语种语
音
克隆,钢铁侠讲16国语言
按照固有的思维方式,如果想要语
音
克隆首先得有克隆对象
具
体的语言语
音
样本,换句话说,克隆对象必须说过某一种语言的话才行,但现在,coqui-ai TTS V2.0版本做到了,真正的跨语种无需训练的语
音
克隆技术
coqui-ai
TTS
语音
国内厂商语
音
识别与Whisper评测:现状与概况对比
随着人
工
智能技术的飞速发展,语
音
识别已经成为了现代社会中一个重要的研究领域。
语音识别
Faster-Whisper
Stable Diffusion
[Stable Diffusion]AnimateDiff :最稳定的文本生成视
频
插件
在小视
频
风靡的时代,稳定的文本生成短视
频
成为了迫切需求。
AnimateDiff
视频
训练
数字人
数字人之声
音
克隆:无样本,1分钟样本完美克隆声
音
,开源
WebUI
工
具
: 集成
工
具
包括声
音
伴奏分离、自动训练集分割、中文自动语
音
识别(ASR)和文本标注,协助初学者创建训练数据集和
数字人
声音克隆
GPT-SoVITS
Stable Diffusion
Stable Diffusion AnimateDiff | 最火文本生成视
频
插件
AnimateDiff介绍 AnimateDiff采用控制模块来影响Stable Diffusion模型,通过大量短视
频
剪辑的训练,它能够调整图像生成过程,生成一系列与训练视
频
剪辑相似的图像。
动画
视频
AnimateDiff
<
...
4
5
6
7
8
9
10
11
12
13
...
>
1
2
4
5
6
7
8
9
100