首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 国内厂商语音识别与Whisper评测:现状与概况对比
· 最新最强开源模型Qwen3本地运行指南!Windows+ollama+chatwise轻松搞定
· Stable Diffusion|提示词高阶用法(二)双人同图
· AI换脸工具:facefusion使用心得
· 阿里Outfit Anyone实现真人百变换装
· 变天了,AI可以一键生成中文海报了......
· API.box
· 为你推荐开源项目:Meridian——专属个人情报站!
· 字节跳动最强AI工具 “豆包” ,近1000款应用!一句话自动生成图文,堪比ChatGPT?
· 【重磅推荐】PaddleOCR:超越人眼识别率的AI文字识别神器!
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
被高估的Pika,被低估的多模态AI
例如,在医疗领域可以通过结合图像、录
音
和病历文本,提供更准确的诊断和治疗方案;在交通领域,结合图像和传感器数据,带来更智能、更安全的自动驾驶体验;在教育领域,将文本、声
音
、视
频
相结合,呈现更具互动性的教育内容
大模型
多模态
国内厂商语
音
识别与Whisper评测:现状与概况对比
语
音
识别技术不仅可以应用于智能助手、语
音
控制、自动化客服等领域,还有望为残障人士提供更便捷的沟通工具。
语音识别
Faster-Whisper
大模型
中国首个长时长、高一致性、高动态性视
频
大模型,Vidu 登场
今日,在中关村论坛未来人工智能先锋论坛上,生数科技联合清华大学正式发布中国首个长时长、高一致性、高动态性视
频
大模型——「Vidu」。
Vidu
大模型
视频
微调
超越Animate Anyone! 南加大&字节提出MagicPose,不需任何微调就可生成逼真的人类视
频
南加州大学&字节提出MagicPose,一种新颖有效的方法,提供逼真的人类视
频
生成,实现生动的运动和面部表情传输,以及不需要任何微调的一致的野外零镜头生成。
MagicPose
视频
打造
音
乐传奇:Suno推出
音
乐生成模型Suno V3,让每个人都能成为作曲家
Suno AI全新
音
乐生成模型Suno V3来临,掀起
音
乐界"ChatGPT时刻",人人皆可成为作曲家、歌手,瞬间超越自我,打造独一无二
音
乐专辑就在此刻!
suno
歌曲
音乐
Stable Diffusion
读取大脑重建高清视
频
,Stable Diffusion还能这么用
但以往的研究都主要聚焦在重建静态图像,而以高清视
频
形式来展现的工作还是较为有限。
stablediffusion
开源
有道开源的国产语
音
库EmotiVoice爆火了!具有情绪控制功能的语
音
合成引擎!
接下面让我们看看这款国产语
音
库为何如何迅速的火遍大江南北的🔥!
EmotiVoice
语音库
Stable Diffusion
小白设计师福
音
:Stable Diffusion 16款插件测评,好用不?推荐吗?
因为这是以设计师日常应用的角度出发,从推荐指数、易上手程度、使用
频
率三个维度来测评。
SD
插件
文生图
Agent
深度好文,Agent盛行前传
第六是模仿能力(imitation),它和概括能力相似的点是它们同属基础能力,好的模仿能力能够促进语言、知识和运动技能的提升,“元能力”(参考“元认知”,我来给它起了个名字),行为
克
隆
和观察式学习是习得模仿能力的两种途径
Agent
大模型
Stable Diffusion
Stable Diffusion AnimateDiff | 最稳定的基于文本生成视
频
的方法
之前虽然小视
频
生成比较火,不过出的视
频
都不太稳定,目前来看 AnimateDiff 是相对比较稳定的,而且能同时支持和其他插件一起使用。
动画
animate
sd
Stable Diffusion
Stable Diffusion AnimateDiff | 最稳定的基于文本生成视
频
的方法!
之前虽然小视
频
生成比较火,不过出的视
频
都不太稳定,目前来看 AnimateDiff 是相对比较稳定的,而且能同时支持和其他插件一起使用。
文本生成视频
AnimateDiff
工具
再次重点介绍!!!这款国内的AI制作视
频
工具
之前介绍过一款图片生成视
频
的工具-Flow Photo,99%的人不知道的一款国内的AI制作视
频
工具。
Flow
Photo
视频
开源
9.4k Star!MemGPT:伯
克
利大学最新开源、将LLM作为操作系统、无限上下文记忆、服务化部署自定义Agent
加州大学伯
克
利分校的研究人员发明了这个技术,灵感来自于电脑操作系统怎样管理内存的。
MemGPT
大语言模型
Mixtral 7B 官宣免费,一大波 AI 模型也免费了,有网就能用!
没有精心编辑过的 Demo 视
频
,也没有长长的介绍博客,只有简单直接的磁力下载链接,背后是高达 87G 完整的模型文件。
开源
大模型
AI Comic Factory:AI(连环)漫画生成器
我还没有为它编写文档,但基本上它是其他现有 API 的“只是一个包装器™”: @hysts 的 hysts/SD-XL 空间 以及其他用于制作视
频
、添加
音
频
等的 API
生成式AI
<
...
4
5
6
7
8
9
10
11
12
13
...
>
1
2
4
5
6
7
8
9
100