首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· Transformer速查宝典:模型、架构、训练方法的论文都在这里了
· 接私活必看的11个开源项目
· AI写作不如意?万字长文深度剖析背后原因
· 保姆级教程:图解Transformer
· 聊天机器人阅读 PDF?用这25个提示词技巧,亲测有效!(ChatGPT & Claude 2)
· 掌握 Midjourney 提示词技巧成为 25 个流派的摄影大师
· 爱设计PPT
· 我用AI写小说:「国学篇」如何将国学插入小说中
· 中学生也能看懂的Sora视频生成原理解读
· Animatediff V2 版本来了!就一个字:秀
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
腾讯
AI助手App“腾讯元宝”已上线应用商店
腾讯混元文生图大模型支持中英文双语输入及理解,无论是中文的古诗词、民间俚语,还是英文的文学作品、科技文章,都能得到精准的理解和生动的呈现 腾讯元宝还允许用户创建个人智能体,用户可以在创建过程中让AI自动生成智能体相关信息,并支持
克
隆
声
音
腾讯元宝
开源
GPT-4o实时语
音
方案提供商Livekit开源voice agent:轻松处理
音
视频流
轻松访问 LiveKit WebRTC 会话并处理或生成
音
频、视频和数据流。
voice
agent
开源
音视频
「语
音
转换新速度」— 探秘Whisper JAX的70倍速提升
在AI的众多分支中,语
音
识别技术的突破性进展尤为引人瞩目。
Whisper
语音识别
开源
开源免费离线语
音
识别神器whisper如何安装
whisper介绍 Open AI在2022年9月21日开源了号称其英文语
音
辨识能力已达到人类水准的Whisper神经网络,且它亦支持其它98种语言的自动语
音
辨识。
wisper
翻译
免费
开源
【开源项目】Flow Matching 语
音
合成
CFM是一种新技术,已被证明可以改进扩散模型,Meta的Voicebox模型将CFM引入语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
打造
音
乐传奇:Suno推出
音
乐生成模型Suno V3,让每个人都能成为作曲家
,以下是歌词: 在远方的天际线,火光划破宁静夜, 硝烟弥漫,战鼓
声
,撕裂和平的幻灭。
suno
歌曲
音乐
开源
有感情的语
音
合成开源模型:ChatTTS安装使用详解
ChatTTS是一个为对话场景设计的语
音
生成模型,专门用于大型语言模型(LLM)助手的对话任务、对话语
音
和视频介绍等应用。
ChatTTS
语音合成
开源
有道开源的国产语
音
库EmotiVoice爆火了!具有情绪控制功能的语
音
合成引擎!
接下面让我们看看这款国产语
音
库为何如何迅速的火遍大江南北的🔥!
EmotiVoice
语音库
开源
9.4k Star!MemGPT:伯
克
利大学最新开源、将LLM作为操作系统、无限上下文记忆、服务化部署自定义Agent
加州大学伯
克
利分校的研究人员发明了这个技术,灵感来自于电脑操作系统怎样管理内存的。
MemGPT
大语言模型
Agent
深度好文,Agent盛行前传
第六是模仿能力(imitation),它和概括能力相似的点是它们同属基础能力,好的模仿能力能够促进语言、知识和运动技能的提升,“元能力”(参考“元认知”,我来给它起了个名字),行为
克
隆
和观察式学习是习得模仿能力的两种途径
Agent
大模型
开发语
音
产品时设计唤醒词和命令词的技巧
命令词中字的
音
节较长且相邻汉字的
声
韵母区分度越大越好; 3.
语音产品
唤醒词
命令词
Stable Diffusion
小白设计师福
音
:Stable Diffusion 16款插件测评,好用不?推荐吗?
#65039;⭐️⭐️ 能做什么:Ultimate SD Upscale 是一款强大的图像超分辨率工具,可用于将低分辨率图像提升到高分辨率、减少噪
声
和模糊
SD
插件
文生图
被高估的Pika,被低估的多模态AI
例如,在医疗领域可以通过结合图像、录
音
和病历文本,提供更准确的诊断和治疗方案;在交通领域,结合图像和传感器数据,带来更智能、更安全的自动驾驶体验;在教育领域,将文本、
声
音
、视频相结合,呈现更具互动性的教育内容
大模型
多模态
大模型
大模型RAG检索增强问答如何评估:噪
声
、拒答、反事实、信息整合四大能力评测任务探索
为此,噪
声
鲁棒性测试根据所需的噪
声
比,将外部文档包含一定数量噪
声
文档的实例包含在内。
大模型
RAG检索增强
懒人福
音
!用AI生成会议纪要,让你的工作更高效!
**环境适应性**:AI系统可以在各种噪
声
环境下工作,不受会议室环境的影响。
会议纪要
AI工具
<
...
2
3
4
5
6
7
8
9
10
11
...
>
1
2
4
5
6
7
8
9
100