首页
Ai 资讯
Ai 知识库
创作魔法
绘画魔法
视频魔法
训练魔法
Ai术语
Ai提示词
Ai创意图
Ai工具
Ai视频
VIP专区
VIP专区
登录
AI魔法学院客服
最新
排序
收藏
全部
七天内
一个月内
选择分类
全部
写作魔法
绘画魔法
视频魔法
训练魔法
其他
AI工具
VIP视频
推荐阅读
换一批
· 10秒换脸,一张图片够了!SD Roop插件教程
· Stable Diffusion|提示词高阶用法(二)双人同图
· 字节开源项目MimicTalk:快速打造逼真3D Talking Face的利器
· GenColor.ai
· 最新最强开源模型Qwen3本地运行指南!Windows+ollama+chatwise轻松搞定
· 6个最佳开源TTS引擎
· 高效选择:Ollama与LM Studio深度对比
· LangChain: LLM 应用聚焦的两大方向,RAG 和 Agents
· GPU 性能(数据表)快速参考
· 大模型微调数据选择和构造技巧
热门标签
Stable Diffusion
stable diffusion
Midjourney
midjourney
ComfyUI
comfyui
ChatGPT
chatgpt
大模型
数字人
开源
人工智能
Sora
文心一言
天工
零一万物
知海图
星火
文心一格
混元
通义千问
盘古
言犀
ChatGLM
Github
微软
热门标签
免费
教程
插件
免费
教程
插件
免费
教程
插件
文章列表
深入探秘:百川7B
大
模
型
的训练代码解析,揭秘巨无霸
语
言
模
型
背后的奥秘
之前几期讲了
大
模
型
的一些部署相关,非常基础,感兴趣的同学可以参考下: 手把手教你部署和理解
大
模
型
,超详细步骤,包教包会!
大模型
心理
MindChat心理
大
模
型
模
型
介绍 心理
大
模
型
——漫谈(MindChat)期望从心理咨询、心理评估、心理诊断、心理治疗四个维度帮助人们纾解心理压力与解决心理困惑, 提高心理健康水平.
心理大模型
解读wav2lip:探究
语
音
驱动唇部动作的技术原理!
二、 本文方法介绍 wav2lip
模
型
的训练分为两个阶段,第一阶段是专家
音
频和口
型
同步判别器预训练;第二阶段是GAN网络训练。
wav2lip
语音
百
模
大
战,谁是
大
模
型
的裁判员?
定义了树-邻接
语
法(TAG)的阿拉文德·乔西(Aravind Joshi)教授,曾提出过“如果没有基准来评估
模
型
,就像不造望远镜的天文学家想看星星。”
大模型
开源
网易有道强力开源中英双
语
语
音
克隆
torchaudio pip install numpy numba scipy transformers==4.26.1 soundfile yacs g2p_en jieba pypinyin 准备
模
型
文件
语音
开源
LLM
一文汇总
大
语
言
模
型
LLM所有prompt提示词框架的论文出处
能够让
大
模
型
推理结果变得更好的基础优化手段已经非常多了,这里梳理了常见的提示技术手段和对应的论文: - Zero-shot(零样本提示):https://arxiv.org/abs/2109.01652
prompt
提示词
开源
【开源项目】Flow Matching
语
音
合成
CFM是一种新技术,已被证明可以改进扩散
模
型
,Meta的Voicebox
模
型
将CFM引入
语
音
合成领域,下面是voicebox的一个工作流程图 Matcha-TTS是第一个开源conditional
音视频
Flow
Matching
大
语
言
模
型
的拐杖——RLHF基于人类反馈的强化学习
这些
模
型
使用
大
规
模
的神经网络,可以生成自然
语
言文本,例如对话和文章。
大模型
训练
从零开始学习
大
模
型
-第二章-
大
模
型
学习路线
随着技术的进步,
大
模
型
如OpenAI的GPT-4和Sora、Google的BERT和Gemini等已经展现出了惊人的能力-从理解和生成自然
语
言到创造逼真的图像及视频。
大模型
学习
Prompt
大
语
言
模
型
定制化应用的三种方式:Prompt engineering、Fine tuning、Pre-trainning的区别
在实现
大
语
言
模
型
的定制化应用中,的确有几种常用的方式:Prompt Engineering(提示工程)、Fine-tuning(微调)和Pre-training(预训练)。
大模型
「
语
音
转换新速度」— 探秘Whisper JAX的70倍速提升
在AI的众多分支中,
语
音
识别技术的突破性进展尤为引人瞩目。
Whisper
语音识别
开源
开源免费离线
语
音
识别神器whisper如何安装
Whisper系统所提供的自动
语
音
辨识(Automatic Speech Recognition,ASR)
模
型
是被训练来运行
语
音
辨识与翻译任务的,它们能将各种
语
言的
语
音
变成文本,也能将这些文本翻译成英文
wisper
翻译
免费
开源
【TTS
语
音
克隆开源最强王者】5款爆火开源
模
型
(Fish、F5、GPT、CosyVoice、MaskGCT)效果对比,等你来评!
MaskGCT
模
型
介绍
大
型
文本到
语
音
(TTS)系统通常被分为自回归和非自回归系统。
语音克隆
开源模型
「
语
音
识别的未来已来」——探索Distil-Whisper,轻量级AI的强
大
力量
在AI技术的浪潮中,一款新
型
的
语
音
识别
模
型
Distil-Whisper以其独特的魅力和强
大
的性能脱颖而出。
Distil-Whisper
语音识别
如何避免
大
语
言
模
型
绕过知识库乱答的情况?LlamaIndex 原理与应用简介
LlamaIndex 介绍 LlamaIndex(也称为 GPT Index)是一个用户友好的接口,它将外部数据连接到
大
型
语
言
模
型
(Large Language Models)。
大语言模型
<
1
2
3
4
5
6
7
8
9
10
...
>
1
2
4
5
6
7
8
9
100