生成式AI
VAE·GAN·Diffusion·视频生成
- 001 进阶 3D生成 从NeRF到3D Gaussian Splatting,3D生成模型的核心技术与管线
- 002 进阶 ControlNet与LoRA条件化 ControlNet的零卷积结构与LoRA的低秩适应,精细控制预训练扩散模型
- 003 中级 GAN -- 生成器与判别器 对抗训练的核心机制,从Goodfellow的minimax博弈到StyleGAN的演进
- 004 中级 StyleGAN StyleGAN的映射网络与AdaIN机制,从风格解耦到照片级人脸生成
- 005 中级 图像修复、扩展与编辑 扩散模型在图像修复、外绘和编辑任务中的应用,从SDEdit到inpainting管线
- 006 进阶 扩散模型 -- DDPM从零开始 从DDPM的噪声预测到反向采样,理解扩散模型的核心训练与推理流程
- 007 进阶 流匹配与整流流 从DDPM到流匹配,更直的采样路径与更快的推理速度
- 008 中级 条件GAN与Pix2Pix 条件生成对抗网络与图像到图像翻译,从Pix2Pix到CycleGAN
- 009 进阶 潜扩散与Stable Diffusion 从像素空间到潜空间的扩散,Stable Diffusion的两阶段架构与文本条件化
- 010 中级 生成模型 -- 分类与历史 五大生成模型家族的分类体系与演进历史,理解每个家族的权衡取舍
- 011 中级 生成模型评估 -- FID与CLIP分数 FID、CLIP分数、Inception分数等生成模型评估指标的原理与局限
- 012 中级 自编码器与VAE 从普通自编码器到变分自编码器,理解重参数化技巧与ELBO损失
- 013 进阶 视觉自回归模型 -- VAR 从光栅扫描到多尺度生成,视觉自回归模型VAR的原理与架构
- 014 进阶 视频生成 从图像扩散到视频扩散,时空建模与Sora架构的核心原理
- 015 中级 音频生成 从语音合成到音乐创作,音频扩散与自回归模型的核心技术