生成式AI
VAE·GAN·Diffusion·视频生成
- 001进阶3D生成从NeRF到3D Gaussian Splatting,3D生成模型的核心技术与管线
- 002进阶ControlNet与LoRA条件化ControlNet的零卷积结构与LoRA的低秩适应,精细控制预训练扩散模型
- 003中级GAN -- 生成器与判别器对抗训练的核心机制,从Goodfellow的minimax博弈到StyleGAN的演进
- 004中级StyleGANStyleGAN的映射网络与AdaIN机制,从风格解耦到照片级人脸生成
- 005中级图像修复、扩展与编辑扩散模型在图像修复、外绘和编辑任务中的应用,从SDEdit到inpainting管线
- 006进阶扩散模型 -- DDPM从零开始从DDPM的噪声预测到反向采样,理解扩散模型的核心训练与推理流程
- 007中级条件GAN与Pix2Pix条件生成对抗网络与图像到图像翻译,从Pix2Pix到CycleGAN
- 008进阶流匹配与整流流从DDPM到流匹配,更直的采样路径与更快的推理速度
- 009进阶潜扩散与Stable Diffusion从像素空间到潜空间的扩散,Stable Diffusion的两阶段架构与文本条件化
- 010中级生成模型 -- 分类与历史五大生成模型家族的分类体系与演进历史,理解每个家族的权衡取舍
- 011中级生成模型评估 -- FID与CLIP分数FID、CLIP分数、Inception分数等生成模型评估指标的原理与局限
- 012进阶视觉自回归模型 -- VAR从光栅扫描到多尺度生成,视觉自回归模型VAR的原理与架构
- 013进阶视频生成从图像扩散到视频扩散,时空建模与Sora架构的核心原理
- 014中级自编码器与VAE从普通自编码器到变分自编码器,理解重参数化技巧与ELBO损失
- 015中级音频生成从语音合成到音乐创作,音频扩散与自回归模型的核心技术