#Phase 8: Generative AI
Create images, video, audio, 3D, and more.
14 lessons, ~14 hours total. Each lesson ships: a 180-230 line doc, a runnable stdlib Python demo, a diagram, and a named skill for your agent.
| # | Lesson | Time |
|---|---|---|
| 01 | Generative Models — Taxonomy & History | ~45 min |
| 02 | Autoencoders & VAE | ~75 min |
| 03 | GANs — Generator vs Discriminator | ~75 min |
| 04 | Conditional GANs & Pix2Pix | ~75 min |
| 05 | StyleGAN | ~45 min |
| 06 | Diffusion Models — DDPM from Scratch | ~75 min |
| 07 | Latent Diffusion & Stable Diffusion | ~75 min |
| 08 | ControlNet, LoRA & Conditioning | ~75 min |
| 09 | Inpainting, Outpainting & Editing | ~75 min |
| 10 | Video Generation | ~45 min |
| 11 | Audio Generation | ~45 min |
| 12 | 3D Generation | ~45 min |
| 13 | Flow Matching & Rectified Flows | ~45 min |
| 14 | Evaluation — FID, CLIP Score, Human Preference | ~45 min |
See ROADMAP.md for the full cross-phase plan.