标签: #diffusion-transformer
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 3 篇
SOTA 视频生成模型解析 — 时空扩散 Transformer
从时空潜在补丁与扩散 Transformer 的视角,梳理视频生成的根本难题 — 时间一致性与计算成本。本文围绕 Sora 提出的概念与后续模型系列,以架构为中心分析条件化、评估与物理一致性方面的局限。
2026-06-30 · 13 分钟阅读 #ai-papers#video-generation#diffusion-transformer#spatiotemporal#text-to-videoSOTA 图像生成模型分析 — 从扩散模型到 FLUX
以谱系为中心,梳理文本-图像生成的最前沿:从扩散模型原理到潜在扩散、DiT、rectified flow,再到 FLUX 系列。通过架构原理、对比表和图解,分析 SOTA 模型之间共同的结构与差异。
2026-06-30 · 16 分钟阅读 #ai-papers#diffusion-models#text-to-image#latent-diffusion#rectified-flowDiffusion Transformer(DiT)架构分析:从 U-Net 到 Transformer 的转变
本文分析 Scalable Diffusion Models with Transformers(DiT)论文。内容涵盖突破 U-Net 扩散模型局限、转向 Transformer 骨干网络的背景、adaLN-Zero 条件化机制、缩放定律,以及对 SORA、DALL-E 3 的影响。
2026-03-03 · 11 分钟阅读 #ai-papers#diffusion-transformer#dit#generative-ai#image-generation