标签: #video-generation
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 2 篇
用一张图片生成视频 — Kling·Veo·Sora vs Wan·HunyuanVideo,何时选哪个
在挑选「一张图片加一段提示词生成视频」的模型时,真正左右决定的不是演示片的画质,而是每秒价格、输入图像限制、许可证这三件事。本文以 2026 年 7 月为基准,只依据各厂商的官方价目表和文档直接核对整理。托管一侧,sora-2 为 720p 每秒 0.10 美元,Veo 3.1 Fast 为含音频 720p 每秒 0.10 美元;Kling 则不按秒、而按 5 秒·10 秒的片段为单位计费,「每秒价格」根本不存在。开放权重一侧,Wan2
2026-07-17 · 31 分钟阅读 #ai#video-generation#image-to-video#open-weights#licensingSOTA 视频生成模型解析 — 时空扩散 Transformer
从时空潜在补丁与扩散 Transformer 的视角,梳理视频生成的根本难题 — 时间一致性与计算成本。本文围绕 Sora 提出的概念与后续模型系列,以架构为中心分析条件化、评估与物理一致性方面的局限。
2026-06-30 · 13 分钟阅读 #ai-papers#video-generation#diffusion-transformer#spatiotemporal#text-to-video