标签: #open-weights
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 4 篇
现在 Hugging Face 上什么在火 —— 2026 年 8 月热门地图
以 2026 年 8 月 2 日为准,亲自过了一遍 Hugging Face 的热门榜单,按用途整理出真正能用于部署的模型。按通用 LLM、编程、嵌入与重排、视觉、语音、图像视频生成、小型端侧模型的顺序,写清了每个模型的厂商、规模、许可证,以及使用前需要了解的限制。核心结论是:热门榜单里相当一部分根本不是新模型,而是量化重新上传和社区微调。文中讲了怎么分辨原版和衍生版、为什么衍生版的下载量会反超原版,以及这个事实对选型意味着什么。所有数
2026-08-02 · 25 分钟阅读 #llm#huggingface#open-weights#model-selection#quantization蒸馏会迁移什么、不会迁移什么 — 把 DeepSeek 蒸馏进 GPT-OSS,审查没有跟过来
2026 年 7 月 30 日发到 Show HN 上的 CTGT 实验报告说,以 DeepSeek V4 Flash 为教师、GPT-OSS 为学生蒸馏金融推理能力,结果能力过来了,政治审查没有过来。在 152 组配对上,教师在敏感问题与对照组之间表现出 45.45 分的审查落差,而学生只有 0.43 分和 3.94 分,停在基线上。本文不把这一个实验放大,只把它当作起点 — 因为蒸馏复制的是教师的输出分布,所以本文立起一套框架:观测
2026-07-31 · 18 分钟阅读 #ai#llm#distillation#alignment#open-weights用一张图片生成视频 — Kling·Veo·Sora vs Wan·HunyuanVideo,何时选哪个
在挑选「一张图片加一段提示词生成视频」的模型时,真正左右决定的不是演示片的画质,而是每秒价格、输入图像限制、许可证这三件事。本文以 2026 年 7 月为基准,只依据各厂商的官方价目表和文档直接核对整理。托管一侧,sora-2 为 720p 每秒 0.10 美元,Veo 3.1 Fast 为含音频 720p 每秒 0.10 美元;Kling 则不按秒、而按 5 秒·10 秒的片段为单位计费,「每秒价格」根本不存在。开放权重一侧,Wan2
2026-07-17 · 31 分钟阅读 #ai#video-generation#image-to-video#open-weights#licensingTencent Hy3:冷静解读 295B 开放权重 MoE
Tencent 于 2026 年 7 月 6 日以 Apache 2.0 许可证公开了 Hy3。这是一个总参数 295B、每次仅激活 21B 的 MoE 推理·智能体语言模型。本文梳理它到底有什么新意、在中国系开放权重浪潮中处于什么位置,以及厂商自行公布的基准测试数字应当相信到什么程度。
2026-07-11 · 8 分钟阅读 #hy3#tencent#hunyuan#open-weights#moe