标签: #huggingface
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 4 篇
现在 Hugging Face 上什么在火 —— 2026 年 8 月热门地图
以 2026 年 8 月 2 日为准,亲自过了一遍 Hugging Face 的热门榜单,按用途整理出真正能用于部署的模型。按通用 LLM、编程、嵌入与重排、视觉、语音、图像视频生成、小型端侧模型的顺序,写清了每个模型的厂商、规模、许可证,以及使用前需要了解的限制。核心结论是:热门榜单里相当一部分根本不是新模型,而是量化重新上传和社区微调。文中讲了怎么分辨原版和衍生版、为什么衍生版的下载量会反超原版,以及这个事实对选型意味着什么。所有数
2026-08-02 · 25 分钟阅读 #llm#huggingface#open-weights#model-selection#quantization怎样真正读懂一张模型卡片 —— 5 分钟内挑出你需要的东西
模型卡片的写法是,从头读到尾反而找不到你需要的信息:基准测试表占了半屏,许可证和聊天模板却一笔带过。本文把阅读顺序倒过来,整理出在 5 分钟内挑出部署决策真正需要的七件事的方法。内容涉及开放权重和开源有什么不同、为什么不能对卡片上的分数照单全收、上下文长度的标注背后藏着什么,以及分词器和聊天模板为什么是最容易在不报错的情况下悄悄出问题的地方。最后按这份清单,把 2026 年 8 月 2 日在 Hugging Face 上直接核实过的一张
2026-08-02 · 27 分钟阅读 #llm#huggingface#model-card#license#tokenizer开源 LLM 生态完全指南:2026 年的模型、工具与部署策略
全面梳理 2026 年开源 LLM 生态的实战指南。涵盖主要模型家族(Llama、Mistral、Gemma、Qwen、DeepSeek)、本地推理工具(Ollama、llama.cpp、vLLM)、微调技术(LoRA、QLoRA),以及运营自有 LLM 所需的实战部署策略。
2026-03-17 · 28 分钟阅读 #open-source#llm#llama#mistral#gemmaHuggingFace 生态系统完全指南:精通 Transformers、Datasets、PEFT 与 Accelerate
全面掌握 HuggingFace 整个生态系统的指南。通过实战示例系统学习 Transformers、Datasets、Tokenizers、PEFT、Accelerate、Diffusers 以及 Hub API。
2026-03-17 · 22 分钟阅读 #huggingface#transformers#peft#accelerate#nlp