标签: #platform-engineering
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 4 篇
用家里的服务器搭一个实操型学习平台 — 如何把 Kubernetes 塞进没有特权的 Pod 里
学员按下按钮,专属容器随即启动,在浏览器终端里操作真实的 Linux shell,每一步点击评分后由服务器检查 Pod 内的实际状态来判定通过与否 — 这是把这样一个学习平台搭在家里 7 节点 Kubernetes 集群之上的记录。最难的问题不是功能,而是隔离。既然是实操,就必须把 root 交给学员,但这个 root 绝不能跑到家庭网络里去。解法是三层:把 Cilium 网络策略拆成按实验区分的三档配置,Linux capabilit
2026-08-20 · 22 分钟阅读 #kubernetes#cilium#security#homelab#kwok用 LLM 搭建企业内部知识库这件事 —— 权限感知检索、新鲜度,以及上线前必须准备的评测集
Cerebras 在 2026 年 7 月 15 日公开的内部知识库搭建记录,揭示了一个日均处理超过 15,000 次查询、由人、自动化脚本和智能体共同调用的系统的内部结构。但企业内部知识库中团队真正容易低估的部分,并不是分块(chunking)或重排(reranking),而是权限、新鲜度、删除传播,以及真相来源(source of truth)的冲突。一个会泄露 HR 文档的搜索,还不如没有搜索;一个自信地引用已经作废的运维手册(r
2026-07-31 · 23 分钟阅读 #ai#rag#enterprise-search#llm#platform-engineering使用平台的团队吞吐量低8%,变更稳定性低14% — 为什么不能把 DORA 的数据读成因果
截至2026年,内部开发者平台的采用率据报告为90%。然而,得出这个数字的 DORA 报告自身的数据里,也藏着一个令人不安的结果 — 在2024年的报告中,使用平台的用户个人生产力高8%、团队绩效高10%,但吞吐量却低8%、变更稳定性低14%,DORA 自己称之为「令人意外的结果」。更重要的是,DORA 自己提出的三个假设中,有一个是反向因果 — 即已经不稳定、已经燃尽(burnout)的组织,是为了修复这一点才建起了平台。在2025年
2026-07-16 · 30 分钟阅读 #platform-engineering#dora#internal-developer-platform#devex#research-methodsAI 时代生存指南 第 1 篇:从开发者转型 DevOps/平台工程师 — 路线图与现实策略
写给害怕被 AI 取代的开发者的现实版职业转型指南。在编码工作被 AI 大量取代的时代,给出转向 DevOps、平台工程、SRE 的具体路线图与学习策略。
2026-03-17 · 26 分钟阅读 #career#devops#ai-era#career-transition#platform-engineering