标签: #deployment
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 3 篇
发布本身就是压测 —— 不为「把缓存填满」设计成本会发生什么
拆解 Canva 把网关的内存态会话吊销缓存从 MySQL 迁到 S3 的过程。问题不在稳态的查询成本,而在每次发布时几百个 Pod 同时填缓存、把数据库砸穿的启动成本;解法也不是再叠一层缓存,而是换掉数据的表示方式。把 12 小时的滑动窗口切成 30 分钟的片段,再把一条吊销压进 16 字节做成有序数组,网关就能对下载下来的字节不做任何转换直接做二分查找。文中还理清了条件式 PUT 与领导者选举里,哪一个是正确性、哪一个是优化。
2026-08-09 · 12 分钟阅读 #architecture#caching#s3#scalability#deployment2026年自托管部署平台怎么选 —— 划分 Coolify、Dokploy、CapRover、Kamal、Openship 的五个维度
Openship —— 一款自带 CI/CD 的自托管部署平台 —— 登上 GeekNews,老问题又被带回来了:要不要离开托管式 PaaS,自己运维?本文用真正决定结果的五个维度 —— 控制平面归属、回滚路径、密钥处理方式、多节点行为、运维负担 —— 来比较 Coolify、Dokploy、CapRover、Kamal 2、Openship,以及纯 compose 组合。文中给出每款工具的实际命令与配置,并算一算自托管到底是用什么换掉
2026-07-31 · 19 分钟阅读 #self-hosting#deployment#paas#kamal#coolifyTelegram Bot + Webhook 实战指南:从用 Python 造机器人到 Kubernetes 部署
基于 Telegram Bot API 与 Webhook 的聊天机器人开发完全指南。用 python-telegram-bot 和 FastAPI 构建机器人,涵盖 Polling vs Webhook 对比、内联键盘、命令处理器,以及 Kubernetes 部署。
2026-03-02 · 8 分钟阅读 #telegram#bot#webhook#python#chatbot