标签: #performance
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 33 篇
Postgres 19 的 pg_plan_advice — 一个长期拒绝提示的项目给出的妥协方案
PostgreSQL 项目长期以来一直拒绝优化器提示(hint)。但在 2026 年 6 月 4 日发布的 PostgreSQL 19 Beta 1 中,Robert Haas 编写的 pgplanadvice 和 pgstashadvice 作为 contrib 模块被合并了进去。这不是 Oracle 式的提示 — 建议(advice)活在 SQL 之外,它不是替代规划器,而只是收窄搜索空间,用文档自己的话说,出来的"只会是核心规划器
2026-07-16 · 22 分钟阅读 #postgresql#query-planner#query-optimization#database#performanceCXL 内存分层,内核走到哪一步了 — DAMON 合并了什么,数字又没测到什么
即便 CXL 硬件已经插在服务器上,真正决定把哪些热页面、哪些冷页面搬来搬去的还是内核。截至 2026 年 7 月,Linux mainline 已经陆续接收了基于 DAMON/DAMOS 的分层组件,从 6.11 一直分布到 7.2-rc1,但真正「装上就能用」的分层内核模块并不存在,而 CONFIGDAMON 自从 Linus 撤回默认启用之后,至今仍然是关闭状态。本文直接查阅内核源码,确认到底是哪些代码在第几版内核真正落地,并追溯
2026-07-16 · 30 分钟阅读 #hardware#cxl#memory#linux-kernel#performance.NET 11 runtime-async — 把 async 状态机从编译器搬到运行时的中期报告
C 的 async/await 从 2012 年起就一直是编译器层面的功能。Roslyn 把方法体重写成一个状态机类,而运行时甚至不知道那是 async,只是照常执行罢了。.NET 11 的 runtime-async 把这个重写过程搬进了运行时内部 — 方法上会带一个 MethodImplOptions.Async 标记,挂起与恢复直接由 JIT 和 VM 处理。第一个看得见的成果是「活的」堆栈跟踪从 13 帧缩短到 5 帧,而从预览
2026-07-16 · 28 分钟阅读 #dotnet#csharp#async#jit#performance精英运动员的心理,撕掉海报之后 — 思维模式、刻意练习与压力的真实证据
"精英运动员的心理"是励志海报的常见题材,但真正的运动心理学要比海报谨慎得多,也正因如此更耐人寻味。本文梳理了 Carol Dweck 的成长型思维(以及她本人警告过的"伪成长型思维")、Anders Ericsson 的刻意练习与"一万小时定律"是如何被误解的,以及关于压力、专注、自我对话和正念的研究。文章诚实地区分哪些有证据支撑、哪些只是口号,也写了对开发者和创作者而言什么能迁移、什么不能迁移。
2026-07-11 · 9 分钟阅读 #mindset#psychology#performance#sports#deliberate-practiceLLM 缓存的原理 — 提示词缓存与 Prefix Cache 为什么能省钱
为什么提示词的前半部分相同,成本就会降到十分之一?答案就在 Transformer 内部的 KV 缓存里。由于注意力是因果的(causal),前面 token 的 Key/Value 向量无论后面出现什么都不会改变,因此可以先存下来再复用。从 prefill 与 decode 的区分、KV 缓存的内存数字、vLLM/SGLang 的 prefix cache 实现,一直到 Anthropic/OpenAI 提示词缓存的定价结构与实战设计
2026-07-08 · 12 分钟阅读 #ai#llm#caching#inference#performancehtop 与 top 完全解剖 — 读懂每一个数字
在 Linux 上打开 htop 或 top,扑面而来的是一大堆数字。VIRT、RES、SHR 三者的区别,进程状态字母的含义,为什么负载均值(load average)不等于 CPU 使用率,仪表条颜色代表什么,以及僵尸进程究竟是怎么回事 — 本文基于最近再度登上 Hacker News 榜首的一篇名解说,把这些字段逐一拆开讲清楚。
2026-07-05 · 11 分钟阅读 #linux#performance#htop#sysadmin实战 Big-O:没有数学焦虑的复杂度
O() 到底意味着什么、常见复杂度类别配合现实例子、n 较小或缓存起作用时常数为何会赢、隐藏在嵌套循环与 N+1 查询里的 O(n²)、空间复杂度、动态数组的分摊成本,以及该在什么时候停止优化。用工程师的直觉而非数学上的严谨来处理复杂度。
2026-06-22 · 16 分钟阅读 #algorithms#performance#fundamentals缓存失效全解析
"计算机科学中有两件难事:缓存失效和命名。"本文梳理缓存为何如此之难、TTL·write-through·write-behind·cache-aside 等策略、缓存踩踏(dogpile)问题及其缓解手段(锁·抖动·stale-while-revalidate)、基于事件与版本键的失效方式,以及从 CPU 到浏览器贯穿始终的缓存层级。
2026-06-19 · 24 分钟阅读 #performance#caching#systemsMechanical Sympathy(机械同感):写硬件喜欢的代码
同样时间复杂度的代码,实际运行速度却能相差数十倍,原因就藏在硬件里。CPU 缓存(L1/L2/L3)与缓存行、数组和链表的数据局部性、分支预测、伪共享、内存层级的延迟数字,以及为什么数组结构体(SoA)如此重要 — 本文带你进入写硬件喜欢的代码的机械同感(mechanical sympathy)世界。
2026-06-18 · 25 分钟阅读 #performance#systems#cpuripgrep 为什么这么快
ripgrep 比 grep 快,靠的不是魔法,而是许多决策的累积:Rust 的 regex crate 所用的有限自动机(不回溯)、SIMD 加速的 memchr、并行目录遍历、尊重 .gitignore、智能大小写、跳过二进制文件,直到 mmap。逐一拆解打造快速工具的原理。
2026-06-17 · 19 分钟阅读 #rust#performance#tools#cliAI/ML 的 Python 高阶技巧:性能优化、并行处理、内存管理
AI/ML 开发所需的 Python 高阶技巧完全指南。通过实战示例掌握 Python 性能优化、多进程、async/await、Numba JIT、Cython、内存剖析、类型提示。
2026-03-17 · 36 分钟阅读 #python#advanced#performance#multiprocessing#numbaPostgreSQL 高级索引完全指南:GIN·GiST·BRIN·Partial Index 实战活用
深入讲解 PostgreSQL 的高级索引类型。超越 B-tree,覆盖 GIN(倒排索引)、GiST(空间索引)、BRIN(块范围索引)、Partial/Expression Index 的内部结构与应用场景,基于 EXPLAIN ANALYZE 的性能分析,直到索引膨胀的管理,提供一份实战指南。
2026-03-10 · 21 分钟阅读 #database#postgresql#indexing#gin-index#performancenginx 配置完全指南:从架构到生产优化的 15 个核心主题
从 nginx 的事件驱动架构和配置结构,到反向代理、负载均衡、SSL/TLS、缓存、Rate Limiting、安全响应头、性能调优、健康检查 —— 用实战示例完整梳理可在生产环境立即落地的 15 项核心配置。
2026-03-01 · 41 分钟阅读 #nginx#reverse-proxy#load-balancing#ssl#tls