博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 829 篇
#2026-03 168#ai 110#llm 90#ai-papers 62#career 60#kubernetes 54#mindset 51#ai-platform 48#devops 42#security 41#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#database 23#linux 22#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#rag 16#fundamentals 15#network 15#postgresql 15#2026-08 14
htop 与 top 完全解剖 — 读懂每一个数字
在 Linux 上打开 htop 或 top,扑面而来的是一大堆数字。VIRT、RES、SHR 三者的区别,进程状态字母的含义,为什么负载均值(load average)不等于 CPU 使用率,仪表条颜色代表什么,以及僵尸进程究竟是怎么回事 — 本文基于最近再度登上 Hacker News 榜首的一篇名解说,把这些字段逐一拆开讲清楚。
2026-07-05 · 11 分钟阅读 #linux#performance#htop#sysadmin记忆力的秘密 — 不是天赋,而是技术
记忆力并非与生俱来、固定不变的天赋,而是可以善加利用的技术与生物学机制的组合。从艾宾浩斯遗忘曲线、间隔效应、检索练习(测试效应)、记忆宫殿,到睡眠与记忆巩固——本文梳理记忆究竟是如何运作的,以及如何加以利用。
2026-07-04 · 15 分钟阅读 #memory#learning#psychology#cognition什么是流畅 — 语言习得科学怎么说
流畅既不是词汇量,也不是语法准确度,而是以能进行实时沟通的速度调用语言的自动化。本文以克拉申的输入假说、卡明斯的 BICS/CALP 区分、保罗·内申的高频词汇研究为基础,梳理流畅为何与准确度相冲突,以及实际上该如何抵达流畅。
2026-07-04 · 23 分钟阅读 #language#learning#fluency#communication支付系统入门:流程·PSP·卡组织·结算
从工程师的视角,拆解「按下支付按钮的瞬间,究竟发生了什么」。授权、扣款、结算三者的区别,商户、PSP/网关、收单机构、卡组织、发卡行这五个参与方,一路讲到 3-D Secure、拒付(chargeback)、对账(reconciliation)、幂等性、PCI-DSS。这是在设计一个牵动资金流动的系统之前,必须先弄清楚的地图。
2026-07-03 · 22 分钟阅读 #payments#fintech#systems自信从何而来
持续稳固的自信并不是积极思考的产物,而是证据的残留物。本文通过班杜拉的自我效能理论、邓宁-克鲁格效应、冒名顶替综合征和成长型思维,梳理持续的自信究竟从何而来,以及如何有意识地培养它。
2026-07-03 · 20 分钟阅读 #psychology#confidence#growth#learning浏览器里跑着真引擎:WebAssembly 开发工具集
用 Pyodide 跑的真 Python,用 PGlite 跑的真 PostgreSQL,用 ffmpeg.wasm 处理的视频。本文带你巡览这个网站新加入的 WebAssembly 浏览器工具,从实务角度梳理 WASM 为何能在没有服务器的情况下做到接近原生的速度、它是如何加载的、以及现实中的局限是什么。
2026-07-03 · 13 分钟阅读 #webassembly#wasm#developer-tools#browser#tooling消息队列与异步入门:Queue·Kafka·RabbitMQ·Redis·asyncio 一览
从最朴素的 FIFO 队列开始,到 Kafka 的分区日志、RabbitMQ 的交换机与路由、Redis 的列表·Pub/Sub·Streams,再到 Python asyncio 的事件循环。本文把消息队列与异步的核心概念逐一对照梳理,并用一张比较表说明什么时候该用什么。
2026-07-03 · 17 分钟阅读 #message-queue#kafka#rabbitmq#redis#asyncio可观测性完全指南:日志、链路追踪与 LLM 监控
从日志、指标、链路追踪这三大支柱出发,梳理它们如何通过 traceid 相互关联,再对比 Loki 与 OpenSearch 的日志策略差异、以 OpenTelemetry 为中心的分布式链路追踪(Jaeger、Tempo),最后延伸到以 Langfuse 为代表的 LLM 可观测性。逐项对照实务中该如何搭建技术栈、又该如何取舍。
2026-07-03 · 22 分钟阅读 #observability#opentelemetry#tracing#logging#llm如何构建可更新的解决方案:从安装向导到安全的自动更新
从多步骤安装向导的 UX 设计,到语义化版本与更新渠道、增量更新、原子替换与回滚、代码签名·签名验证·TUF 等完整性安全,再到更新时的数据迁移。结合 Squirrel、Sparkle、electron-updater、Tauri、Service Worker 的实例,梳理如何设计可更新的解决方案。
2026-07-03 · 19 分钟阅读 #auto-update#installer#wizard#code-signing#devops像科学家一样调试:假设驱动的调试
与其盯着 bug 把代码改来改去,不如像科学家那样先立假设、做预测,再用实验去验证。把问题空间用二分搜索一点点缩小,搭出最小可复现示例,用 git bisect 揪出元凶提交,并且真正把错误信息读完。一份把「瞎猜」变成方法论的实战调试指南。
2026-07-03 · 22 分钟阅读 #debugging#engineering#productivity#fundamentals并发 vs 并行 — "应对"与"真正同时做"的区别
Rob Pike 著名的区分 — 并发是"应对"多件事,并行是"同时做"多件事。本文梳理线程与事件循环、竞态条件与数据竞争、互斥锁与死锁、哲学家就餐问题、原子操作,以及 async(I/O)何时占优、线程(CPU)何时占优。
2026-07-03 · 19 分钟阅读 #concurrency#systems#fundamentals靠复利积累的职业生涯 — 别追逐热情,去积累实力
好的职业生涯不是靠"追逐热情"造就的,而是靠把稀缺而有价值的实力、声誉、人脉,随时间以复利的方式积累起来才造就的。本文梳理了职业资本理论、刻意练习、杠杆,以及一套每年都能重复的实践循环 — 如何打造一份靠复利积累的职业生涯。
2026-07-03 · 23 分钟阅读 #career#growth#skills#productivityRust 所有权、借用与生命周期完全指南
Rust 在没有垃圾回收器的情况下保证内存安全的三个核心概念 — 所有权、借用、生命周期,从头到尾讲清楚。移动(move)语义、借用检查器的 &mut XOR & 规则、生命周期为什么必需、如何读懂 E0382、E0502 这类典型错误,以及 Copy 与 Clone 的区别,全部以代码示例为中心梳理。
2026-07-03 · 21 分钟阅读 #rust#ownership#systemsRust 枚举、模式匹配与错误处理
Rust 里既没有 null 也没有异常。取而代之的是 Option 和 Result 这两个枚举,以及安全地拆解它们的模式匹配。本文用示例梳理 enum 与代数数据类型、穷尽(exhaustive)的 match、if let 与 let else、用 ? 运算符传播错误,以及用 thiserror 和 anyhow 设计实战错误类型的方法。
2026-07-02 · 18 分钟阅读 #rust#error-handling#pattern-matching前线部署工程师(FDE)是什么
梳理 Palantir 让其大众化、如今又在 OpenAI、Anthropic 等 AI 公司的解决方案团队里重新火起来的前线部署工程师(FDE)这一角色。所谓 FDE,是被派驻到客户那里、把软件工程、产品、解决方案、外加一点销售与咨询混在一起、把客户真正的问题解决到底的人。本文梳理它与 SWE、SE、PM、咨询顾问的区别,以及为什么 AI 让 FDE 这个角色重新变得不可或缺。
2026-07-02 · 12 分钟阅读 #career#engineering#fde支付幂等性:如何防止重复扣款
网络迟早会断开,一旦断开,客户端就会重试。可在支付场景里,重试可能变成重复扣款。幂等键、去重窗口、唯一约束、重试与超时问题、给 at-least-once 投递加上 dedup、把支付建模为状态机,直到 Stripe 风格的幂等性实现 — 本文梳理了如何让一笔钱只被扣一次。
2026-07-02 · 22 分钟阅读 #payments#idempotency#reliability输入 URL 并按下回车之后会发生什么:从浏览器到像素的全链路巡礼
在地址栏敲入 URL、按下回车的那一秒里,究竟发生了多少事情。从 URL 解析,到带着递归查询与多层缓存的 DNS 解析、TCP 三次握手、TLS 握手、HTTP 请求与响应,再到 HTML 解析和关键渲染路径。这是一趟从浏览器一路走到第一个像素的全栈巡礼。
2026-07-02 · 17 分钟阅读 #networking#web#fundamentalsRust 的 trait、泛型与 trait 对象
trait 是 Rust 的接口,而且不止于此。trait 与接口的区别、泛型约束(trait bound)、静态分派与 dyn trait 对象(动态分派)之间的权衡、关联类型、覆盖实现(blanket impl),以及 derive 宏 — 本文以示例为中心梳理 Rust 的抽象化工具。
2026-07-01 · 16 分钟阅读 #rust#traits#generics复式记账账本:设计一套永不丢钱的会计系统
一项 600 年历史的会计技法,为什么会是现代支付系统的心脏。借方=贷方、不可变的 append-only 记录、账户与余额、「直接搞一个余额字段不行吗」的答案、对账(reconciliation)、像 TigerBeetle 这样的专用账本,以及并发之下的一致性 —— 如何设计一套永不丢钱的系统。
2026-07-01 · 24 分钟阅读 #payments#ledger#accounting#databases如何阅读别人写的代码
开发者花在读代码上的时间远多于写代码,但读代码这件事却从来没人教。找到入口点,不逐行阅读而是追踪数据,把测试和类型当作文档,用 grep 和 IDE 跳转画出调用图,实际跑起来打印调试,再改点东西看看什么会坏掉。这是一份快速掌控陌生代码库的实战策略。
2026-07-01 · 18 分钟阅读 #code-reading#engineering#onboarding#fundamentals