博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 829 篇
#2026-03 168#ai 110#llm 90#ai-papers 62#career 60#kubernetes 54#mindset 51#ai-platform 48#devops 42#security 41#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#database 23#linux 22#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#rag 16#fundamentals 15#network 15#postgresql 15#2026-08 14
精英运动员的心理,撕掉海报之后 — 思维模式、刻意练习与压力的真实证据
"精英运动员的心理"是励志海报的常见题材,但真正的运动心理学要比海报谨慎得多,也正因如此更耐人寻味。本文梳理了 Carol Dweck 的成长型思维(以及她本人警告过的"伪成长型思维")、Anders Ericsson 的刻意练习与"一万小时定律"是如何被误解的,以及关于压力、专注、自我对话和正念的研究。文章诚实地区分哪些有证据支撑、哪些只是口号,也写了对开发者和创作者而言什么能迁移、什么不能迁移。
2026-07-11 · 9 分钟阅读 #mindset#psychology#performance#sports#deliberate-practice作为普遍概念的计算 — 什么是坚实的,什么是夸大的
Tim Roughgarden 讲授的“作为普遍而根本的概念的计算”这门课程正引发热议。实际内容是一门扎实的计算理论,涵盖停机问题、算法效率、NP完全性,以及 P 对 NP。本文把它坚实的内核,与宇宙或心灵在字面意义上就是计算这一更大的主张切分开来,并追问“一切皆计算”从哪里开始变成一句无法证伪的话。
2026-07-11 · 12 分钟阅读 #computer-science#computation#complexity#theory#philosophy在 Emacs 中,一切看起来都像服务:用客户端-服务器视角重读"编辑器即操作系统"这个梗
读 Charles Choi 的文章《In Emacs, Everything Looks Like a Service》并梳理其论点。他正面否定"Emacs 是操作系统"这个常见的比喻,转而给出一幅更准确的图景:Emacs 是一个通用客户端,在它里面,无论是网络 API 还是命令行工具,都像是一个个可以向其发送请求的服务。我认同这个视角远比那个陈旧的梗更准确,同时也诚实地掂量它与"一个任务一个应用"模型有何不同,以及它的魅力与代价究竟
2026-07-11 · 10 分钟阅读 #emacs#elisp#client-server#developer-tools#text-editorsCloudNativePG 在 Kubernetes 上跑起 Postgres 再杀掉它 — 实测故障转移 23 秒
在真实的 8 节点 Kubernetes 集群上安装 CloudNativePG(CNPG) v1.30.0,启动一个 3 实例的 Postgres 集群,然后真的把主库杀掉。从引导启动、复制确认,到强制删除主库后的故障转移(23.1 秒内副本晋升、数据零丢失),再到死掉的节点作为副本自愈、恢复到 3/3 — 全过程连同实测日志一并记录。运行在 NFS 存储之上的家庭实验室环境里那些诚实的数字与陷阱,也原样收录。
2026-07-11 · 7 分钟阅读 #cloudnativepg#postgresql#kubernetes#operator#database只用体育场的巡演:BLACKPINK《Deadline》讲述的女性 K-pop 经济学
BLACKPINK 的《Deadline》世界巡演被作为组合首次全体育场巡演来营销,2025年7月5日在高阳开幕,2026年1月26日在香港落幕。先行单曲《Jump》于2025年7月11日发行,以第一名的成绩空降 Billboard 全球200榜;而同名 EP 却直到巡演结束后的2026年2月27日才以5首歌的形式面世,首日约146万张,刷新了女团纪录。不过总演出场次与观众人数在各家出处之间出入极大 — 维基百科的演出表约为33场,福布
2026-07-11 · 9 分钟阅读 #kpop#blackpink#music-industry#korea#touring兵役之后的 BTS:从《阿里郎》专辑与巡演看回归的规模与舞台设计
BTS 全员结束兵役后首次以团体名义推出的正规专辑《阿里郎》于 2026 年 3 月 20 日发行,以首周 641,000 的专辑等效销量在 Billboard 200 榜首出道,这是他们生涯第 7 次登顶、也是自 2022 年《Proof》以来首次夺冠,并连续 3 周稳居第一。同名的阿里郎世界巡演于 2026 年 4 月 9 日在高阳开演,覆盖 34 座城市、23 个国家、超过 88 场演出,一直延续到 2027 年,并主打 360
2026-07-11 · 9 分钟阅读 #kpop#bts#music#korea#touringACSM 健身趋势 20 年 — 从美容到心理健康·寿命·数据
美国运动医学会(ACSM)的全球健身趋势调查今年迎来第 20 届,2026 年的榜首再次是可穿戴技术。本文整理了前十名,但比起排名本身,更想读出这 20 年所勾勒的轨迹 — "减重"改名为"体重管理",运动者中有 78% 把精神与情绪层面的安康列为最大理由。文章也淡淡地点明:这是约 2,000 名专业人士参与的认知调查,而非对大众行为的测量;拥有可穿戴设备并不等于行为改变 — 连作者的这一告诫也一并道来。所有数字均以 ACSM 的公布为
2026-07-11 · 10 分钟阅读 #fitness#health#trends#wellness#wearables从 UniClawBench 看 2026 年的智能体基准测试 — 存活容器与隐藏的监督者
香港大学(HKU)MMLab 于 2026 年 7 月投稿到 arXiv 的 UniClawBench,是一个标榜"能力驱动(capability-driven)"的主动式智能体基准测试。它不再与预先静态记录好的标准答案做比对,而是在存活的 Docker 容器中用步骤级检查点来评分,并以执行者、隐藏的监督者、用户智能体组成的闭环来模拟多轮反馈。其核心在于:把 400 个双语任务划分为五种能力,并力图将基座模型的实力与智能体框架的设计分开
2026-07-11 · 9 分钟阅读 #ai#agents#evaluation#benchmark#llmScarf 为何恋恋不舍地告别用了 7 年的 Haskell — 语言选择的真正成本
Scarf 正在把在生产环境跑了 7 年的 Haskell 迁移到 Python。有意思的是迁移的理由。创始人 Avi Press 坦承 Haskell 在很大程度上兑现了可靠性、类型安全和性能的承诺,但决定性的成本是编译时间和生态系统的摩擦。在多个 AI 智能体并行探索各自分支的开发方式下,冷构建的等待时间从一点小小的不便,变成了最大的成本。本文梳理了一个团队离开一门仍然尊重的语言的真正原因,以及语言的适合度会随时代与开发方式而改变这
2026-07-11 · 13 分钟阅读 #haskell#python#engineering-decisions#compile-times#ai-assisted-development想得更多不等于答得更对:测试时计算与过度思考
2026年4月,Shu Zhou 等6人在 "When More Thinking Hurts" 中,对一味增加推理 token 的潮流正面提出质疑。据作者们报告,计算预算越大,额外推理 token 的边际效用就下降得越多,而从某个点开始,模型会陷入"过度思考",亲手推翻自己此前已经答对的答案。最优思考长度因问题难度而各不相同,因此给所有问题相同预算的做法并不高效。摘要并未给出具体的模型名称或数值,所以我只谨慎地带回方向性。
2026-07-11 · 10 分钟阅读 #ai#llm#reasoning#inference#test-time-computeLLM 倦怠 — 当工作从"创造"变为"审阅"
开发者 Alec Scollon 的随笔《I Think I Have LLM Burnout》在 Hacker News 上引发热议。因为它精准地道出了这样一种感受:一天的工作从"编写"代码,悄然变成了"审阅"模型写出的东西。本文忠实地梳理他的观点,并补上一份平衡的视角。生成变便宜了,验证却没有,审阅 AI 的输出是实实在在的认知劳动。工具在样板代码和陌生领域里能显出价值,但疲惫来自同样错误的反复、频繁的上下文切换,以及"把一切都塞进
2026-07-11 · 10 分钟阅读 #llm#developer-experience#burnout#ai-tooling#code-review重返终端的创业者 — Hashimoto 的 Ghostty、Zig 这场豪赌,以及“没有义务”的开源
HashiCorp 联合创始人 Mitchell Hashimoto 从成功创业者的位置上再次走下来,用还不到 1.0 的语言 Zig 打造终端模拟器 Ghostty,本文以最近的一次采访为依据梳理他这样做的理由。他坦言自己做了 15 年 CLI,却并不了解终端内部是如何运作的,为了重新磨砺已经变钝的技术手感,他向下钻进了 GPU、桌面和 Zig。Zig 在 0.15 中把输出接口几乎整个改掉,至今仍不稳定,但他反而欢迎这种破坏性变更。
2026-07-11 · 11 分钟阅读 #ghostty#zig#open-source#terminal#mitchell-hashimoto扩散 LLM 会写 CUDA 内核 — DICE,以及并行生成为何可能有效
DICE 是 2026 年 2 月的一篇预印本,它主张扩散(diffusion)大语言模型在 CUDA 内核生成上超越了同规模的自回归(autoregressive)模型,创下了新的最高性能(SOTA)。核心思路是:与其把 token 从左到右逐个写出,不如并行生成整个序列,并可以在任意位置非顺序地改写 — 这一性质似乎很适合全局结构至关重要的代码任务。作者用一个名为 CuKe 的 SFT 数据集和两阶段强化学习(BiC-RL)训练了
2026-07-11 · 10 分钟阅读 #ai#llm#diffusion#cuda#gpu苹果起诉了OpenAI — 人才流动与商业秘密法,开发者该如何解读
2026年7月10日,苹果将OpenAI、两名前员工以及OpenAI的硬件子公司io Products诉至加利福尼亚北区联邦地区法院。核心是商业秘密的不正当使用与违约。本文先把苹果所"主张"的内容作为主张明确区分开来,再从开发者的视角剖析这场诉讼真正的争点 — 由于加州的竞业禁止协议无效,商业秘密法几乎是规范人才流动的唯一杠杆。这还只是第一手棋,已确认的报道中既没有OpenAI的公开反驳,也没有法院的判断。
2026-07-11 · 10 分钟阅读 #openai#apple#trade-secrets#legal#industry用 Rust 编写 Kubernetes GPU Operator — 用 kube-rs 诊断真实集群
面对一个 8 节点的实际运行家庭实验室集群(k8s v1.32.5),我用 kube-rs 亲手用 Rust 写了一个 GPU Operator 并跑了起来。我定义了 GpuInventory 自定义资源,并把两个控制器(节点扫描→记录 CR 状态、节点监视→更新 ConfigMap)打包进一个二进制,从集群外部运行。然后是 Operator 真正吐出的结果 — 4 个 GPU 节点中 Ready 为 0 个,也就是整支 GPU 舰队都
2026-07-11 · 8 分钟阅读 #rust#kubernetes#operator#gpu#kube-rs生产级 RAG 模式 — 朴素 RAG 为何失败,以及真正管用的技法
演示版 RAG 半小时就能做出来,但在生产环境中悄然崩坏的地方,大多不是生成,而是检索。本文把分块、嵌入与混合检索(BM25 + 向量)、重排序、上下文检索、查询改写以及评估逐一梳理,讲清每一项各自是什么、何时有用、又要付出什么代价。只引用像 Anthropic 上下文检索数值那样有出处的数字,并坦率地指出 RAG 并非魔法、最终终究要用自己的数据来评估。
2026-07-11 · 15 分钟阅读 #ai#rag#llm#retrieval#embeddings在 AI 编程模型评测中分辨信号与噪声 — SWE-bench 为何开始动摇
OpenAI 评测团队指出,最广泛使用的编程基准 SWE-bench Verified 因为污染和设计缺陷,已经无法再给出有意义的信号。用信号(区分模型的能力)和噪声(每次运行都会摇摆的变动)这两个维度重新审视,就会发现排行榜上相当一部分名次其实站在噪声之上。本文梳理污染、测试框架差异、无法评分的任务与过拟合是如何把分数抬高的,并结合 eval-first 原则,说明团队在挑选编程助手时为何应当用自己的任务、而非排行榜来评测。
2026-07-11 · 10 分钟阅读 #llm-evaluation#coding-benchmarks#swe-bench#benchmarks#ai-codingForward Deployed Engineer(FDE)备战 — 你需要掌握的软件知识地图
Forward Deployed Engineer(FDE)是 Palantir 创造的职位,工程师直接进驻客户公司,把产品部署、集成到他们的真实环境中。最近 OpenAI、Anthropic 这类 AI 公司为了把自家模型搭载到客户基础设施上,大量招聘这一职位,让它重新受到关注。本文写给准备做 FDE 的人,梳理了这个角色的真实面貌(基于真实资料),以及真正重要的软件知识 — Linux、网络、容器/Kubernetes、数据库、AP
2026-07-11 · 10 分钟阅读 #career#fde#software-engineering#palantir#solutions-engineering用 Keycloak 搭建 SSO — 从 Realm、Client、登录流程到 2026 年新功能
与其给 20 个内部应用分别接上登录功能,不如让一台身份服务器代替所有应用完成这件事,这就是 SSO。本文用 Realm、Client、Role、Identity Provider 这四个核心概念来理解开源标准 Keycloak,一步步走完 OIDC Authorization Code + PKCE 登录流程,梳理 Quarkus 发行版 build/start 两阶段模型、hostname v2 等生产环境陷阱,并从实战角度整理 2
2026-07-09 · 13 分钟阅读 #keycloak#sso#oidc#security#devops自动化的三个部族 — Zapier·Make·n8n、RPA,以及 2026 年的智能体化自动化
面对「帮我自动化这个」这句话,人们常常拿错工具。因为自动化其实分属三个互不相同的部族 — 连接 API 的工作流自动化(Zapier·Make·n8n)、在没有 API 的画面上像人一样操作的 RPA(UiPath·Power Automate),以及连判断都能代劳的 AI 智能体。本文梳理各部族的真面目与 2026 年的格局(计费模型的陷阱、n8n 2.0 的 AI 节点、Zapier Agents、38 亿美元 RPA 市场的智能体
2026-07-09 · 10 分钟阅读 #automation#rpa#zapier#n8n#ai-agents