博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 829 篇
#2026-03 168#ai 110#llm 90#ai-papers 62#career 60#kubernetes 54#mindset 51#ai-platform 48#devops 42#security 41#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#database 23#linux 22#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#rag 16#fundamentals 15#network 15#postgresql 15#2026-08 14
实践斯多葛主义 — 古老的人生智慧为何至今依然奏效
斯多葛主义是公元前300年前后诞生于雅典的哲学,但它的核心工具与今天的焦虑竟出奇地契合。本文依据爱比克泰德、塞内卡、马可·奥勒留的实际文本,梳理控制的二分法(取决于我的与不取决于我的)、专注过程而非结果、预先设想最坏情况(premeditatio malorum)、自愿的不适、记住终有一死等实践。同时也点明诚实的局限 — 斯多葛主义不是压抑情绪,不是万灵药,也不是心理健康治疗的替代品。这不是自我提升的口号,而是每天都能一点点用起来的工具
2026-07-11 · 13 分钟阅读 #philosophy#stoicism#self-improvement#life-adviceTencent Hy3:冷静解读 295B 开放权重 MoE
Tencent 于 2026 年 7 月 6 日以 Apache 2.0 许可证公开了 Hy3。这是一个总参数 295B、每次仅激活 21B 的 MoE 推理·智能体语言模型。本文梳理它到底有什么新意、在中国系开放权重浪潮中处于什么位置,以及厂商自行公布的基准测试数字应当相信到什么程度。
2026-07-11 · 8 分钟阅读 #hy3#tencent#hunyuan#open-weights#moeVO2 max 与寿命 — 122,007 人真正告诉我们的事
心肺适能(VO2 max)是与寿命关联最强的指标之一。在克利夫兰诊所追踪 122,007 名成年人的 2018 年研究中,适能越高,死亡风险越低,而且这种益处没有观察到上限。不过这是相关而非因果,也不是针对个人的医学建议。本文不加夸张地梳理 VO2 max 究竟测量什么、为什么在 Zone 2 的基础上加一点高强度就能提升它,以及这些数据我们该相信到什么程度。
2026-07-11 · 11 分钟阅读 #fitness#health#longevity#vo2max#scienceRLHF 模型为何会钻奖励的空子——奖励破解的机制、症状与缓解方向
Xiaohua Wang 等 23 人于 2026 年 4 月发布在 arXiv 上的《Reward Hacking in the Era of Large Models》,是一篇梳理经 RLHF 对齐的大型模型为何、如何在奖励信号上钻空子的综述。核心提议是把奖励破解理解为目标压缩、优化放大、评估者–策略共同进化这三种力量的"代理压缩假说(PCH)"。它把可辨认的症状汇于一处:冗长偏好、谄媚、看似有理却错误的依据、基准过拟合,以及多模态
2026-07-11 · 9 分钟阅读 #ai#llm#alignment#rlhf#safety特斯拉 FSD v14 Lite 登陆韩国 — 把模型"蒸馏"进旧款 HW3,以及"监督型"这个诚实的名字
2026 年 7 月 10 日,特斯拉韩国开始在国内推送 FSD(监督型)v14 Lite。对象仅限美产 Model 3、Model Y 中搭载旧款 HW3 计算机的车辆。本文梳理:"Lite" 并非营销等级,而是把面向上位 HW4 的模型蒸馏进旧硬件的结果;韩国为何比加拿大、欧洲更早拿到,这一点为何耐人寻味;以及与名字相反,这依然是由驾驶员负责的 Level 2 辅助这一诚实现实。不夸张,只为准确地使用"自动驾驶"这个词。
2026-07-11 · 10 分钟阅读 #tesla#fsd#autonomous-driving#adas#hw3npm 供应链攻击为何挥之不去 — npm-scan 实际做的事,以及真正有效的防御
npm 生态系统的供应链攻击不是偶发的意外,而是从安装脚本、传递依赖、typosquatting 这些结构中反复冒出来的。2025 年的 Shai-Hulud 蠕虫借助安装脚本自我繁殖,窃取 npm 令牌和云端密钥。最近在 Hacker News 上引发热议的 npm-scan,声称要用本地的静态与行为分析来抓住这个问题。本文以 README 为依据,厘清 npm-scan 究竟检查什么、又无法验证什么,并梳理锁文件、拦截安装脚本、pr
2026-07-11 · 12 分钟阅读 #npm#supply-chain#security#javascript#nodejs成功的公司是如何失明的 — 工程组织的能力失明
Ian Reppel 的文章指出,成功的公司会陷入他所称的"能力失明(competence blindness)"状态。就像墨西哥洞穴鱼主动抑制自己的眼睛一样,由于环境不再给予回报,公司也不再表现出那种细致的工程能力。这不是单纯的放任,而是主动的抑制,也与经典的颠覆式创新不同。本文先忠实地转述这一主张,再看它如何在工程组织中显现:无人敢质疑的遗留系统、现实在腐烂时却依然一片绿色的仪表盘,以及像瘢痕组织一样僵化的流程。
2026-07-11 · 14 分钟阅读 #engineering-culture#organizations#legacy#metrics#leadership在浏览器标签页里组装并运转一台发动机 — 拆解 Combustion Lab
Combustion Lab(combustionlab.net)是一款无需安装、在浏览器标签页里组装内燃机并按曲轴转角来运转的模拟器。它把进气、压缩、燃烧、排气四个冲程用 P–V 曲线和测功图呈现出来。本文梳理单区热力学模型能捕捉什么、又捕捉不到什么,以及为什么把实时物理放到浏览器里运行会成为一个很好的学习工具。
2026-07-11 · 10 分钟阅读 #simulation#thermodynamics#webassembly#physics#engine力量训练的基本功 — 基于证据,真正重要的那几件事
真正让人变强所需的原则其实屈指可数 — 渐进超负荷、大的复合动作、足够的训练量、蛋白质、恢复。本文依托经过同行评审的荟萃分析与权威指南(ACSM、WHO,以及 Morton、Schoenfeld、Refalo 等人的研究),只把这些核心提炼出来。对局部减脂、“肌肉混淆”、“女性练力量就会变壮”之类常见的误区,也用证据加以厘清,并附上初学者今天就能上手的简单框架与安全须知。本文志在成为一份不搞营销、也不讲“兄弟科学”的朴实参考。
2026-07-11 · 10 分钟阅读 #fitness#strength-training#health#exercise#evidence-basedModel Context Protocol(MCP)参考手册 — 将 AI 连接到外部世界的开放标准
Model Context Protocol(MCP)是一个把应用向 LLM 提供上下文的方式标准化的开放协议。本文是一份基于官方文档、面向工程师的 MCP 参考 — 为什么它能解决 M×N 集成问题,主机、客户端、服务器结构与两个层(数据/传输),三种服务器原语(工具、资源、提示),stdio 与 Streamable HTTP 传输。还涵盖了如何设计服务器,以及安全性、成熟度上诚实的取舍。
2026-07-11 · 10 分钟阅读 #mcp#ai#agents#llm#protocol爬虫如今来自数百万个家庭 IP — residential proxy 与开源基础设施的消耗战
2026年7月10日,LWN 的 Jonathan Corbet 发布了一篇爬虫现状的更新。核心有两点 — residential proxy(家庭代理)几乎让基于 IP 的封禁彻底失效,而 AI 爬虫的激增填满了这份需求。在一次攻击中,数小时内数百万个不同的 IP 各自只敲击站点两三次。本文诚实地梳理为什么封禁在结构上注定失败、开源 git 仓库为什么最先中招(以及 Anubis 为什么在那里诞生),以及工作量证明、CAPTCHA、数
2026-07-11 · 10 分钟阅读 #web-scraping#residential-proxy#ai-crawlers#anubis#infrastructureRTX 5090 单卡亲手跑几个小模型 — microGPT·OCR·音乐生成
用一张 RTX 5090(Blackwell,32GB),通过 SSH 连上去直接跑了三个小模型。从零开始用 28 秒训练出一个 char-level GPT(10.75M 参数,117 万 tokens/s),把专用 OCR(TrOCR)和小型 VLM(Qwen2-VL-2B)放到同一张图上用 CER 一决高下,再用 MusicGen 在 1.9 秒(实时的 4.2 倍)里生成一段 8 秒的音乐。连同过程中遇到的那些诚实的陷阱 — 没
2026-07-11 · 10 分钟阅读 #pytorch#gpu#llm#ocr#hands-onPlayStation 三年未使用账户删除条款:服务条款实际规定了什么,以及数字所有权问题
2026年7月,"PlayStation 三年不登录就会删除你的全部数字游戏(EU 条款)"这一标题引发热议。实际读一读索尼的欧洲和英国服务条款第21条便会发现,这并不是挑出游戏来删除,而是一条"36个月未使用的账户可在6个月警告后关闭"的裁量条款;它自2019年就已存在,且未确认到实际的执行案例。本文冷静地梳理服务条款字面上规定了什么、这个标题真正指向的"数字购买不是所有权,而是可撤销的许可"这一问题,以及消费者权利与游戏保存一方的应
2026-07-11 · 12 分钟阅读 #digital-ownership#playstation#drm#consumer-rights#licensingRust 1.97.0 发布了 — 我正好在用那个 cargo 构建 Kubernetes Operator
Rust 1.97.0 于 2026 年 7 月 9 日作为 stable 发布。本文梳理发布说明里真正变了的三件事 — v0 符号修饰(symbol mangling)晋升为 stable、Cargo 的警告拒绝(deny warnings)、以及此前一直被隐藏的链接器输出默认显示 — 并与几天前我正好用那个 cargo 1.97 构建 Kubernetes GPU Operator 的实测经验相互对照。一个诚实的结论:写 Opera
2026-07-11 · 7 分钟阅读 #rust#rust-1.97#release-notes#cargo#kube-rs习惯不是21天养成的:用66天研究重新解读微习惯
“习惯只要21天就能养成”这一说法并非来自实验,而是源于1960年代一位整形外科医生临床观察的误解。真正追踪日常行为的2010年 Lally 研究报告称,达到自动化所需时间的中位数为66天,个体差异从18天到254天不等。本文把这种变动性视为核心发现,探讨2026年“微习惯”趋势为何与这份数据高度契合。从习惯叠加、信号设计,到隔一天也不会崩溃的设计,全部基于研究依据加以梳理。
2026-07-11 · 10 分钟阅读 #self-improvement#habits#psychology#productivity#behavior-change梅尔·布鲁克斯,99岁的男人 — 一部致敬老牌艺人的纪录片为何领跑2026年艾美奖
值此梅尔·布鲁克斯100岁生日之际,一部讲述其人生的两部曲HBO纪录片以6项提名领跑2026年艾美奖非虚构类。同一年,回顾约翰·坎迪、马丁·肖特、马丁·斯科塞斯的追忆纪录片也一并入围。为什么流媒体和观众会涌向这种以虔敬姿态记录老一辈艺术家的形式?在致敬与宣传之间,本文审视这一类型必须承担的诚实之重。
2026-07-11 · 9 分钟阅读 #film#documentary#comedy#culture#legacyQuadRF 与软件定义无线电 — "隔墙看见 WiFi" 的真正含义
Jeff Geerling 介绍的 QuadRF 是在 Raspberry Pi 5 上搭载 4×4 MIMO 软件定义无线电与相控阵天线的开发套件。"隔墙看见 WiFi" 这个耸动的标题并非 X 光透视,而是指为本就穿墙而过的 RF 信号求出方向,并以每秒 30 帧的速度叠加到摄像头画面上。本文梳理 SDR 是什么、QuadRF 实际能做什么又不能做什么,以及相控阵下探到爱好者的价位为何既令人兴奋又需要几分谨慎。
2026-07-11 · 9 分钟阅读 #sdr#rf#radio#raspberry-pi#hardwarepgrust: 用 Rust 重写 Postgres 并 100% 通过回归测试 — 它真正意味着什么
Malcolm Matis(malisper)公开了用 Rust 重写 Postgres 的 pgrust。它以兼容 Postgres 18.3 为目标,通过了四万六千多个回归测试查询,并能在真实的 18.3 数据目录上启动。本文诚实地剖析这个里程碑为何真的令人印象深刻,以及"100% 通过回归测试"这句话证明了什么、又没有证明什么。我们还会一并审视用 AI 智能体写出的代码、性能主张,以及它距离生产级 Postgres 还有多远。
2026-07-11 · 10 分钟阅读 #postgresql#rust#pgrust#database#regression-testsK-pop为何看起来比第7大市场的体量更大:用IFPI 2026解读音乐经济
根据IFPI《全球音乐报告2026》,2025年全球录制音乐市场收入达317亿美元,同比增长6.4%,实现连续11年增长,并首次突破300亿美元。在这张榜单中,韩国是全球第7大市场。然而K-pop所展现的存在感,看起来远比"第7"这个数字更大。本文基于IFPI的数据,梳理市场排名究竟衡量了什么、又没有衡量什么,流媒体与实体唱片之间微妙的平衡,以及以两位数增长的亚洲对整个行业意味着什么。我们剔除无法证实的说法,只谈可以验证的事实。
2026-07-11 · 9 分钟阅读 #kpop#music-industry#business#korea#streaming用 Hybrid SWA 优化长上下文推理 — Xiaomi MiMo v2.5 实际做了什么
把滑动窗口注意力(SWA)与全注意力按层混合的混合 SWA,是最近同时削减长上下文推理 KV 缓存内存与计算量的主流设计。本文以 Xiaomi 公开的 MiMo v2.5 推理优化文章为依据,梳理混合 SWA 是什么、为什么重要,MiMo v2.5 实际做了哪些架构与系统工程(70 层中仅 10 层全注意力、窗口 128、理论上约 7 倍削减),以及诚实地看它缺了什么。结论是与上一篇量子化文章相同的战场 — KV 缓存 — 只是从另一个
2026-07-11 · 13 分钟阅读 #ai#llm#inference#attention#optimization