标签: #testing
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 4 篇
Bun 把 Zig 重写成 Rust 的 11 天 — AI 大规模迁移里真正能带走的东西
本文用一手资料追踪 Bun 在 11 天内把 53.5 万行 Zig 代码迁到 Rust 的整个过程。2026 年 5 月 3 日到 14 日,动用了最多 64 个 Claude 实例、约 50 条工作流、6,502 个提交,按 API 标价折算约 16.5 万美元。本文关心的不是 11 天这个数字,而是让这个数字得以成立的条件 — 一套与语言无关的测试套件充当预言机、文件对文件一一对应的结构保持式翻译,以及编译器这第二位裁判。文章把
2026-07-31 · 19 分钟阅读 #ai#bun#rust#migration#testing用 AI 搬迁代码库的实战流程 — 先把裁判立起来,测评审率而不是行数
本文从 2026 年上半年公开的大规模 LLM 迁移案例(53 万 5 千行 Zig 转 Rust、16 万 5 千行 Python 转 TypeScript)中抽出共同的流程,整理成一份可执行的顺序。关键在于顺序 — 在开始翻译之前先立起行为预言机,并且先确认这台预言机在被故意改坏的代码上真的会亮红灯。然后沿可验证的边界切分成队列,把完成判定交给磁盘状态,让每一步都保持可回退。要测的指标不是转换了多少行,而是人真正读过的差分比例,以及
2026-07-31 · 19 分钟阅读 #ai#migration#refactoring#testing#engineeringRust 标准库验证行动找到的内存安全漏洞是 0 个
由 AWS 和 Rust 基金会主导的 verify-rust-std 行动的成果论文,发表在 2026 年 NASA Formal Methods Symposium 上。作者们称之为"针对某个软件库所报告过的最大规模验证行动",这项工作生成了 16,748 个自动生成的证明工具(harness),其中 11,970 个通过,但在标准库中没有找到任何一个此前未知的内存安全漏洞。论文没有隐藏这个空结果,而是把它直接写进第 4.4 节的标
2026-07-16 · 42 分钟阅读 #formal-methods#rust#verification#memory-safety#testing确定性模拟测试找到的那个 bug — KAFKA-19880,以及该怎么读「零 bug」
确定性模拟测试(DST)把时钟、线程交错、随机数这些非确定性会渗入的来源,全部关进模拟器里,让那些原本无法复现的 heisenbug 可以靠一个种子重新召唤出来。2026 年 3 月,Aiven 把 Kafka 的 Diskless Topics 实现放进 Antithesis 里,跑了大约 2,200 个逻辑小时,结果是零 bug。真正的 bug 却出自对照组 — 他们为了验证而跑的上游 Apache Kafka 原版代码,跑出了 K
2026-07-16 · 26 分钟阅读 #testing#deterministic-simulation-testing#distributed-systems#kafka#antithesis