タグ: #testing
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 21 件
検証の設計 — テストを合否ではなく信頼の根拠として見る
テストが緑だという事実それ自体は何も語りません。何を心配しなくてよいかが決まって初めて、緑に意味が生まれます。この記事はテストを合否ではなく信頼の根拠として扱う方法を扱います。各テストに信頼の一文を付ける練習、カバレッジが実際に測るものと測れないものの違い、検証しないと決めたものを明示的に書くべき理由、そして正解表のない領域で判定そのものを設計する方法まで整理しました。高いまま残る技術シリーズの第4回です。
2026-08-15 · 12 分で読めます #career#skills#testing#verification#craftテスト戦略 完全ガイド: ピラミッド論争ではなく判断基準
テストピラミッドとテスティングトロフィーのどちらが正しいかを選ぶのではなく、その論争を実際の軸に分解して、チームが自分の比率を自分で決める方法を整理します。単位の定義、コスト関数、モックの使用範囲、カバレッジの数字、欠陥分布のデータ、遅く壊れやすいテストの運用規則までを判断基準中心に扱います。
2026-08-15 · 41 分で読めます #테스트#아키텍처#testing#test-pyramid#coverage並行性 完全ガイド: 共有状態を減らしていく順序
アプリケーション設計者が並行性の問題に向き合うときに踏む作業順序を整理します。まず共有状態を消せるかを確認し、消せなければ範囲を狭め、残ったものに原子性境界とロックをかけ、プロセスの外に出たらトランザクションと冪等性で守り、最後にテストで確認します。概念の区別でもインフラ比較でもなく、コードを書く人の意思決定順序に焦点を当てます。
2026-08-15 · 43 分で読めます #동시성#아키텍처#concurrency#locking#backpressureBunのZigからRustへの書き換え11日間 — AI大規模マイグレーションで実際に持ち帰れるもの
Bunが53万5千行のZigコードを11日でRustへ移した過程を一次ソースで追いかけます。2026年5月3日から14日まで、最大64個のClaudeインスタンス、約50個のワークフロー、6,502個のコミット、API定価換算で約16万5千ドルがかかりました。この記事が関心を持つのは11日という数字ではなく、その数字を成立させた条件です — 言語に依存しないテストスイートというオラクル、ファイル対ファイルで対応する構造保存の翻訳、そして
2026-07-31 · 24 分で読めます #ai#bun#rust#migration#testingAIでコードベースを移す実践手順 — 審判を先に立て、行数ではなくレビュー率を測る
2026年上半期に公開された大規模LLMマイグレーションの事例(53万5千行のZigからRustへ、16万5千行のPythonからTypeScriptへ)から共通の手順を抜き出し、実行可能な順序に整理します。核心は順序です — 翻訳を始める前に振る舞いのオラクルを立て、わざと壊したコードでそのオラクルが落ちるかどうかをまず確認します。そのうえで検証可能な境界で切ってキューを作り、完了判定をディスクの状態に任せてすべての工程を元に戻せるよ
2026-07-31 · 23 分で読めます #ai#migration#refactoring#testing#engineeringRust標準ライブラリ検証キャンペーンが見つけたメモリ安全性バグは0件だった
AWSとRust Foundationが主導したverify-rust-stdキャンペーンの結果論文が、2026年のNASA Formal Methods Symposiumに掲載されました。著者たちが「ソフトウェアライブラリを対象に報告された中で最大の検証キャンペーン」と呼ぶこの取り組みは、自動生成ハーネス16,748件を作り11,970件を通過させましたが、標準ライブラリにおいて未知のメモリ安全性の脆弱性は一つも見つかりませんでした
2026-07-16 · 47 分で読めます #formal-methods#rust#verification#memory-safety#testing決定論的シミュレーションテストが見つけたバグ — KAFKA-19880、そして「バグ0件」の読み方
決定論的シミュレーションテスト(DST)は、クロック、スレッドのインターリーブ、乱数のように非決定性が入り込む出所をシミュレータの中に閉じ込め、再現できなかったheisenbugを一つのシードで呼び戻せるようにする技法です。2026年3月、AivenはKafkaのDiskless Topics実装をAntithesisにかけて約2,200論理時間動かし、結果はバグ0件でした。ところが実際のバグは対照群から出てきました — 検証のために動
2026-07-16 · 32 分で読めます #testing#deterministic-simulation-testing#distributed-systems#kafka#antithesisOperator のテストと配布 — envtest・e2e・OLM・バンドルパッケージング
Kubernetes Operator を安全にテストして配布する方法を解説します。テストピラミッド(unit reconcile・envtest・e2e)から OLM の CSV・バンドル・カタログ、アップグレードグラフ、最小権限 RBAC、マルチテナントのインストールモード、本番チェックリストまでコードとともに整理します。
2026-06-15 · 23 分で読めます #kubernetes#operator#testing#envtest#olmプロパティベーステスト実践 — 例示テストが捕まえられないバグを捕まえる方法
例示ベースのテストが見逃すバグを捕まえるプロパティベーステスト(PBT)を実践中心に整理します。プロパティ/ジェネレーター/シュリンキングの核心概念、プロパティ発見のパターンカタログ、Python HypothesisとJava jqwikとJS fast-checkの動作例、ステートマシンテスト、CI統合、AIが書いたコードの検証とのシナジーまで扱います。
2026-06-12 · 27 分で読めます #testing#property-based-testing#hypothesis#jqwik#fast-checkOSSメンテナーとAIコントリビューションの衝突 — jqwik事件が投げかけた問い
JVMのプロパティベーステストエンジンjqwikのメンテナーによる反AI措置が、2026年6月のHNとGeekNewsを沸かせました。AIコントリビューションがメンテナーに課す非対称な負担、curlなど他プロジェクトのポリシー事例、AI貢献ポリシーのスペクトラムとCONTRIBUTING.mdテンプレート、コントリビューターのエチケットまでバランスよく整理します。
2026-06-12 · 30 分で読めます #opensource#ai#maintainer#contribution-policy#communityフロントエンドテスト 2026 — Playwright / Cypress / Vitest / Jest / Storybook 9 / Chromatic 徹底比較
2026年5月、フロントエンドテストの地形は完全に変わった。Playwrightは事実上の標準(VS Code統合、Trace Viewer、Component Testingの成熟)、Cypress 14は依然強力だがシェアを落としつつある。Vitest 3はViteと共に来る最速ユニットランナー、Jest 30はレガシーとNext互換の最後の砦。Testing Libraryの哲学はもはや推奨ではなく義務。Storybook 9(2
2026-05-16 · 34 分で読めます #testing#frontend#playwright#cypress#vitestレガシーコードと向き合う — 怖くて古い、テストのないコードを恐れずに変える方法
レガシーコードとは、テストがないコードであり、触るのが怖いコードだ。そして誰もがいつかそれを引き継ぐ。安全に変えるにはテストが要るが、テストを足すにはコードを変える必要があるというジレンマ、現在の振る舞いが bug でもそれを固定する characterization test、書き直さずにテストを差し込む seam、sprout と wrap、strangler fig パターン、そして AI agent がここでどう助けどう壊すかま
2026-05-14 · 46 分で読めます #legacy-code#refactoring#characterization-tests#strangler-fig#technical-debtAIが書いたコードをレビューする方法: エージェント出力のための検証規律と『AIスロップ』のフィルタリング
AIがコードを書く時代、ボトルネックはレビューに移った。人間のPRをレビューすることとエージェント出力をレビューすることは別のスキルだ。AIコードが特有に間違える方法、ハルシネーションAPIや意味のないテストをフィルタする検証ループ、型からテストから人間へという順序、『AIスロップ』の正体とフィルタリングまで — コピーして使えるチェックリストとともに整理する。
2026-05-14 · 35 分で読めます #code-review#ai-generated-code#verification#ai-slop#qualityagent 評価システム 2026 — Inspect AI・Promptfoo・Phoenix・LangSmith・OpenAI Evals 徹底比較(モデルではなく agent を測る)
LLM 評価はモデルを測る。agent 評価はモデル + harness + tool が作業を最後まで完遂するかを測る。これは別の問題だ。2026 年現在の agent 評価フレームワークの地図を描く — UK AISI の Inspect AI(事実上の gold standard 化)、Promptfoo(OSS CLI)、Arize Phoenix(OSS observability + eval)、LangSmith(Lang
2026-05-14 · 29 分で読めます #agent-evaluation#inspect-ai#promptfoo#phoenix#langsmithフロントエンドテスト 2025 — Vitest·Jest·Bun·Testing Library·Playwright·Storybook·MSW·ビジュアル回帰·AI (シーズン6 第11回)
Jestはもうデフォルトではない。VitestがユニットテストレースをNり、PlaywrightがCypressをe2eで置換、Storybook 8がコンポーネントテストを第一級に、AI生成テストが標準になった。2026年のフロントエンドテストピラミッドを、メンテナンス地獄にならずにグリーンを保って組み立てる実戦ガイド。
2026-04-15 · 8 分で読めます #frontend#testing#vitest#jest#bun-testソフトウェアテスト戦略完全ガイド — ユニットテストからカオスエンジニアリングまで
テストピラミッド、TDD、BDD、ユニット/統合/E2Eテスト、パフォーマンステスト、カオスエンジニアリングまで。ソフトウェア品質を保証するすべてのテスト戦略。
2026-04-12 · 25 分で読めます #devops#testing#unit-test#integration#e2eソフトウェアテスト戦略完全ガイド2025:ユニット/統合/E2E、TDD、テストピラミッド
テスト戦略の全て!テストピラミッド(ユニット/統合/E2E)、TDD/BDD、Jest/Vitest(フロントエンド)、Pytest/JUnit(バックエンド)、Playwright/Cypress(E2E)、モック戦略、テストカバレッジ、CI統合、パフォーマンス/セキュリティテスト。
2026-03-25 · 29 分で読めます #testing#unit-test#integration-test#e2e#tddソフトウェアテスト完全ガイド2025:TDD、単体/統合/E2Eテスト、CI/CD自動化まで
ソフトウェアテストのすべて!テストピラミッド、TDD実践、単体テスト(Jest/pytest/JUnit)、統合テスト(Testcontainers)、E2E(Playwright/Cypress)、性能テスト(k6)、モッキング戦略、コードカバレッジ、CI/CD自動化まで。
2026-03-23 · 29 分で読めます #testing#tdd#unit-test#integration-test#e2eCI/CDベストプラクティス2025:チームのためのパイプライン設計、自動化、セキュリティまで
CI/CDパイプラインの全て!GitHub Actions vs Jenkins vs GitLab CI比較、パイプライン設計原則、テスト自動化、Dockerビルド最適化、GitOps(ArgoCD)、シークレット管理、DORAメトリクス、ロールバック戦略まで。
2026-03-23 · 40 分で読めます #ci-cd#devops#github-actions#jenkins#argocd[DevOps] StubとMockingサーバー完全ガイド:概念から実践まで
StubとMockの概念の違い、主要なMockingツール(WireMock、MockServer、json-server、Prism)の比較、実践的な設定およびCI/CD統合方法を総まとめします。
2026-03-20 · 14 分で読めます #devops#testing#mocking#stub#wiremock