タグ: #garak
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 2 件
AI 安全 / 評価 / レッドチーミング 2026 — Inspect AI / Garak / PyRIT / Promptfoo / OpenAI Evals / lm-eval-harness 深掘りガイド
2026年のAI安全・評価・レッドチーミング エコシステムを1枚にまとめる。Inspect AI(Anthropic、UK AISI採用)、Garak(NVIDIA→独立)、PyRIT(Microsoft)、Promptfoo(YC)、OpenAI Evals、lm-evaluation-harness(EleutherAI)、そして MLflow Evals・Arize Phoenix・DeepEval(Confident AI)・G
2026-05-16 · 31 分で読めます #ai-safety#red-teaming#evaluation#inspect-ai#garakLLMセキュリティ完全ガイド: Prompt Injection、Jailbreak、Red Team、OWASP LLM Top 10、EU AI Act (2025)
2024–2025年、LLMプロダクトの失敗要因TOP3には必ず「セキュリティ事故」が入る。Prompt injectionの12変種、Jailbreak手法、Data exfiltration、Model extraction、Red teamの自動化(PyRIT/Garak)、OWASP LLM Top 10、EU AI Actと韓国の規制、そしてガードレール設計まで。「デフォルトで安全なLLMプロダクト」の作り方。
2026-04-15 · 17 分で読めます #llm-security#prompt-injection#jailbreak#red-team#owasp-llm