태그: #pyrit
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 2 편
AI 안전 / 평가 / 레드티밍 2026 — Inspect AI / Garak / PyRIT / Promptfoo / OpenAI Evals / lm-eval-harness 심층 가이드
2026년의 AI 안전·평가·레드티밍 생태계를 한 장에 모은다. Inspect AI(Anthropic, UK AISI 채택)·Garak(NVIDIA→독립)·PyRIT(Microsoft)·Promptfoo(YC)·OpenAI Evals·lm-evaluation-harness(EleutherAI), 그리고 MLflow Evals·Arize Phoenix·DeepEval(Confident AI)·
2026-05-16 · 35 분 읽기 #ai-safety#red-teaming#evaluation#inspect-ai#garakLLM 보안 완전 가이드: Prompt Injection, Jailbreak, Red Team, OWASP LLM Top 10, EU AI Act (2025)
2024–2025년 LLM 제품의 실패 원인 TOP3 안에 항상 "보안 사고"가 들어간다. Prompt injection 12변종, Jailbreak 기법, Data exfiltration, Model extraction, Red team 자동화(PyRIT/Garak), OWASP LLM Top 10, EU AI Act와 한국 규제, 그리고 가드레일 설계까지. "기본값으로 안전한 LLM 제품
2026-04-15 · 17 분 읽기 #llm-security#prompt-injection#jailbreak#red-team#owasp-llm