タグ: #aisi
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 3 件
プライバシー & AI 規制 2026 — GDPR / EU AI Act(2026.8 全面施行)/ DSA / DMA / PIPA / APPI / NIST AI RMF / ISO 42001 ディープダイブ
2026年5月、プライバシー・AI 規制は5陣営に分かれた。EU は GDPR(2018)の上に EU AI Act(2024.8 発効、2025.2 禁止、2026.8 全面施行)、DSA・DMA・Data Act・Cyber Resilience Act を積み上げた。米国は連邦の包括法がないまま、8つの州が包括プライバシー法を運用し、IL BIPA が生体情報の別戦線を形成する。韓国 PIPA は 2024 改正で仮名情報・MyD
2026-05-16 · 42 分で読めます #privacy#ai-regulation#gdpr#eu-ai-act#dsaAI 安全 & アライメント 2026 完全ガイド - Constitutional AI · RLHF · DPO · GRPO · Mechanistic Interpretability · AISI Evals · Red Team 徹底解説
2026年のAI安全とアライメントの全体地形を一気に整理する。outer/inner アライメントや mesa-optimization といった概念的基盤から、RLHF・DPO・GRPO・Constitutional AI に至る学習時アライメント手法、Anthropic RSP や OpenAI Preparedness Framework、Google DeepMind Frontier Safety Framework といった
2026-05-16 · 30 分で読めます #ai-safety#ai-alignment#constitutional-ai#rlhf#dpoAI 安全 / 評価 / レッドチーミング 2026 — Inspect AI / Garak / PyRIT / Promptfoo / OpenAI Evals / lm-eval-harness 深掘りガイド
2026年のAI安全・評価・レッドチーミング エコシステムを1枚にまとめる。Inspect AI(Anthropic、UK AISI採用)、Garak(NVIDIA→独立)、PyRIT(Microsoft)、Promptfoo(YC)、OpenAI Evals、lm-evaluation-harness(EleutherAI)、そして MLflow Evals・Arize Phoenix・DeepEval(Confident AI)・G
2026-05-16 · 31 分で読めます #ai-safety#red-teaming#evaluation#inspect-ai#garak