태그: #prompt-injection
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 9 편
브라우저·컴퓨터를 조작하는 AI 에이전트, 지금 어디까지 왔나 — 벤치마크 숫자가 실제로 재는 것
"컴퓨터 유즈 에이전트가 OSWorld에서 83.5%를 찍었다"와 "가장 강한 에이전트도 20.6%밖에 못 끝낸다"는 둘 다 2026년에 나온 사실이고, 둘 다 맞습니다. 앞은 OSWorld 1.0, 뒤는 같은 팀이 만든 OSWorld 2.0입니다. 이 글은 그 간극이 어디서 오는지를 원 논문과 벤치마크 저자들의 자체 측정으로 따라갑니다. OSWorld 과제의 절반 가까이는 GUI를 거의 쓰
2026-07-17 · 46 분 읽기 #ai#computer-use#browser-agents#benchmark#prompt-injection이슈 하나로 공급망 끝까지 — CI 안의 에이전트가 무너진 방식과, 방어가 실제로 막아준 만큼
2026년 6월 1일 GMO Flatt Security의 RyotaK가 공개한 Claude Code GitHub Actions 취약점은, CI 파이프라인에 들어온 에이전트가 어떻게 저장소 전체를 넘기는 통로가 되는지를 끝까지 따라간 사례입니다. 봇 판정 한 줄이 신뢰 경계를 무너뜨리고, 이슈 본문에 심긴 지시가 명령이 되고, 읽기 전용처럼 보이는 명령 하나가 유출 채널이 됩니다. 이 글은 그
2026-07-16 · 40 분 읽기 #security#ai#prompt-injection#supply-chain#ci-cd웹 에이전트는 웹페이지의 글을 명령으로 읽는다 — 교차 사이트 프롬프트 인젝션과 Prismata의 봉쇄
2026년 7월 9일 arXiv에 올라온 Prismata 논문(Villa, Ozdarendeli, Tan, Popa)은 자율 웹 에이전트의 가장 오래된 약점을 다룹니다. 에이전트는 자연어를 명령으로 해석하기 때문에, 페이지에 섞인 제3자·사용자 생성 콘텐츠가 그대로 에이전트를 탈취할 수 있습니다. 저자들은 이를 Cross-Site Scripting의 재림으로 봅니다. Prismata는 신뢰를
2026-07-11 · 11 분 읽기 #prompt-injection#web-agents#ai-security#least-privilege#browser-agents데이터 보안·프라이버시 2025 완전 정복: 암호화(At-rest/In-transit/In-use), RBAC·ABAC·PBAC, Row/Column Security, 망분리, Differential Privacy, Zero Trust, Confidential Computing, LLM 보안(Prompt Injection), GDPR·개인정보보호법, Bug Bounty
2025년 데이터 보안·프라이버시의 전 영역. 3가지 암호화(At-rest·In-transit·In-use)와 CMEK/BYOK/HSM, RBAC vs ABAC vs PBAC 접근 제어, Row/Column-Level Security, 금융·공공 망분리 환경, Differential Privacy·K-anonymity·PII 마스킹 기법, Zero Trust 데이터 아키텍처, Confiden
2026-04-15 · 23 분 읽기 #data-security#privacy#encryption#rbac#abacLLM 보안 완전 가이드: Prompt Injection, Jailbreak, Red Team, OWASP LLM Top 10, EU AI Act (2025)
2024–2025년 LLM 제품의 실패 원인 TOP3 안에 항상 "보안 사고"가 들어간다. Prompt injection 12변종, Jailbreak 기법, Data exfiltration, Model extraction, Red team 자동화(PyRIT/Garak), OWASP LLM Top 10, EU AI Act와 한국 규제, 그리고 가드레일 설계까지. "기본값으로 안전한 LLM 제품
2026-04-15 · 17 분 읽기 #llm-security#prompt-injection#jailbreak#red-team#owasp-llmAI 엔지니어링 실전 — LLM API, RAG, 에이전트, LoRA/DPO, 벡터 DB, 평가, 관측, Prompt Injection 완전 가이드 (2025)
LLM API 프로덕션 호출의 진짜 어려움, RAG가 단순 조회가 아닌 이유, 에이전트 패턴(ReAct/Plan-Execute/ReWOO), 파인튜닝 언제/언제 하지 말까(LoRA/QLoRA/DPO), 벡터 DB 선택 매트릭스, LLM 평가의 근본적 어려움, 비용 최적화, Prompt Injection 방어까지. 데모가 아닌 '진짜 프로덕션' AI 앱을 만드는 법.
2026-04-15 · 20 분 읽기 #ai-engineering#llm#rag#ai-agent#loraAI 시스템 보안 엔지니어링: 프롬프트 인젝션부터 모델 보안까지
AI 시스템 보안 완전 가이드. 프롬프트 인젝션, 탈옥(Jailbreak), 데이터 오염, 모델 추출, 프라이버시 공격, 방어 전략까지 실제 공격 사례와 Python 예제로 배웁니다.
2026-03-17 · 30 분 읽기 #ai-security#prompt-injection#llm-security#adversarial-attack#jailbreak챗봇 가드레일과 안전성 완벽 가이드: 프롬프트 인젝션 방어부터 출력 검증까지
프로덕션 챗봇의 안전성 확보 전략을 다룹니다. 프롬프트 인젝션 공격 유형과 방어, NeMo Guardrails/Guardrails AI 프레임워크, 콘텐츠 필터링, 출력 검증, PII 마스킹까지 실무 보안 아키텍처를 코드와 함께 구현합니다.
2026-03-13 · 24 분 읽기 #chatbot#guardrails#prompt-injection#safety#content-filteringLLM 안전성과 Red Teaming 실전 가이드: 적대적 공격 방어부터 가드레일 구축까지
LLM 시스템의 안전성을 확보하기 위한 Red Teaming 방법론과 방어 전략을 다룹니다. 프롬프트 인젝션, 탈옥 공격의 유형 분석부터 Llama Guard, NeMo Guardrails를 활용한 다층 방어 아키텍처 구축까지 실전 코드와 함께 안내합니다.
2026-03-08 · 43 분 읽기 #llm#red-teaming#safety#guardrails#prompt-injection