태그: #prompt-engineering
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 21 편
하네스 엔지니어링이란 무엇인가 — 모델은 고정 입력이고, 배포하는 것은 그 주위 전부입니다
같은 모델을 쓰는데 왜 팀마다 에이전트 성과가 다를까요. 대부분의 팀에게 모델은 고정 입력이고, 실제로 배포하는 것은 도구 표면, 실패 반환 형식, 루프와 정지 조건, 컨텍스트 정책, 권한, 평가자까지 모델을 둘러싼 하네스 전부입니다. 하네스 엔지니어링 시리즈 1편으로, 하네스의 정의와 여섯 개의 손잡이, 그리고 프롬프트 엔지니어링이라는 이름이 이 일을 과소평가하는 이유를 정리했습니다.
2026-08-12 · 11 분 읽기 #llm#agent#harness-engineering#하네스엔지니어링#AI에이전트vLLM 내부 구조 (5) — 접두사 캐싱, 시스템 프롬프트 설계가 곧 성능이 되는 이유
vLLM의 접두사 캐싱이 언제 적중하고 언제 못 하는지를 공식 설계 문서 기준으로 정리했습니다. 블록 해시가 앞 블록에 사슬처럼 묶이는 구조, 꽉 찬 블록만 캐시되는 이유, 프롬프트 맨 앞에 넣은 타임스탬프 하나가 캐시 전체를 날리는 과정, 그리고 cachesalt까지 다룹니다. vLLM 내부 구조 시리즈 5편.
2026-08-12 · 13 분 읽기 #vllm#prefix-caching#kv-cache#prompt-engineering#llm컨텍스트 엔지니어링은 프롬프트 엔지니어링을 대체한 말인가 — 측정된 것과 아닌 것
"프롬프트 엔지니어링은 죽었다"는 문장은 이 용어를 만든 어느 1차 출처에도 없습니다. Karpathy는 few-shot 예제와 태스크 설명을 컨텍스트 엔지니어링의 구성요소로 나열했고, Anthropic은 "프롬프트 엔지니어링의 자연스러운 진전(natural progression)"이라고 썼습니다. 즉 대체가 아니라 포함입니다. 그런데도 이게 진짜 다른 일이라는 근거는 있습니다 — Chrom
2026-07-17 · 37 분 읽기 #llm#context-engineering#prompt-engineering#long-context#ai-agentAI Engineer 되는 방법 완벽 가이드 2026 — LLM, RAG, 에이전트, Evals, 커리어 로드맵
AI Engineer가 되기 위한 2026년 완벽 가이드. ML Engineer와의 차이부터 LLM API, 프롬프트 엔지니어링, RAG 설계, 에이전트 구축, LoRA 파인튜닝, vLLM 서빙, Evals 중심 개발, 프레임워크·벡터 DB 선택, 비용 최적화, 포트폴리오 5종, 한국·일본·글로벌 채용 시장과 인터뷰 대비까지 한 번에 정리합니다.
2026-07-02 · 49 분 읽기 #ai-engineer#career#llm#rag#ai-agentsLLM 관찰성 & 프롬프트 도구 2026 — Helicone / LangSmith / Langfuse / Braintrust / Athina / Comet Opik / Portkey 심층 비교
2026년의 LLM ops 지도. Helicone (YC) · LangSmith (LangChain) · Langfuse (오픈소스 Series A) · W&B Weave · Arize Phoenix · Braintrust · Athina · Comet Opik (2025년 3월 출시) · Vellum · PromptHub · Portkey AI Gateway · TruLens · Ragas
2026-05-16 · 36 분 읽기 #llm-observability#prompt-engineering#helicone#langsmith#langchainAI 시대 개발자 영어: AGENTS.md, 시스템 프롬프트, RFC — 에이전트가 읽는 영어 쓰기의 기술
2026년 개발자가 쓰는 영어 중 가장 영향력이 큰 영어는, 사람이 아니라 에이전트가 읽는 영어입니다. AGENTS.md / CLAUDE.md 컨텍스트 파일, 프로덕션 에이전트의 시스템 프롬프트, 사람과 에이전트가 동시에 읽는 RFC / 디자인 독, 에이전트가 행동할 수 있는 이슈와 PR 설명까지 — '에이전트는 문자 그대로 읽는다(literal)'는 원칙을 중심으로 약한 영어와 강한 영어의
2026-05-14 · 43 분 읽기 #developer-english#ai-writing#agents-md#claude-md#system-prompt프롬프트 엔지니어링의 과학: CoT, Self-consistency, DSPy, 구조화 출력, 자동 최적화까지 (2025)
2023년엔 "주문"이었고, 2024년엔 "기술"이었고, 2025년엔 "과학"이 된 프롬프트 엔지니어링. Chain-of-Thought, Self-consistency, Tree-of-Thoughts, DSPy 자동 최적화, Structured Output, 프롬프트 버저닝, 모델 간 이관까지. 실전 운영 관점에서 한 글로 정리합니다.
2026-04-15 · 25 분 읽기 #prompt-engineering#llm#ai#dspy#cotAdvanced Prompt Engineering 완전 가이드 2025: CoT, ToT, Self-Consistency, 메타프롬프팅
Prompt Engineering 심화! Chain-of-Thought(CoT), Tree-of-Thought(ToT), Self-Consistency, ReAct, 메타프롬프팅, Structured Output(JSON Mode), System Prompt 설계, Few-shot 최적화, Prompt Chaining, 평가(auto-eval), 프로덕션 프롬프트 관리.
2026-04-14 · 40 분 읽기 #prompt-engineering#chain-of-thought#tree-of-thought#few-shot#system-prompt2025 AI 직무 완전 지도: AI 회사부터 SI까지, 모든 AI 직군의 역할·역량·연봉 총정리
2025년 AI 직무 생태계를 완전히 해부합니다. OpenAI/Anthropic/DeepMind 채용 트렌드, FDE 800% 수요 폭증, AI Safety Engineer 45% 연봉 상승, Context Engineer 등장, 한국 SI(삼성SDS/LG CNS) AI 전환 — 15개 AI 직군별 역할, 필수 역량, 연봉, 학습 로드맵.
2026-03-23 · 88 분 읽기 #ai-careers#job-market#fde#mlops#ai-safetyAI 프롬프트 엔지니어링 완전 가이드: 개발자가 알아야 할 프롬프트 기법 30선
Zero-shot부터 Chain-of-Thought, Tree-of-Thought, ReAct, Few-shot, Self-Consistency까지 — 개발자를 위한 프롬프트 엔지니어링 30가지 기법을 실전 예시와 함께. Claude, GPT-4, Gemini에서 최대 성능을 끌어내는 방법.
2026-03-22 · 49 분 읽기 #prompt-engineering#ai#llm#chatgpt#claudePrompt Engineering 2025 실전 가이드: GPT-4o와 Claude 3.5를 최대한 활용하는 법
모델이 아무리 좋아도 프롬프트가 엉망이면 결과도 엉망입니다. 2025년 현재 프로덕션에서 실제로 효과가 입증된 프롬프트 엔지니어링 기법 6가지를 코드와 함께 설명합니다.
2026-03-18 · 15 분 읽기 #prompt-engineering#llm#ai-development#gpt-4o#claudeLLM 환각(Hallucination) 완전 해부: 왜 AI는 거짓말을 하고, 어떻게 막는가
LLM이 왜 사실이 아닌 것을 자신있게 말하는지 기술적 원인을 분석하고, RAG, 자기비판, Chain of Verification 등 5가지 실전 해결 전략을 코드와 함께 설명합니다.
2026-03-18 · 15 분 읽기 #환각#hallucination#llm#AI신뢰성#ai-developmentLLM Agent 설계 패턴 완전 가이드: ReAct부터 Multi-Agent까지
ReAct, Chain of Thought, Plan-and-Execute, Reflection, Tree of Thoughts — LLM Agent를 실제로 만들 때 어떤 패턴을 언제 써야 하는지, 현업 엔지니어 관점에서 정리했습니다.
2026-03-18 · 12 분 읽기 #ai-agent#react#llm#설계패턴#ai-developmentRAG vs Fine-tuning vs Prompt Engineering: 언제 무엇을 선택하는가
RAG, Fine-tuning, Prompt Engineering의 차이를 실전 관점에서 비교하고, 어떤 상황에서 무엇을 선택해야 하는지 구체적인 의사결정 프레임워크와 비용 계산 예시를 제공합니다.
2026-03-18 · 12 분 읽기 #rag#파인튜닝#prompt-engineering#llm#ai-development프롬프트 엔지니어링 완전 정복: CoT, DSPy, 구조화 출력, 프롬프트 보안까지
Zero-shot부터 Chain-of-Thought, Tree-of-Thought, DSPy 자동 최적화, Pydantic 구조화 출력, 프롬프트 인젝션 방어까지 2026년 프롬프트 엔지니어링 완전 가이드입니다.
2026-03-17 · 45 분 읽기 #prompt-engineering#chainofthought#dspy#llm#구조화출력LLM 애플리케이션 개발 가이드: 프로토타입에서 프로덕션까지
프로토타입에서 프로덕션까지 LLM 기반 애플리케이션을 구축하는 종합 가이드. 프롬프트 엔지니어링, RAG 아키텍처, 툴 사용, 스트리밍, 평가, 비용 최적화, 그리고 실전 AI 애플리케이션을 위한 배포 패턴을 다룹니다.
2026-03-17 · 31 분 읽기 #llm#application-development#langchain#openai#prompt-engineeringGemini API를 프로덕션에 올릴 때 필요한 Prompt, Guardrails, Evaluation
Gemini API를 실서비스에 붙일 때 필요한 프롬프트 설계, structured output, safety 정책, 평가 루프, 비용 통제 방법을 운영 관점에서 정리한 가이드입니다.
2026-03-17 · 8 분 읽기 #gemini#generative-ai#ai#llmops#prompt-engineering프롬프트 엔지니어링 완전 정복: Zero-shot부터 고급 기법까지
프롬프트 엔지니어링의 모든 기법을 완전히 마스터하는 가이드. Zero-shot, Few-shot, Chain-of-Thought, Tree of Thoughts, ReAct, Self-Consistency부터 시스템 프롬프트 설계까지 실전 예제로 배웁니다.
2026-03-17 · 57 분 읽기 #prompt-engineering#llm#chatgpt#claude#aiLLM 프롬프트 엔지니어링 고급 기법: Chain-of-Thought·Tree-of-Thought·ReAct·Few-Shot 패턴 실전 가이드
Zero-shot/Few-shot 프롬프팅의 기초부터 Chain-of-Thought(CoT), Self-Consistency, Tree-of-Thought(ToT), ReAct 패턴의 이론과 구현, 구조화된 출력 프롬프팅, 프롬프트 체이닝, 평가 메트릭, 일반적인 안티패턴, 프로덕션 최적화까지 LLM 프롬프트 엔지니어링의 고급 기법을 실전 코드와 함께 체계적으로 다룹니다.
2026-03-12 · 28 분 읽기 #llm#prompt-engineering#chain-of-thought#tree-of-thought#reactLLM 프롬프트 엔지니어링 고급 기법: Chain-of-Thought·ReAct·Tree of Thoughts 실전 적용
LLM 프롬프트 엔지니어링의 고급 기법을 체계적으로 다룹니다. Chain-of-Thought, Few-shot, ReAct, Self-Consistency, Tree of Thoughts 패턴의 원리와 구현 코드를 제공하고, 프로덕션 환경에서의 프롬프트 관리 전략과 평가 방법론을 설명합니다.
2026-03-10 · 26 분 읽기 #llm#prompt-engineering#chain-of-thought#react-prompting#tree-of-thoughts