标签: #context-engineering
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 3 篇
上下文预算 — 设计在于去掉什么,而不是放进什么
上下文窗口明明还有富余,智能体的准确率却在往下掉。上下文是有限的注意力预算,工具的 schema 也在花这笔预算。框架工程系列第 2 篇,整理了把提示词堆积改成 playbook 的做法、丢弃策略与压缩(compaction)的标准,以及委派子智能体的真实成本。
2026-08-12 · 9 分钟阅读 #llm#agent#harness-engineering#하네스엔지니어링#AI에이전트框架不是配置,而是交付物 —— 自我改进循环真正的瓶颈
Lilian Weng 在 2026 年 7 月整理的那篇框架工程(harness engineering)文章,给包裹着模型的整个系统起了名字,把它当成一个工程对象。本文不复述那个定义,而是讨论:当你把框架当作带版本的交付物而不是配置文件来对待时,会有什么不同。文中梳理了给框架打指纹以捕捉回归的做法、把上下文当成 playbook 而不是越写越长的提示词的做法,以及为什么自我改进循环真正的瓶颈不是模型而是评估者。
2026-08-09 · 11 分钟阅读 #llm#agent#harness-engineering#context-engineering#evaluation上下文工程取代了提示词工程吗 — 哪些被测量过,哪些没有
「提示词工程已死」这句话,在创造这个术语的任何一手来源里都不存在。Karpathy 把 few-shot 示例和任务描述列为上下文工程的组成部分,Anthropic 则写道这是「提示词工程的自然演进(natural progression)」。也就是说,不是替代,而是包含。尽管如此,「这确实是一件不同的工作」是有证据的 — Chroma 的 LongMemEval 实验把问题和措辞原样保留,只把周围上下文从 300 token 增加到
2026-07-17 · 30 分钟阅读 #llm#context-engineering#prompt-engineering#long-context#ai-agent