标签: #chunking
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 2 篇
专家不是知道得更多,而是看到的东西不一样
1973年的棋盘实验是专业性研究的起点。高手对真实对局局面的记忆远远更好,但在随机撒开的排列上,这份优势大部分都消失了。这意味着靠的不是记忆容量而是模式知觉。本文梳理从国际象棋出发、经由体育的视线研究一直延伸到语言的成块处理的证据,并看看这个发现对练习方法提出了什么要求。
2026-08-16 · 19 分钟阅读 #mindset#learning#expertise#chunking#perceptionRAG 答非所问时 — 区分检索失败与生成失败的调试流程
RAG 给出错误答案时,多数人先去改提示,但真实原因大多出在检索阶段。本文先给出一次实验就能把检索失败与生成失败切开的流程——把正确分块直接手动喂进去,然后讲清为什么分块是最常见的凶手、嵌入相似度与语义相似度分道扬镳的地方、混入 BM25 常常获胜的理由、重排序值回票价的条件,以及给分块加上文档标题和元数据后的效果。最后附上构建黄金集并测量 recall@k 与答案包含率的代码。
2026-07-26 · 18 分钟阅读 #llm#rag#retrieval#chunking#evaluation