LLM 应用 — 检索、智能体、语音
亲手构建并测量 LLM 应用的各个部件。从 token 与检索开始,用智能体和 MCP 服务器接入工具,最后把能听、能找答案、能说话的语音助手完整串起来。模型内部与推理服务成本在「LLM 模型与推理服务」路径中。
코스
- LLM 工程 — 从分词器到 RAG 评测,从地基开始
- AI 智能体 — 是图不是模型 — 停止条件、失败路径、留痕。demo 与产品的分水岭
- 智能体删掉了我的数据库 — 用标准库编写 MCP 服务器,并设置三层防护
- 语音 AI 智能体 — 会听、会查、会说的流水线 — 在一个 CPU Pod 里把听到说完整串起来,并测量延迟