标签: #tool-calling
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 2 篇
LLM、Tool Calling、Embedding 基准完全解析:每个基准到底衡量什么
MMLU、HellaSwag、HumanEval、BFCL、MTEB 等主要 AI 基准到底衡量什么、各项分数的含义与局限,以及在实际使用时该参考哪个基准,本文逐一完整解析。
2026-03-17 · 37 分钟阅读 #llm#benchmark#mmlu#mteb#bfclLangGraph 智能体工作流实战指南:从多智能体编排到生产部署
用 LangGraph 构建状态化的 AI 智能体工作流。涵盖 StateGraph、条件路由、多智能体编排、Human-in-the-Loop,以及 LangGraph Platform 部署,全程附带实战代码。
2026-03-02 · 8 分钟阅读 #langgraph#langchain#ai-agent#workflow#multi-agent