标签: #ai-agent
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 21 篇
AI 智能体的记忆实际上是怎么做出来的 — 四种设计,以及基准测试实际证明了什么
「智能体记忆」不是一种单一技术,而是把至少四种彼此不同的设计笼统打包的说法 — 文件草稿板、摘要/compaction、向量召回、知识图谱。本文先用产品文档确认每一种实际在做什么,然后抛出一个更不舒服的问题:「哪种更好」的证据真的被测量过吗? 直接去读 Mem0 论文(arXiv:2504.19413)的表格就会发现,头条的「相对 OpenAI 提升 26%」是事实,但在同一张表里,把整段对话原样贴进提示词的全上下文方式以 J 72.9
2026-07-17 · 31 分钟阅读 #ai#ai-agent#agent-memory#llm#benchmark上下文工程取代了提示词工程吗 — 哪些被测量过,哪些没有
「提示词工程已死」这句话,在创造这个术语的任何一手来源里都不存在。Karpathy 把 few-shot 示例和任务描述列为上下文工程的组成部分,Anthropic 则写道这是「提示词工程的自然演进(natural progression)」。也就是说,不是替代,而是包含。尽管如此,「这确实是一件不同的工作」是有证据的 — Chroma 的 LongMemEval 实验把问题和措辞原样保留,只把周围上下文从 300 token 增加到
2026-07-17 · 30 分钟阅读 #llm#context-engineering#prompt-engineering#long-context#ai-agentPydanticAI 实战指南:2026 年 Python 团队为什么在生产级智能体中采用它
面向需要 Python 优先的智能体系统、模型可移植性、持久化工作流、可观测性与评估体系的团队的 PydanticAI 实战指南。
2026-04-12 · 10 分钟阅读 #pydantic#pydantic-ai#python#ai-agent#mcpGoogle Agent Development Kit 实践指南:ADK 为何适合企业级智能体
面向评估 Google Agent Development Kit 的团队的实践指南,围绕上下文管理、callbacks、多智能体组合与上线判断标准展开。
2026-04-12 · 9 分钟阅读 #google-adk#agent-development-kit#ai-agent#multi-agent#session-stateMastra 实战指南:2026 年 TypeScript 团队为什么在生产 AI 智能体中采用它
面向需要在一套开源 TypeScript 技术栈中同时处理智能体、记忆、工作流、可观测性、评估与生产部署的团队,这是一份 Mastra 实战指南。
2026-04-12 · 10 分钟阅读 #mastra#typescript#ai-agent#mcp#memory浏览器·计算机使用代理实战指南:2026 年团队可以立即落地的架构、防护机制与检查清单
直接操作浏览器和虚拟计算机的代理为什么在此刻变得重要、应该按什么架构来设计、自动化到哪一步该停下来 —— 本文按实务标准做了梳理。
2026-04-12 · 15 分钟阅读 #ai-platform#ai-agent#browser-agent#computer-use#automationOpenAI、Azure、AWS 企业级 Agent 可观测性与评估比较指南
对比 OpenAI、Azure、AWS 在 Agent 可观测性、评估、仪表盘、OpenTelemetry 集成上的差异,并为平台、产品、基础设施团队整理了一份做出上线决策的实务指南。
2026-04-12 · 5 分钟阅读 #openai#azure#aws#observability#evaluation用 Cloudflare Agents 与 Durable Objects 构建 AI 应用的实战指南
一篇 2026 年的实战指南,讲清楚 Cloudflare Agents 与 Durable Objects 如何应用在 AI 产品上、为什么状态与长时间运行的任务如此重要、它与 stateless serverless 有何不同,以及一份可直接落地的上线检查清单。
2026-04-12 · 13 分钟阅读 #cloudflare#cloudflare-agents#durable-objects#ai-agent#mcpOpenAI Responses API 与 Agents SDK 实战指南:2026 年团队重新规划架构的方法
以 2025 年 3 月 11 日发布的 OpenAI Responses API 与 Agents SDK 为基准,从实务角度梳理哪些团队应该继续使用 Chat Completions、哪些团队应该转向 Responses API,以及 Assistants API 用户该在何时准备好哪些工作。
2026-04-12 · 17 分钟阅读 #openai#responses-api#agents-sdk#ai-agent#chat-completions深度研究智能体实战指南:2026 年开发者与知识工作者该如何使用
一份 2026 年实战指南,帮助你把 OpenAI 深度研究直接用于实际工作 —— 从概念和重要性,到提示词模式、MCP 集成、常见陷阱与检查清单,一次梳理清楚。
2026-04-12 · 13 分钟阅读 #deep-research#ai-agent#mcp#chatgpt#research-workflow提示词缓存实战指南:让 Agent 应用的成本与延迟一起降下来
梳理为什么提示词缓存在 Agent 应用里很重要、OpenAI 与 Anthropic 的差异、提示词结构化模式、ROI 判断方法、常见错误,以及迁移清单,全部从实务角度整理。
2026-04-12 · 13 分钟阅读 #prompt-caching#latency#cost-optimization#ai-agent#llmopsAzure AI Foundry Agent Service 实战指南:2026 年企业部署判断标准
这是一份从企业视角梳理 Azure AI Foundry Agent Service 的实战指南,说明为什么需要管理型智能体、如何利用工具目录和远程 MCP 服务器,以及如何以 tracing、evaluation、governance、private networking 为基准判断部署方案。
2026-04-12 · 7 分钟阅读 #azure#azure-ai-foundry#agent-service#ai-agent#mcpGemini CLI 实战指南:如何判断是否要采用以终端为先的 AI 智能体
从 2026 年的时间点出发,梳理 Gemini CLI 与以 IDE 为先的工具有何不同,plan mode、hooks、MCP、脚本化对实际开发流程意味着什么,以及如何在团队里安全地落地它。
2026-04-12 · 11 分钟阅读 #gemini-cli#google-gemini#terminal-ai#ai-agent#mcpAmazon Bedrock AgentCore 实践指南:如何在 2026 年构建安全的生产级智能体
Amazon Bedrock AgentCore 面向需要安全、可用于生产的智能体的团队,本文详细介绍 Runtime、Memory、Gateway、可观测性,以及上线前的检查清单。
2026-04-12 · 12 分钟阅读 #aws#bedrock#agentcore#ai-agent#mcp开源社区新闻汇总:2026年3月值得关注的项目
整理了2026年3月开源社区最受关注的项目和有趣的消息。
2026-03-17 · 13 分钟阅读 #opensource#github#ai-agent#developer-tools#communityLLM 智能体与 Agentic AI 完全指南:从 ReAct、多智能体编排到 MCP
一份 2026 年 Agentic AI 完全指南,涵盖 ReAct 框架、Tool Use、多智能体编排、MCP(Model Context Protocol)直至 Computer-use 智能体。
2026-03-17 · 23 分钟阅读 #ai-agent#multiagent#langgraph#crewai#mcpModel Context Protocol 运维指南:服务器设计、Tool 治理与 Transport 策略
梳理在实际业务中落地 Model Context Protocol 时所需的服务器边界划分、tool 设计、transport 选型、认证、token 预算管理与运维检查清单,内容以官方文档为主要依据。
2026-03-17 · 11 分钟阅读 #ai-platform#mcp#model-context-protocol#ai-agent#tool-governanceAI 智能体完全指南 — 用 LangChain、LangGraph、CrewAI 构建自主 AI 系统
一份让你彻底掌握 AI 智能体系统的指南。从 ReAct、Tool Use、Function Calling 到 LangChain 智能体、LangGraph 工作流、CrewAI 多智能体协作,通过实战示例构建自主 AI 系统。
2026-03-17 · 34 分钟阅读 #ai-agent#langchain#langgraph#crewai#autonomous-aiAI 编码智能体沙箱化:安全代码执行隔离与安全运维指南
随着 2026 年 AI 编码智能体的自主性不断提高,安全隔离已成为必需。本文涵盖 macOS sandbox-exec、基于容器的隔离、MicroVM 等实战沙箱化技术与运维指南。
2026-03-14 · 20 分钟阅读 #ai-agent#sandboxing#security#ai-platform#devopsAI Agent 多智能体编排模式:层级式·流水线·蜂群架构实战指南
从单一智能体到多智能体协作 — 梳理层级式、流水线、蜂群模式的设计原则,以及 LangGraph、CrewAI、AutoGen 各框架的实现方法,并附实战代码。
2026-03-14 · 23 分钟阅读 #ai-platform#ai-agent#multi-agent#orchestration#workflow