标签: #ai-gateway
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 6 篇
编码智能体的开销不是靠额度管住的,而是靠摩擦
Databricks 在 2026 年 7 月和 8 月接连发布的两篇工程文章表明,处理编码智能体开销的方式正在从预算额度转向网关加渐进式摩擦。本文拆解这套设计:为什么硬预算是最后的手段,为什么要把日常暴走防护与月度治理分开,为什么单次增量的大小就是设计的全部,以及为什么真正主导账单的不是模型单价而是上下文 —— 全部整理成可以计算的形式。
2026-08-09 · 12 分钟阅读 #mlops#llm#cost#ai-gateway#developer-productivityOpenRouter 使用指南 — 用一个 API 调用 300+ 个 LLM
如何用 OpenRouter 一个入口,以兼容 OpenAI 的方式调用来自 60+ 家供应商的 300+ 个模型 — 从申请密钥、发出第一个 curl 请求,到 SDK 无缝替换、路由与回退、流式输出,按实务标准梳理一遍。
2026-07-06 · 11 分钟阅读 #openrouter#llm#ai-gateway#api#openai-compatibleLiteLLM 实战指南 — 用一个接口调用 100+ 个 LLM
一份实战速成指南:用同一套 OpenAI 格式调用 OpenAI、Anthropic、Gemini、Bedrock、OpenRouter 以及本地模型。从安装到流式输出、Router、Proxy Server,快速梳理一遍 LiteLLM。
2026-07-06 · 13 分钟阅读 #litellm#llm#ai-gateway#python#openai-compatibleCloudflare AI Gateway 实战指南: 观测和控制 AI 流量最快的方法
以 2026 年 4 月为基准,从实务角度梳理为什么要用 Cloudflare AI Gateway、能做哪些控制、以及应该如何搭配使用 Dynamic Routing 与自动重试。
2026-04-12 · 9 分钟阅读 #ai-platform#cloudflare#ai-gateway#observability#caching用 Vercel AI SDK 6 和 AI Gateway 构建多模型应用:2026 实战指南
基于 2025 年 12 月 22 日发布的 Vercel AI SDK 6 与 AI Gateway,从实务角度梳理 2026 年设计多模型架构的方法,以及 fallback、provider routing、human approval、Next.js 落地清单。
2026-04-12 · 13 分钟阅读 #ai-platform#ai-sdk#ai-gateway#multi-model#fallbacksAI 网关平台比较指南:Vercel AI Gateway vs Cloudflare AI Gateway vs Amazon Bedrock AgentCore Gateway
一份截至 2026-04-12 的 AI 网关层实务比较,说明 Vercel AI Gateway、Cloudflare AI Gateway 与 Amazon Bedrock AgentCore Gateway 在技术栈中各自的位置。
2026-04-12 · 6 分钟阅读 #ai-platform#ai-gateway#comparison#vercel#cloudflare