标签: #openai
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 9 篇
GPT-5.6 与性价比的极限 — 如何在曲线上找到自己负载的位置
OpenAI 在 2026 年 7 月 30 日把 GPT-5.6 Luna 降价 80%、Terra 降价 20%。距离 7 月 9 日正式发布只有三周,而最顶端的 Sol 价格不变。Luna 从每 100 万 token 输入 1 美元、输出 6 美元,变成输入 0.20 美元、输出 1.20 美元。本文不介绍降价幅度,而是计算这条曲线 — 降价后三个档位的单价比在两个轴上都恰好锁定为 25 比 10 比 1,因此在同一系列内部 t
2026-07-31 · 17 分钟阅读 #ai#llm#openai#inference-cost#prompt-caching苹果起诉了OpenAI — 人才流动与商业秘密法,开发者该如何解读
2026年7月10日,苹果将OpenAI、两名前员工以及OpenAI的硬件子公司io Products诉至加利福尼亚北区联邦地区法院。核心是商业秘密的不正当使用与违约。本文先把苹果所"主张"的内容作为主张明确区分开来,再从开发者的视角剖析这场诉讼真正的争点 — 由于加州的竞业禁止协议无效,商业秘密法几乎是规范人才流动的唯一杠杆。这还只是第一手棋,已确认的报道中既没有OpenAI的公开反驳,也没有法院的判断。
2026-07-11 · 10 分钟阅读 #openai#apple#trade-secrets#legal#industryOpenAI、Azure、AWS 企业级 Agent 可观测性与评估比较指南
对比 OpenAI、Azure、AWS 在 Agent 可观测性、评估、仪表盘、OpenTelemetry 集成上的差异,并为平台、产品、基础设施团队整理了一份做出上线决策的实务指南。
2026-04-12 · 5 分钟阅读 #openai#azure#aws#observability#evaluation托管智能体平台对比指南:OpenAI AgentKit vs Azure AI Foundry Agent Service vs Amazon Bedrock AgentCore
基于官方文档,对截至 2026-04-12 的三个托管智能体平台进行实用对比,涵盖产品适配、治理、工具链、部署与上线检查清单。
2026-04-12 · 7 分钟阅读 #ai-platform#managed-agents#agent-platform#comparison#openaiOpenAI Responses API 与 Agents SDK 实战指南:2026 年团队重新规划架构的方法
以 2025 年 3 月 11 日发布的 OpenAI Responses API 与 Agents SDK 为基准,从实务角度梳理哪些团队应该继续使用 Chat Completions、哪些团队应该转向 Responses API,以及 Assistants API 用户该在何时准备好哪些工作。
2026-04-12 · 17 分钟阅读 #openai#responses-api#agents-sdk#ai-agent#chat-completionsGPT-5 开发者实战指南:智能体编程、工具调用与成本优化
本文以 2025 年 8 月 7 日发布的 GPT-5 为基准,从实务角度梳理开发者需要做出哪些改变、该如何选择模型规模与控制参数,以及如何把智能体编程与成本优化放在一起设计。
2026-04-12 · 13 分钟阅读 #openai#gpt-5#coding#agentic-coding#tool-useOpenAI RFT 与自定义评分器:面向产品和平台团队的实践指南
一份关于 OpenAI 强化微调(RFT)搭配自定义评分器的实践指南,涵盖何时该用它、如何准备数据、如何评估检查点,以及如何安全地上线。
2026-04-12 · 9 分钟阅读 #ai-platform#openai#rft#reinforcement-fine-tuning#custom-gradersLLM 应用开发指南:从原型到生产环境
从原型到生产环境构建基于 LLM 的应用的综合指南。涵盖提示词工程、RAG 架构、工具使用、流式传输、评估、成本优化,以及实战 AI 应用的部署模式。
2026-03-17 · 27 分钟阅读 #llm#application-development#langchain#openai#prompt-engineeringGPT 系列论文完全解析:从 GPT-1 到 GPT-4,语言模型改变世界的历程
按代际完整解析 OpenAI 的 GPT 系列。从 GPT-1 的无监督预训练、GPT-2 的 Zero-shot 学习、GPT-3 的 In-context Learning 与 Scaling Law、InstructGPT 的 RLHF,到 GPT-4 的多模态 — 用公式梳理每篇论文的核心贡献与架构演进。
2026-03-01 · 54 分钟阅读 #gpt#openai#language-model#transformer#pre-training