博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 829 篇
#2026-03 168#ai 110#llm 90#ai-papers 62#career 60#kubernetes 54#mindset 51#ai-platform 48#devops 42#security 41#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#database 23#linux 22#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#rag 16#fundamentals 15#network 15#postgresql 15#2026-08 14
RAG 论文综述:Retrieval-Augmented Generation 的演进 — 从 RETRO 到 Self-RAG、Corrective-RAG
以论文为线索追溯 Retrieval-Augmented Generation(RAG)研究的演进。从早期 RAG(Lewis 等)出发,比较分析 RETRO 的大规模检索、Self-RAG 的自我反思、Corrective-RAG 的检索质量评估等核心架构与基准测试。
2026-03-12 · 28 分钟阅读 #ai-papers#rag#self-rag#corrective-rag#retroKubernetes Gateway API 实战指南:从替代 Ingress 到 HTTPRoute、GRPCRoute、Envoy Gateway 生产部署
讲解如何利用 Kubernetes Gateway API v1.2 的 HTTPRoute、GRPCRoute 与 Envoy Gateway 制定生产部署策略。内容涵盖从 Ingress 的迁移、TLS 终止、流量分割、基于请求头的路由、限流以及监控等一整套实战运维经验。
2026-03-12 · 15 分钟阅读 #kubernetes#gateway-api#httproute#grpcroute#envoy-gatewayArgoCD GitOps 完全指南:用 ApplicationSet·Sync Waves·Hook 实现 Kubernetes 声明式部署
讲解如何用 ArgoCD 实现基于 GitOps 的 Kubernetes 声明式部署。涵盖 ApplicationSet 生成器、用 Sync Waves 与 Hook 控制部署顺序、多集群部署、RBAC、Secret 管理与监控,包含生产运维所需的全部内容。
2026-03-12 · 15 分钟阅读 #devops#argocd#gitops#applicationset#sync-wavesDiffusion Model 论文综述:从 DDPM 到 Stable Diffusion、DiT、SDXL,图像生成模型的演进
从 DDPM/DDIM 的扩散-逆扩散理论、Score-based 模型,到 Latent Diffusion(Stable Diffusion)的 VAE+U-Net 架构、Classifier-free Guidance、DiT(Diffusion Transformer)的 adaLN-Zero、SDXL 的双文本编码器与 Refiner 流水线、ControlNet 的条件控制、训练流水线、推理优化,全面综述图像生成模型的演进历
2026-03-12 · 22 分钟阅读 #ai-papers#diffusion-model#ddpm#stable-diffusion#ditKubeflow Pipelines ML 工作流编排实战指南:从 KFP v2 SDK 到生产部署
以实战为中心讲解如何用 Kubeflow Pipelines 编排 ML 工作流。详细说明 KFP v2 SDK 架构、流水线组件编写、缓存策略、Argo Workflows/Airflow 对比,以及生产环境所需的故障应对策略。
2026-03-11 · 16 分钟阅读 #ai-platform#kubeflow#mlops#pipeline-orchestration#kubernetesMixture of Experts(MoE)架构深度解析:从 Switch Transformer 到 Mixtral 的演进与高效扩展策略
从 Mixture of Experts(MoE)架构的核心原理,到 Switch Transformer 的单专家路由、Mixtral 8x7B 的 Sparse MoE 实现、DeepSeek-MoE 的细粒度专家策略,逐层深度解析。涵盖路由机制、负载均衡损失、训练稳定化技巧、推理优化、故障案例与检查清单。
2026-03-11 · 24 分钟阅读 #ai-papers#moe#switch-transformer#mixtral#model-architectureKV Cache 优化深度解析:GQA、MLA、MHA 注意力机制与内存效率化策略
从 Transformer Self-Attention 的 KV Cache 基本原理出发,深入分析并比较 MHA、MQA、GQA(Llama 2/3)、MLA(DeepSeek-V2/V3)机制的内存占用,涵盖 KV Cache 压缩技术(量化、驱逐策略、滑动窗口)、PagedAttention(vLLM)实现、PyTorch 代码示例、OOM 故障案例与优化清单。
2026-03-11 · 22 分钟阅读 #ai-papers#kv-cache#attention-mechanism#gqa#mlaKubernetes Network Policy 完全指南:用 Cilium 与 Calico 构建零信任网络安全
从 Kubernetes NetworkPolicy 基础概念到 Cilium CiliumNetworkPolicy(L3-L7 过滤、基于 DNS 的策略、eBPF)与 Calico GlobalNetworkPolicy 的深度对比。涵盖 Default Deny 策略、命名空间隔离模式、基于 Hubble 与 calicoctl 的监控与排障、策略配置错误引发的故障案例与恢复流程,以及生产环境检查清单。
2026-03-11 · 21 分钟阅读 #kubernetes#network-policy#cilium#calico#zero-trustMLflow 实验管理完全指南:实验追踪·模型注册表·部署流水线搭建
本文以实战为中心,讲解如何用 MLflow 做 ML 实验追踪、模型注册表管理与部署流水线搭建。从 Tracking Server 架构、自动日志记录、模型版本管理,到 Kubernetes/Docker 部署,详细说明生产环境中所需的 MLOps 策略。
2026-03-11 · 16 分钟阅读 #ai-platform#mlflow#experiment-tracking#model-registry#mlopsFeature Store 构建完全指南:Feast 架构、在线/离线服务与 ML 流水线集成
深入探讨 ML 系统的核心基础设施 Feature Store。涵盖 Feast 框架的架构与实现、在线/离线特征服务、特征工程流水线集成、与 Tecton 的对比分析,以及生产环境运维经验。
2026-03-10 · 17 分钟阅读 #ai-platform#feature-store#feast#mlops#ml-pipelineMixture of Experts(MoE)架构深度解析:从 Switch Transformer 到 Mixtral、DeepSeek
深度解析 Mixture of Experts(MoE)架构。从 Sparse MoE 的数学基础,到 Switch Transformer、Mixtral 8x7B、DeepSeek-V3 的路由策略、训练稳定性技巧、推理优化,基于论文进行详细梳理。
2026-03-10 · 19 分钟阅读 #ai-papers#moe#transformer#mixtral#deepseekKubernetes RBAC 深度指南:用 Role、ClusterRole 与 OPA Gatekeeper 实现最小权限访问控制
从 Kubernetes RBAC 的核心概念(Role、ClusterRole、RoleBinding、ServiceAccount)到基于 OPA Gatekeeper 的策略化访问控制,提供一份完整的实战指南。内容涵盖最小权限原则的落地、审计日志分析,以及故障案例与恢复流程。
2026-03-10 · 19 分钟阅读 #kubernetes#rbac#opa-gatekeeper#security#access-controlPostgreSQL 高级索引完全指南:GIN·GiST·BRIN·Partial Index 实战活用
深入讲解 PostgreSQL 的高级索引类型。超越 B-tree,覆盖 GIN(倒排索引)、GiST(空间索引)、BRIN(块范围索引)、Partial/Expression Index 的内部结构与应用场景,基于 EXPLAIN ANALYZE 的性能分析,直到索引膨胀的管理,提供一份实战指南。
2026-03-10 · 21 分钟阅读 #database#postgresql#indexing#gin-index#performance用 vCluster 实现 Kubernetes 多租户:虚拟集群隔离与运维指南
基于 vCluster 的 Kubernetes 多租户实现综合指南。以实战为中心讲解虚拟集群架构、与命名空间隔离的对比、Syncer 机制、RBAC 策略、资源配额、网络隔离、基于 Helm 的部署,以及生产环境运维排障。
2026-03-09 · 23 分钟阅读 #kubernetes#vcluster#multi-tenancy#isolation#virtual-clusterDPO(Direct Preference Optimization)论文深度解析 — 无需 RLHF 对齐 LLM
从 DPO 的数学原理到实现、与 RLHF 的比较,以及 IPO/KTO/ORPO 变体 — 从实务角度深入分析 LLM 偏好优化的核心。
2026-03-09 · 26 分钟阅读 #ai-papers#dpo#rlhf#llm-alignment#preference-optimizationFlashAttention 论文解析:用 IO-Aware Exact Attention 革新 Transformer 训练与推理速度
深入解析 FlashAttention 系列(v1~v3)核心论文。涵盖 IO-Aware 算法的 tiling 策略、GPU SRAM/HBM 内存层级的利用、反向传播的 recomputation、FlashAttention-2 的并行化改进,以及 FlashAttention-3 的 FP8 支持与异步流水线,并配有实战基准测试。
2026-03-09 · 29 分钟阅读 #ai-papers#flash-attention#transformer#gpu-optimization#attention-mechanismRay Serve 模型服务平台构建指南 — 自动扩缩容、多模型、生产部署
结合实战代码,全面梳理 Ray Serve 的架构、LLM 模型服务部署、自动扩缩容、多模型模式与 KubeRay 运维。
2026-03-09 · 23 分钟阅读 #ai-platform#ray-serve#model-serving#kuberay#mlopsLLM 生产监控平台对比:LangSmith·LangFuse·Arize Phoenix 实战运维指南
LLM 生产监控平台三巨头(LangSmith、LangFuse、Arize Phoenix)综合对比指南。涵盖追踪(trace)采集、提示词版本管理、评估流水线、成本监控、质量看板构建,以及实战选型标准,并配有代码示例。
2026-03-09 · 31 分钟阅读 #ai-platform#llm-monitoring#langsmith#langfuse#arizeAI/ML 论文阅读必备数学 + LaTeX/KaTeX 全面整理
全面整理阅读 AI/ML 论文时必然会遇到的数学概念(线性代数、微积分、概率统计、最优化)与 LaTeX/KaTeX 公式语法,以实战示例为核心讲解。从符号速查表、公式模式解析,到 MDX 博客渲染技巧,一次讲清楚。
2026-03-08 · 24 分钟阅读 #ai-papers#math#latex#katex#linear-algebraKAN(Kolmogorov-Arnold Networks)论文解析:替代 MLP 的可学习激活函数架构
深入解析 Kolmogorov-Arnold Networks(KAN)论文,涵盖 Kolmogorov-Arnold 表示定理的数学背景、B 样条激活函数、与 MLP 相比的精度与可解释性对比,以及实战实现代码。
2026-03-08 · 33 分钟阅读 #ai-papers#kan#kolmogorov-arnold#neural-network#mlp