标签: #2026-03
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 168 篇
Sparse Mixture of Experts(MoE)架构深度解析:从设计原理到 DeepSeek-V3、Qwen3
分析 Sparse MoE 架构的数学原理、路由策略与负载均衡技术,涵盖从 Switch Transformer 到 DeepSeek-V3、Qwen3-235B 等最新 MoE 模型的设计选择,以及训练与推理的实战优化策略。
2026-03-06 · 30 分钟阅读 #ai-papers#moe#sparse-model#deepseek#2026-03BitNet 论文解析:1-Bit LLM 的时代 — 从三值权重到 CPU 推理
Microsoft Research 的 BitNet 系列(v1、b1.58、a4.8、2B4T)论文解析,从三值权重训练原理到 bitnet.cpp 推理框架、实战基准测试的综合指南。
2026-03-06 · 33 分钟阅读 #ai-papers#bitnet#1-bit-llm#quantization#model-efficiency从 DPO 到 KTO:人类反馈对齐技术最新论文综述与实战实现
综述克服 RLHF 局限的 DPO、IPO、KTO 等最新人类反馈对齐技术论文,并提供基于 TRL 的实战实现指南。涵盖算法对比、超参数调优,直至失败案例。
2026-03-05 · 31 分钟阅读 #ai-papers#dpo#kto#alignment#2026-03MLflow 2.x 实验追踪与模型注册表运维指南
从 MLflow 2.x 的实验追踪设计到模型注册表运维、Artifact 管理、CI/CD 集成、多租户、生产部署的实战指南。
2026-03-05 · 22 分钟阅读 #ai-platform#mlflow#model-registry#2026-03AI Platform Feature Store 同步设计
AI Platform Feature Store 同步设计 - 以 2026 年为基准的实务应用指南
2026-03-04 · 14 分钟阅读 #ai-platform#feature-store#2026-03AI 平台:Feature Store 与 RAGOps 蓝图 2026
AI 平台:以 Feature Store 与 RAGOps 蓝图 2026 为主题,包含 Why、How、When、对比表、故障排查、代码示例与测验的实战指南。
2026-03-04 · 18 分钟阅读 #ai-platform#2026-03AI 论文解读:Agentic Reasoning 实现指南 2026
以 AI 论文解读:Agentic Reasoning 实现指南 2026 为主题,包含 Why、How、When、对比表、故障排查、代码示例、测验的实战指南。
2026-03-04 · 22 分钟阅读 #ai-papers#2026-03Mixture of Experts(MoE)架构论文综述与实战扩展 2026
Mixture of Experts(MoE)架构核心论文分析。涵盖 Switch Transformer、GShard、ST-MoE 直到 Mixtral 的路由机制、专家并行化、负载均衡策略,从实战角度加以梳理。
2026-03-04 · 30 分钟阅读 #ai-papers#2026-03PostgreSQL 索引调优模式 2026
PostgreSQL 索引调优模式 2026 - 面向 2026 年的实务应用指南
2026-03-04 · 17 分钟阅读 #database#postgresql#2026-03AI 平台模型注册表与 A/B 部署流水线设计 2026
AI 平台模型注册表与 A/B 部署流水线设计。涵盖 MLflow Model Registry、模型版本管理、金丝雀/A/B 部署策略、KServe InferenceService、流量拆分,直至回滚。
2026-03-04 · 32 分钟阅读 #ai-platform#2026-03打造属于自己的 GPT — 用 nanoGPT 从零开始训练语言模型
借助 Andrej Karpathy 的 nanoGPT,从零开始训练 GPT 语言模型。结合代码,完整解剖 Transformer 架构的核心原理、分词器、Self-Attention、训练循环。
2026-03-03 · 8 分钟阅读 #ai#llm#gpt#nanogpt#transformer2026年人形机器人完全指南 — 从 Tesla Optimus 到 Unitree G1
2026年人形机器人市场的现状与未来。Tesla Optimus Gen 3、Boston Dynamics Atlas、Figure AI、Unitree G1、1X NEO — 比较主要玩家、技术栈、价格,以及实际部署现状。
2026-03-03 · 12 分钟阅读 #ai#robotics#humanoid-robot#tesla-optimus#boston-dynamics面向开发者的电子控制入门 — 从 Arduino 到 AI 机器人
面向软件开发者迈入硬件世界的指南。从 Arduino 基础到传感器控制、ESP32 IoT,再到 AI + 硬件融合项目。只要你会写代码,电子控制就比你想象的容易。
2026-03-03 · 9 分钟阅读 #ai#arduino#electronics#embedded#iot用 BentoML 搭建 ML 模型服务流水线:从打包到 Kubernetes 部署
一份关于用 BentoML 做 ML 模型服务的实战指南。涵盖模型打包、API 实现、多模型流水线、Docker 构建,直到 Kubernetes 部署。
2026-03-03 · 7 分钟阅读 #ai-platform#bentoml#model-serving#mlops#kubernetes用 Ray Serve 构建可扩展的 LLM 服务流水线
从 Ray Serve 支撑的 ML/LLM 模型服务核心概念开始,一路讲到多模型流水线、自动伸缩、批量推理与生产部署,并配有代码示例。
2026-03-03 · 7 分钟阅读 #ai-platform#ray-serve#model-serving#llm#mlopsRWKV: Reinventing RNNs for the Transformer Era — 从 v4 到 v7 Goose
分析克服 Transformer O(N²) 局限的 RWKV 架构。从 Linear Attention 与 RNN 的融合、选择性状态空间机制,到 v7 Goose 的创新,结合代码逐一梳理。
2026-03-03 · 12 分钟阅读 #ai-papers#rwkv#rnn#linear-attention#state-space-modelDiffusion Transformer(DiT)架构分析:从 U-Net 到 Transformer 的转变
本文分析 Scalable Diffusion Models with Transformers(DiT)论文。内容涵盖突破 U-Net 扩散模型局限、转向 Transformer 骨干网络的背景、adaLN-Zero 条件化机制、缩放定律,以及对 SORA、DALL-E 3 的影响。
2026-03-03 · 11 分钟阅读 #ai-papers#diffusion-transformer#dit#generative-ai#image-generationRWKV-7 "Goose" 架构分析 — 超越 Transformer 的线性时间模型
基于论文分析 RWKV-7 Goose 的 Dynamic State Evolution 机制、TC0 限制的突破,以及与 Transformer 的性能对比。这是一种能实现常数内存 + 线性时间推理的下一代架构。
2026-03-03 · 10 分钟阅读 #ai-papers#rwkv#linear-attention#sequence-modeling#2026-03Mixture of Experts(MoE)架构完全解析
从 Sparse MoE 的原理,到 Mixtral、DeepSeek-V3 的 MoE 实现、路由策略、负载均衡,完全解析 MoE 架构。
2026-03-03 · 6 分钟阅读 #ai-papers#moe#mixtral#deepseek#2026-03Kubeflow Pipelines v2 实战指南 — 用 KFP SDK 构建 ML 流水线
一份使用 Kubeflow Pipelines v2 的 KFP SDK 构建 ML 流水线的实战指南。以代码为中心,涵盖组件定义、流水线编写、Artifact 管理直至 Kubernetes 部署。
2026-03-03 · 25 分钟阅读 #ai-platform#kubeflow#kfp#mlops#pipeline