标签: #gpt
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 3 篇
自然语言处理(NLP)完全指南:从零到精通 - 从文本处理到LLM
一份从 NLP 基础到最新 LLM 的完全指南。通过实战代码逐步学习文本预处理、Word2Vec、RNN/LSTM、Attention、Transformer、BERT、GPT。
2026-03-17 · 46 分钟阅读 #nlp#natural-language-processing#transformer#bert#gpt打造属于自己的 GPT — 用 nanoGPT 从零开始训练语言模型
借助 Andrej Karpathy 的 nanoGPT,从零开始训练 GPT 语言模型。结合代码,完整解剖 Transformer 架构的核心原理、分词器、Self-Attention、训练循环。
2026-03-03 · 8 分钟阅读 #ai#llm#gpt#nanogpt#transformerGPT 系列论文完全解析:从 GPT-1 到 GPT-4,语言模型改变世界的历程
按代际完整解析 OpenAI 的 GPT 系列。从 GPT-1 的无监督预训练、GPT-2 的 Zero-shot 学习、GPT-3 的 In-context Learning 与 Scaling Law、InstructGPT 的 RLHF,到 GPT-4 的多模态 — 用公式梳理每篇论文的核心贡献与架构演进。
2026-03-01 · 54 分钟阅读 #gpt#openai#language-model#transformer#pre-training