标签: #vector-database
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 4 篇
为什么向量索引的默认值从 HNSW 变成了磁盘 — Elasticsearch bbq_disk 的权衡
从 Elasticsearch 9.4(2026-05-05)开始,float 向量的默认索引类型变成了 bbqdisk,也就是基于磁盘的 IVF。不到一年时间里,默认值从 int8hnsw 变成 bbqhnsw,又第二次变成了根本不是图结构的磁盘索引 — 这次迁移背后的判断是:向量检索真正昂贵的资源不是算力,而是 RAM。本文梳理了 HNSW 的内存悬崖在厂商基准测试里体现为怎样的数字、BBQ 从原始论文 RaBitQ 那里拿走了什么
2026-07-16 · 35 分钟阅读 #vector-database#elasticsearch#ann-index#quantization#hnswRAG 系统完全指南:检索增强生成的一切
全面掌握 RAG(检索增强生成)系统的指南。从基础 RAG 到 Self-RAG、Corrective-RAG、HyDE 等高级架构,涵盖向量数据库、嵌入模型、分块策略、重排序,并配有可直接用于生产的代码示例。
2026-03-17 · 34 分钟阅读 #rag#llm#vector-database#langchain#embedding数据库工程完全指南:从 SQL 到向量数据库、AI RAG 系统
从 SQL 高级技巧到 pgvector 向量检索、Pinecone、RAG 系统搭建 — 一份 AI 时代的数据库工程完全指南。
2026-03-17 · 26 分钟阅读 #database#postgresql#vector-database#pgvector#ragRAG:Retrieval-Augmented Generation 论文解析与生产架构
解析 RAG 论文的核心概念,梳理 Chunking 策略、Vector DB 选型、Advanced RAG 模式等生产级 RAG 系统设计。
2026-03-01 · 31 分钟阅读 #ai-papers#rag#llm#vector-database#langchain