NLP与大模型难度 ★★★★☆
向量数据库
存的不是表格,是一堆高维向量,查的是"谁离我最近"
分享:
📖 详细解释
🎯 一句话定义
存的不是表格,是一堆高维向量,查的是"谁离我最近"
⚙️ 工作原理
向量数据库专门优化了ANN(近似最近邻)搜索,支持亿级向量毫秒级检索。常用算法:HNSW、IVF、PQ。主流产品:Pinecone、Milvus、Weaviate、Chroma
💡 生活类比
"就像蜂巢——每个格子存一个向量,查询时同时跟很多向量比距离,快速找到最近的邻居"
🌍 真实应用
RAG应用的核心组件、推荐系统、人脸识别、图像检索,任何需要"找相似"的场景