Skip to main content

概述

向量存储用于存储向量嵌入数据并执行相似度搜索。

接口

LangChain 为向量存储提供了统一的接口,允许您:
  • add_documents - 向存储中添加文档。
  • delete - 按 ID 删除已存储的文档。
  • similarity_search - 查询语义相似的文档。
这种抽象使您可以在不修改应用逻辑的情况下切换不同的实现。

初始化

要初始化向量存储,请为其提供向量嵌入模型:

添加文档

按如下方式添加 Document 对象(包含 page_content 和可选的元数据):

删除文档

通过指定 ID 进行删除:

相似度搜索

使用 similarity_search 执行语义查询,该方法返回最接近的向量嵌入文档:
许多向量存储支持以下参数:
  • k — 返回结果的数量
  • filter — 基于元数据的条件过滤

相似度指标与索引

向量嵌入相似度可以通过以下方式计算:
  • 余弦相似度
  • 欧几里得距离
  • 点积
高效搜索通常采用 HNSW(分层可导航小世界)等索引方法,但具体细节取决于所使用的向量存储。

元数据过滤

通过元数据(例如来源、日期)进行过滤可以精炼搜索结果:

热门集成

选择向量嵌入模型:
选择向量存储:
pip
Install the package and start Elasticsearch locally using the start-local script:
This creates an elastic-start-local folder. To start Elasticsearch:
Elasticsearch will be available at http://localhost:9200. The password for the elastic user and API key are stored in the .env file in the elastic-start-local folder.

所有向量存储

Activeloop Deep Lake

Alibaba Cloud MySQL

Alibaba Cloud OpenSearch

AnalyticDB

Annoy

Apache Doris

ApertureDB

Astra DB Vector Store

Atlas

AwaDB

Azure Cosmos DB Mongo vCore

Azure Cosmos DB No SQL

Azure Database for PostgreSQL - Flexible Server

Azure AI Search

Bagel

BagelDB

Baidu Cloud ElasticSearch VectorSearch

Baidu VectorDB

Apache Cassandra

Chroma

Clarifai

ClickHouse

CockroachDB

Couchbase

DashVector

Databricks

IBM Db2

DingoDB

DocArray HnswSearch

DocArray InMemorySearch

Amazon Document DB

DuckDB

China Mobile ECloud ElasticSearch

Elasticsearch

Epsilla

Faiss

Faiss (Async)

FalkorDB

Gel

Google AlloyDB

Google BigQuery Vector Search

Google Cloud SQL for MySQL

Google Cloud SQL for PostgreSQL

Firestore

Google Memorystore for Redis

Google Spanner

Google Bigtable

Google Vertex AI Feature Store

Google Vertex AI Vector Search

Hippo

Hologres

Jaguar Vector Database

Kinetica

LambdaDB

LanceDB

Lantern

Lindorm

LLMRails

ManticoreSearch

MariaDB

Marqo

Meilisearch

Amazon MemoryDB

Milvus

Momento Vector Index

Moorcheh

MongoDB Atlas

MyScale

Neo4j Vector Index

NucliaDB

Oceanbase

openGauss

OpenSearch

Oracle AI Database

Pathway

Postgres Embedding

PGVecto.rs

PGVector

PGVectorStore

Pinecone

Pinecone (sparse)

Qdrant

Relyt

Rockset

SAP HANA Cloud Vector Engine

ScaNN

SemaDB

SingleStore

scikit-learn

SQLiteVec

SQLite-VSS

SQLServer

StarRocks

Supabase

SurrealDB

Tablestore

Tair

Tencent Cloud VectorDB

Teradata VectorStore

ThirdAI NeuralDB

TiDB Vector

Tigris

TileDB

Timescale Vector

Typesense

turbopuffer

Upstash Vector

USearch

Vald

Valkey

VDMS

veDB for MySQL

Vearch

Vectara

Vespa

viking DB

vlite

Volcengine RDS for MySQL

Weaviate

Xata

YDB

Yellowbrick

Zep

Zep Cloud

ZeusDB

Zilliz

Zvec