Skip to main content
Pinecone 是一个功能广泛的向量数据库。
本笔记本介绍如何使用底层使用 Pinecone 和混合搜索的检索器。 该检索器的逻辑取自 此文档 要使用 Pinecone,您必须拥有 API 密钥和环境。 这里是 安装说明
我们要使用 OpenAIEmbeddings,所以我们需要获取 OpenAI API Key。

配置 Pinecone

这部分您只需执行一次。
现在索引已创建,我们可以使用它了。

获取嵌入和稀疏编码器

嵌入用于稠密向量,分词器用于稀疏向量
要将文本编码为稀疏值,您可以选择 SPLADE 或 BM25。对于域外任务,我们建议使用 BM25。 有关稀疏编码器的更多信息,您可以查看 pinecone-text 库的 文档
上面的代码使用的是默认 tf-idf 值。强烈建议将 tf-idf 值针对您自己的语料库进行拟合。您可以按如下方式操作:

加载检索器

我们现在可以构建检索器了!

添加文本(如有必要)

我们可以选择向检索器添加文本(如果它们尚未在其中)

使用检索器

我们现在可以使用检索器了!