网站页面优化签象客,网站模板 代码免费,app制作教程步骤和方法,网站网页基本情况 网页栏目设置本文是LLM系列文章#xff0c;针对《Vector Search with OpenAI Embeddings: Lucene Is All You Need》的翻译。  使用OpenAI嵌入的向量搜索#xff1a;Lucence是你所需的一切 摘要1 引言2 从架构到实现3 实验4 讨论5 结论 摘要 
我们在流行的MS MARCO文章排名测试集上使用Lu…本文是LLM系列文章针对《Vector Search with OpenAI Embeddings: Lucene Is All You Need》的翻译。  使用OpenAI嵌入的向量搜索Lucence是你所需的一切 摘要1 引言2 从架构到实现3 实验4 讨论5 结论 摘要 
我们在流行的MS MARCO文章排名测试集上使用Lucene提供了一个可复制的、端到端的OpenAI嵌入向量搜索演示。我们工作的主要目标是挑战主流的说法即专用向量存储是利用深度神经网络应用于搜索的最新进展所必需的。恰恰相反我们表明Lucene中的分层可导航小世界网络HNSW索引足以在标准双编码器架构中提供向量搜索功能。这表明从简单的成本效益分析来看似乎没有令人信服的理由将专用向量存储引入现代“人工智能堆栈”中进行搜索因为这些应用程序已经在现有的、广泛部署的基础设施中获得了大量投资。 
1 引言 
2 从架构到实现 
3 实验 
4 讨论 
5 结论 
毫无疑问密集向量的操作是当今搜索的重要组成部分。我们要解决的核心争论是如何在生产系统中实施和部署这些功能。主流的说法是你需要一个新的、独特的添加到你的企业“AI堆栈”中——一个向量存储。我们提出的另一种选择是如果你已经构建了搜索应用程序那么你很可能已经投资于Lucene生态系统。在这种情况下Lucene就是您所需要的全部。当然时间会告诉我们谁是对的。