搜索
首页科技周边人工智能通过混合搜索和重新养活建立上下文的破布系统

本指南详细介绍了建立上下文检索增强生成(RAG)系统,通过合并上下文信息和混合搜索技术来增强标准的抹布方法。标准的抹布系统虽然有效地回答自定义数据的问题,但经常由于文档块而遭受上下文损失。改进的系统解决了这一限制。

目录:

  • 天真的抹布建筑
  • 天真的破布限制
  • 混合破布工作流程
  • 上下文检索解释了
  • 实施上下文检索
  • 上下文检索预处理
  • 与混合搜索和重新加工体系结构的上下文抹布
  • 实施实施:
    • 依赖性安装
    • OpenAI API密钥输入
    • 环境变量设置
    • 数据集采集
    • JSON Wikipedia文档处理
    • PDF研究论文处理以及上下文信息
    • 向量数据库索引和语义检索
    • BM25索引和关键字检索
    • 合奏检索的混合搜索
    • 用reranker增强回猎人
  • 常见问题

幼稚的抹布建筑:

基本的抹布系统涉及:

  1. 数据处理和索引:文档已加载,块,嵌入并存储在矢量数据库中。

通过混合搜索和重新养活建立上下文的破布系统

  1. 检索和响应生成:处理用户查询,检索类似的块,LLM使用检索到的上下文生成响应。

通过混合搜索和重新养活建立上下文的破布系统

幼稚的破布限制:

  • 由于孤立的块引起的上下文信息损失。
  • 次优率性能。
  • 仅依靠语义相似性。

混合抹布工作流程:

这种方法结合了语义和关键字搜索:

通过混合搜索和重新养活建立上下文的破布系统

BM25是TF-IDF的细化,用于关键字搜索,分组文档长度。两种方法的结果均使用相互等级融合(RRF)合并。

通过混合搜索和重新养活建立上下文的破布系统

上下文检索:

该技术通过准备大型语言模型(LLM)产生的上下文信息来增强质量。拟人化的研究突出了这种方法的好处。

通过混合搜索和重新养活建立上下文的破布系统

通过混合搜索和重新养活建立上下文的破布系统

通过混合搜索和重新养活建立上下文的破布系统

通过混合搜索和重新养活建立上下文的破布系统

上下文检索预处理体系结构:

通过混合搜索和重新养活建立上下文的破布系统

该管道处理文档,将它们块,使用LLM生成上下文信息,并将此上下文预先给每个块。讨论了LLM使用的成本优化策略。

带有混合搜索和重新加工体系结构的上下文抹布:

通过混合搜索和重新养活建立上下文的破布系统

该体系结构集成了上下文预处理,混合搜索(语义和关键字检索),集合检索(RRF)和Reranking(使用Baai/bge-reranker-V2-M3等跨编码模型)以提高检索准确性。

动手实施:本节提供了使用Langchain,Pymupdf,Chromadb,BM25和OpenAI的Embeddings和LLM的详细的分步指南。该代码涵盖数据加载,处理,索引,检索和响应生成。该示例使用Wikipedia文章和研究论文。使用样品查询测试管道证明了系统的有效性。

通过混合搜索和重新养活建立上下文的破布系统

结论:该指南成功地证明了通过混合搜索和重新计算的上下文抹布系统的构建,与幼稚的抹布系统相比,展示了提高的检索准确性和响应质量。

常见问题:本节回答了有关抹布系统,它们的局限性以及改进的架构中使用的技术的常见问题。

以上是通过混合搜索和重新养活建立上下文的破布系统的详细内容。更多信息请关注PHP中文网其他相关文章!

声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
为什么山姆·奥特曼(Sam Altman)和其他人现在将氛围用作AI最新进展的新规格为什么山姆·奥特曼(Sam Altman)和其他人现在将氛围用作AI最新进展的新规格May 06, 2025 am 11:12 AM

让我们讨论“共鸣”作为AI领域的评估度量的上升。该分析是我正在进行的《福布斯》列的一部分,探索了AI开发的复杂方面(请参见此处的链接)。 AI评估中的共鸣 传统

在Waymo工厂建造Robotaxi的未来在Waymo工厂建造Robotaxi的未来May 06, 2025 am 11:11 AM

Waymo的亚利桑那工厂:批量生产自动驾驶美洲虎及以后 Waymo位于亚利桑那州凤凰城附近,经营着最先进的设施,生产其自动jaguar i-pace电动SUV机队。 这个239,000平方英尺的工厂开业

在S&P Global的数据驱动转换内,AI处于核心在S&P Global的数据驱动转换内,AI处于核心May 06, 2025 am 11:10 AM

标准普尔全球首席数字解决方案官Jigar Kocherlakota讨论了公司的AI旅程,战略收购和未来的数字化转型。 变革性的领导角色和未来的准备团队 Kocherlakota的角色

超级应用的兴起:在数字生态系统中蓬勃发展的4个步骤超级应用的兴起:在数字生态系统中蓬勃发展的4个步骤May 06, 2025 am 11:09 AM

从应用到生态系统:导航数字景观 数字革命远远超出了社交媒体和AI。 我们正在见证“所有应用程序”的兴起 - 综合数字生态系统整合了生活的各个方面。 山姆A。

万事达卡和签证释放AI代理商为您购物万事达卡和签证释放AI代理商为您购物May 06, 2025 am 11:08 AM

万事达卡代理工资:AI驱动的付款革新商业 虽然Visa的AI驱动交易功能成为头条新闻,但万事达卡揭开了代理商的薪酬,是建立在代币化,信任和代理的基础上的更高级的AI本地支付系统

支持大胆:未来冒险的变革创新剧本支持大胆:未来冒险的变革创新剧本May 06, 2025 am 11:07 AM

Future Ventures Fund IV:一项耗资2亿美元的新技术押注 Future Ventures最近关闭了其超额认购的IV,总计2亿美元。 这项由史蒂夫·朱维森(Steve Jurvetson),玛丽娜·萨恩科(Maryanna Saenko)和尼科·恩里克斯(Nico Enriquez)管理的新基金代表

随着AI的使用飙升,公司从SEO转移到GEO随着AI的使用飙升,公司从SEO转移到GEOMay 05, 2025 am 11:09 AM

随着AI应用的爆炸式增长,企业正从传统的搜索引擎优化(SEO)转向生成式引擎优化(GEO)。 谷歌正引领这一转变。其“AI概述”功能已服务于超过十亿用户,在用户点击链接之前提供完整的答案。[^2] 其他参与者也在迅速崛起。ChatGPT、微软Copilot和Perplexity正在创造一种全新的“答案引擎”类别,完全绕过了传统的搜索结果。 如果您的企业没有出现在这些AI生成的答案中,潜在客户可能永远不会发现您——即使您在传统的搜索结果中排名靠前。 从SEO到GEO——这究竟意味着什么? 几十年来

大量赌注这些途径将推动当今的AI成为珍贵的AGI大量赌注这些途径将推动当今的AI成为珍贵的AGIMay 05, 2025 am 11:08 AM

让我们探索人工通用智能(AGI)的潜在途径。 该分析是我正在进行的《福布斯》列的AI进步的一部分,并深入研究了实现AGI和人工超智慧(ASI)的复杂性。 (请参阅相关艺术

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

Video Face Swap

Video Face Swap

使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热工具

PhpStorm Mac 版本

PhpStorm Mac 版本

最新(2018.2.1 )专业的PHP集成开发工具

Atom编辑器mac版下载

Atom编辑器mac版下载

最流行的的开源编辑器

WebStorm Mac版

WebStorm Mac版

好用的JavaScript开发工具

Dreamweaver Mac版

Dreamweaver Mac版

视觉化网页开发工具

SublimeText3 Linux新版

SublimeText3 Linux新版

SublimeText3 Linux最新版