elastic联合英伟达、戴尔和红帽推出gpu加速矢量搜索集成,支持rag与代理ai在云、混合云及本地环境的规模化部署。

搜索引擎AI公司Elastic(纽约证券交易所代码:ESTC)已扩展与英伟达、戴尔科技和红帽的集成,帮助企业通过高性能矢量搜索和加速计算,加快向量级人工智能的生产规模转型。这些集成将Elastic的矢量数据库功能与GPU加速、经过验证的AI工厂设计以及企业级基础设施相结合,使组织能够构建和扩展RAG和代理AI应用程序。
随着企业在人工智能领域投入巨资,成功依赖于能够存储大量数据、获取实时情境以及利用企业数据源采取行动的代理人工智能。Elastic 及其合作伙伴正在通过经过验证的人工智能基础架构平台实现多重集成,实现这一基础。
弹性+英伟达:GPU加速矢量索引(技术预览)
Elastic 和 NVIDIA 正在以 NVIDIA cuVS 提供支持,通过 Elasticsearch 提供 GPU 加速矢量索引。Elastic 提供了实时的上下文检索层,可将正确的数据引入 AI 模型,使其能够响应并正确操作;而 NVIDIA cuVS 和 NVIDIA GPU 则加速了处理大型矢量数据集所需的繁重计算。这种结合使企业能够更快、更高效地构建生产规模的人工智能应用。Elasticsearch 还集成在 NVIDIA Enterprise AI Factory 验证设计中,这是一种全栈解决方案,可供企业自行构建和部署本地 AI 工厂。
由NVIDIA cuVS驱动的Elasticsearch现在能够比基于CPU的方法更快地索引矢量数据,从而消除一个主要瓶颈,从而阻止许多组织在生产规模上部署生成式人工智能、RAG和特定的AI系统。
英伟达战略企业合作副总裁帕特·李表示:“随着企业从人工智能实验转向全面生产,他们需要采用一类新的加速数据基础设施,以高效处理庞大的矢量数据量。”我们与Elastic在GPU加速矢量索引上的协作,采用NVIDIA cuVS,为企业在RAG和代理AI系统大规模实时性能部署需求方面提供了高性能基础。
这款由 Elastic 和 NVIDIA 加速的 GPU 加速矢量索引也正与戴尔和红帽公司集成,集成到全新的企业级人工智能解决方案中。
弹性+戴尔:戴尔数据搜索引擎
Elastic 和戴尔开发了戴尔数据搜索引擎,这是一个由 Elasticsearch 驱动、NVIDIA cuVS 加速的矢量数据库,与 NVIDIA 原生集成在戴尔人工智能数据平台中。
该解决方案内置于戴尔人工智能数据平台中,支持企业将数字节的非结构化数据转化为人工智能工作负载的实时可操作环境。它使人工智能智能能够利用企业数据进行推理、学习和行动,同时降低部署复杂性和管理成本。
弹性+红帽:面向混合云的AI工厂
Elastic 和 Red Hat 已合作,将由 NVIDIA cuVS 支持的 GPU 加速矢量搜索技术应用于企业级混合云环境。通过将Elastic的实时搜索和矢量数据库功能与Red Hat OpenShift的Kubernetes功能相结合,用户将获得一种经过安全优化、可扩展的AI工厂参考设计,用于构建生产级RAG系统和自主AI代理。Red Hat AI Factory with NVIDIA配备英伟达的红帽AI工厂将这一参考设计扩展为一个协同设计的堆栈,用于标准化这些经过GPU加速的RAG和代理工作负载在混合云环境中的开发、部署和管理。
红帽公司OpenShift为企业提供了重要的、以Kubernetes为生的基础,使其能够在任何混合云环境中实现人工智能工作负载的运行和扩展,”红帽公司生态系统开发高级总监凯蒂·吉利奥表示。通过以英伟达(NVIDIA)的速度在红帽OpenShift和红帽AI上实现Elastic的GPU加速搜索,我们共同提供一个具备生产准备功能的开放平台,帮助客户在完全掌控数据主权的同时,构建安全、高性能的RAG和自主AI代理。
“企业正迅速从人工智能实验转向全面生产,而这种转变需要现代化的数据和基础设施基础Steve Kearns, general manager, Search and AI at Elastic,”Elastic公司搜索与人工智能总经理史蒂夫·凯恩斯表示。通过英伟达、戴尔和红帽,我们使组织能够更高效、更高效地将大量非结构化数据转化为实时环境,以实现RAG、生成式人工智能和代理系统的规模。
这些集成共同扩展了弹性人工智能生态系统,为组织提供了灵活的选项,可在云、混合环境和本地环境中部署通过 GPU 加速的矢量搜索。











