GraphRAG 이해(1): RAG의 과제-일체 포함-php.cn

집

기술 주변기기

일체 포함

GraphRAG 이해(1): RAG의 과제

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Apr 30, 2024 pm 07:10 PM

llmrag

RAG(Risk Assessment Grid)는 보다 상황에 맞는 답변을 제공하기 위해 외부 지식 소스로 기존 LLM(대형 언어 모델)을 강화하는 방법입니다. RAG에서 검색 구성 요소는 추가 정보를 얻고 응답은 특정 소스를 기반으로 한 다음 이 정보를 LLM 프롬프트에 제공하여 LLM의 응답이 이 정보를 기반으로 합니다(향상 단계). RAG는 트리밍과 같은 다른 기술에 비해 경제적입니다. 또한 이 정보(증강 단계)를 기반으로 추가 컨텍스트를 제공하여 환각을 줄이는 이점이 있습니다. RAG는 오늘날의 LLM 작업(예: 추천, 텍스트 추출, 감정 분석 등)을 위한 워크플로 방법이 됩니다.

GraphRAG 이해(1): RAG의 과제

이 아이디어를 더 세분화하면 사용자 의도에 따라 일반적으로 벡터 데이터베이스를 쿼리합니다. 벡터 데이터베이스는 연속 벡터 공간을 사용하여 근접 기반 검색을 통해 두 개념 간의 관계를 캡처합니다.

벡터 데이터베이스 개요

벡터 공간에서는 텍스트, 이미지, 오디오 또는 기타 유형의 정보가 벡터로 변환됩니다. 벡터는 고차원 공간의 데이터를 수치로 표현한 것입니다. 각 차원은 데이터의 특성에 해당하며, 각 차원의 값은 해당 특성의 강도나 존재 여부를 반영합니다. 벡터 표현을 통해 데이터에 대한 수학적 연산, 거리 계산, 유사성 비교 등을 수행할 수 있습니다. 다양한 치수에 해당하는 값은 기능의 강도 또는 존재 여부를 반영합니다. 텍스트 데이터를 예로 들면, 각 문서는 벡터로 표현될 수 있으며, 여기서 각 차원은 문서에 있는 단어의 빈도를 나타냅니다. 이런 방식으로 두 문서는

벡터 사이의 거리를 계산하고 해당 데이터베이스를 다른 벡터로 쿼리하고 벡터 공간 벡터에서 "가까운" 항목을 검색하여 데이터베이스에서 근접성 기반 검색을 수행할 수 있습니다. 벡터 사이의 근접성은 일반적으로 유클리드 거리, 코사인 유사성 또는 맨해튼 거리와 같은 거리 측정값에 의해 결정됩니다. 벡터 사이의 근접성은 일반적으로 유클리드 거리, 코사인 유사성 또는 맨해튼 거리와 같은 거리 측정값에 의해 결정됩니다.

데이터베이스 검색을 수행하면 시스템이 벡터로 변환하는 쿼리를 제공합니다. 그런 다음 데이터베이스는 이 쿼리 벡터와 이미 데이터베이스에 저장된 벡터 간의 거리 또는 유사성을 계산합니다. 선택한 메트릭에 따라 쿼리 벡터에 가까운 벡터가 가장 관련성이 높은 결과로 간주됩니다. 선택한 측정항목을 기준으로 쿼리 벡터에 가장 가까운 이러한 벡터는 가장 관련성이 높은 결과로 간주됩니다.

근접 기반 검색은 벡터 데이터베이스에서 특히 강력하며 추천 시스템, 정보 검색, 이상 탐지와 같은 작업에 적합합니다.

이 접근 방식을 사용하면 시스템이 표면 일치에만 의존하기보다는 데이터의 맥락과 더 깊은 의미를 이해함으로써 보다 직관적으로 작동하고 사용자 쿼리에 보다 효과적으로 응답할 수 있습니다.

그러나 데이터 품질, 동적 지식 처리 능력, 투명성 등 고급 검색을 위해 데이터베이스에 연결하는 애플리케이션에는 몇 가지 제한 사항이 있습니다.

RAG의 한계

RAG는 문서의 크기에 따라 크게 3가지로 분류됩니다. ), 쿼리에 대한 응답으로 인덱싱되고 사용되는 블록을 쿼리할 때 더 작은 데이터가 생성됩니다.

성공에도 불구하고 RAG에는 몇 가지 단점이 있습니다.

RAG의 성능을 측정하는 두 가지 주요 지표는 당혹감과 환각입니다. 당혹스러움은 텍스트 생성 과정에서 똑같이 가능한 다음 단어 선택 수를 나타냅니다. 즉, 언어 모델을 선택할 때 얼마나 "혼란"되는지를 나타냅니다. 환각은 AI가 만든 허위 또는 상상의 진술입니다.

RAG는 환각을 줄이는 데 도움이 되지만 완전히 없애지는 않습니다. 작고 간결한 문서가 있으면 혼란을 줄이고(LLM 옵션이 적기 때문에) 환각을 줄일 수 있습니다(문서에 내용만 묻는 경우). 물론, 단점은 하나의 작은 문서로 인해 사소한 응용 프로그램이 생성된다는 것입니다. 더 복잡한 애플리케이션의 경우 더 많은 컨텍스트를 제공할 수 있는 방법이 필요합니다.

예를 들어 "bark"라는 단어를 생각해 보세요. 최소한 두 가지 다른 컨텍스트가 있습니다.

나무 컨텍스트: "떡갈나무의 거친 껍질은 추위로부터 나무를 보호합니다." : "이웃집 개는 누군가 집을 지나갈 때마다 큰 소리로 짖습니다."

더 많은 맥락을 제공하는 한 가지 방법은 RAG와 지식 그래프(GRAPHRAG)를 결합하는 것입니다.

지식 그래프에서는 이러한 단어가 해당 단어와 관련된 문맥 및 의미와 연결되어 있습니다. 예를 들어, "bark"는 "tree"와 "dog"를 나타내는 노드에 연결됩니다. 다른 연결은 일반적인 행동(예: 나무의 "보호", 개의 "소음 만들기") 또는 속성(예: 나무의 "거칠기", 개의 "소리 크기")을 나타낼 수 있습니다. 이 구조화된 정보를 통해 언어 모델은 문장의 다른 단어나 대화의 전체 주제를 기반으로 적절한 의미를 선택할 수 있습니다.

다음 섹션에서는 RAG의 한계와 GRAPHRAG가 이를 해결하는 방법을 살펴보겠습니다.

원제: GraphRAG 이해 – 1: RAG의 과제

원작자: ajitjaokar

위 내용은 GraphRAG 이해(1): RAG의 과제의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

성명

이 기사는 51CTO.COM에서 복제됩니다. 침해가 있는 경우 admin@php.cn으로 문의하시기 바랍니다. 삭제

관련 기사

에이전트가오고 있습니다 - AI 파트너 옆에서 우리가 할 일에 대해 더 많이Apr 29, 2025 am 11:13 AM

AI의 미래는 간단한 단어 예측과 대화 시뮬레이션을 넘어서고 있습니다. AI 에이전트는 새로운 행동 및 작업 완료가 가능합니다. 이러한 변화는 이미 Anthropic의 Claude와 같은 도구에서 분명합니다. AI 요원 : 연구 a

AI 중심의 미래에 리더를위한 통제보다 공감이 더 중요한 이유Apr 29, 2025 am 11:12 AM

빠른 기술 발전은 미래의 업무에 대한 미래 지향적 인 관점을 필요로합니다. AI가 단순한 생산성 향상을 초월하고 사회적 구조를 형성하기 시작하면 어떻게됩니까? Topher McDougal의 다가오는 책인 Gaia Wakes :

제품 분류를위한 AI : 기계가 세법을 마스터 할 수 있습니까?Apr 29, 2025 am 11:11 AM

조화 시스템 (HS)과 같은 시스템의 "HS 8471.30"과 같은 복잡한 코드를 포함하는 제품 분류는 국제 무역 및 국내 판매에 중요합니다. 이 코드는 올바른 세금 신청을 보장하여 모든 inv에 영향을 미칩니다

데이터 센터 요구가 기후 기술 반등을 일으킬 수 있습니까?Apr 29, 2025 am 11:10 AM

데이터 센터 및 기후 기술 투자의 에너지 소비의 미래 이 기사는 AI가 주도하는 데이터 센터의 에너지 소비 급증과 기후 변화에 미치는 영향을 탐구 하고이 과제를 해결하기 위해 혁신적인 솔루션 및 정책 권장 사항을 분석합니다. 에너지 수요의 과제 : 대규모 및 초대형 스케일 데이터 센터는 수십만 명의 일반 북미 가족의 합과 비슷한 대규모 전력을 소비하며, AI 초반 규모 센터는 이보다 수십 배 더 많은 힘을 소비합니다. 2024 년 첫 8 개월 동안 Microsoft, Meta, Google 및 Amazon은 AI 데이터 센터의 건설 및 운영에 약 1,250 억 달러를 투자했습니다 (JP Morgan, 2024) (표 1). 에너지 수요 증가는 도전이자 기회입니다. 카나리아 미디어에 따르면 다가오는 전기

AI와 할리우드의 다음 황금 시대Apr 29, 2025 am 11:09 AM

생성 AI는 영화 및 텔레비전 제작을 혁신하고 있습니다. Luma의 Ray 2 모델과 활주로의 Gen-4, Openai의 Sora, Google의 VEO 및 기타 새로운 모델은 전례없는 속도로 생성 된 비디오의 품질을 향상시키고 있습니다. 이 모델은 복잡한 특수 효과와 현실적인 장면을 쉽게 만들 수 있으며 짧은 비디오 클립과 카메라로 인식 된 모션 효과조차도 달성되었습니다. 이러한 도구의 조작과 일관성은 여전히 개선되어야하지만 진행 속도는 놀랍습니다. 생성 비디오는 독립적 인 매체가되고 있습니다. 일부 모델은 애니메이션 제작에 능숙하고 다른 모델은 라이브 액션 이미지에 능숙합니다. Adobe 's Firefly와 Moonvalley's MA가

chatgpt가 천천히 AI의 가장 큰 예-맨이되고 있습니까?Apr 29, 2025 am 11:08 AM

ChatGpt 사용자 경험 감소 : 모델 저하 또는 사용자 기대치입니까? 최근에, 많은 ChatGpt 유료 사용자가 성능 저하에 대해 불평하여 광범위한 관심을 끌었습니다. 사용자는 모델에 대한 느린 반응, 짧은 답변, 도움 부족 및 더 많은 환각을보고했습니다. 일부 사용자는 소셜 미디어에 대한 불만을 표명했으며 Chatgpt가“너무 아첨”이되었으며 중요한 피드백을 제공하기보다는 사용자보기를 확인하는 경향이 있습니다. 이는 사용자 경험에 영향을 줄뿐만 아니라 생산성 감소 및 컴퓨팅 리소스 낭비와 같은 회사 고객에게 실제 손실을 가져옵니다. 성능 저하의 증거 많은 사용자들이 ChatGpt 성능, 특히 GPT-4와 같은 이전 모델 (이번 달 말에 서비스에서 곧 중단 될 예정)에서 상당한 악화를보고했습니다. 이것

우리는 어떤 AI 유산을 세대 알파를 떠나나요?Apr 29, 2025 am 11:07 AM

알파 세대와 AI 혁명 Alpha Generation (2010-2024 년 출생)은 독특하게 위치하고 있습니다. 그들은 일상 생활에 깊이 짜여진 기술인 생성 AI와 함께 자랍니다. 그러나이 광범위한 접근은 주로 i가 즐겼습니다

AI 내부 배포의 숨겨진 위험 : 거버넌스 격차 및 치명적인 위험Apr 28, 2025 am 11:12 AM

Apollo Research의 새로운 보고서에 따르면 고급 AI 시스템의 점검되지 않은 내부 배치는 상당한 위험을 초래합니다. 주요 AI 기업들 사이에서 널리 퍼져있는 이러한 감독 부족은 uncont에서 범위에 이르는 잠재적 인 치명적인 결과를 허용합니다.

See all articles

핫 AI 도구

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

AI 옷 제거제

Video Face Swap

완전히 무료인 AI 얼굴 교환 도구를 사용하여 모든 비디오의 얼굴을 쉽게 바꾸세요!

뜨거운 도구

Dreamweaver Mac版

시각적 웹 개발 도구

mPDF

mPDF는 UTF-8로 인코딩된 HTML에서 PDF 파일을 생성할 수 있는 PHP 라이브러리입니다. 원저자인 Ian Back은 자신의 웹 사이트에서 "즉시" PDF 파일을 출력하고 다양한 언어를 처리하기 위해 mPDF를 작성했습니다. HTML2FPDF와 같은 원본 스크립트보다 유니코드 글꼴을 사용할 때 속도가 느리고 더 큰 파일을 생성하지만 CSS 스타일 등을 지원하고 많은 개선 사항이 있습니다. RTL(아랍어, 히브리어), CJK(중국어, 일본어, 한국어)를 포함한 거의 모든 언어를 지원합니다. 중첩된 블록 수준 요소(예: P, DIV)를 지원합니다.