Hive 개수 예외: WHERE 절로 인해 개수가 증가합니다.
Hive 데이터 탐색 중 이상한 현상이 관찰되었습니다. 간단한 설명 select count(*) as c from mytable
을 사용하여 계산하면 결과는 1,129,563입니다. 그러나 select count(*) as c from mytable where master_id is not null
필터를 추가하면 개수가 예기치 않게 1,134,041개로 늘어났습니다.
추가 조사에 따르면 master_id
열에는 항상 null이 아닌 값이 포함되어 있는 것으로 나타났습니다. 이는 다음과 같은 질문으로 이어집니다. null 값 제외 조건을 구현하면 실제로 행 수가 증가한다는 것을 어떻게 설명할 수 있을까요?
가능한 설명: Hive 통계
답은 Hive 통계의 영향을 이해하는 데 있습니다. 기본적으로 Hive는 통계를 활용하여 쿼리를 최적화하고 성능을 향상시킵니다. 필터링 없이 select count(*) as c from mytable
쿼리를 실행할 때 Hive는 저장된 통계를 사용하여 개수를 추정할 수 있습니다. 그러나 이러한 통계가 항상 정확하거나 최신인 것은 아닙니다.
이 경우 통계에 따르면 master_id
열에 null 값이 포함된 행이 많이 있는 것으로 나타날 수 있습니다. master_id is not null
필터를 추가할 때 Hive는 통계를 재평가하여 대부분의 행에 null이 아닌 값이 포함되어 있음을 인식했습니다. 이로 인해 눈에 띄는 불일치가 제거되어 보다 정확한 계산이 가능해집니다.
문제 해결 방법
정확한 개수를 얻으려면 특히 크게 변경되었거나 최근에 분석되지 않은 테이블로 작업할 때 다음을 수행하는 것이 좋습니다.
-
통계 비활성화:
hive.compute.query.using.stats=false
을 설정하여 Hive가 통계를 사용하지 못하게 하고 전체 테이블 스캔을 강제 실행합니다. -
통계 수집: 테이블 통계를 수동으로 업데이트하고 정확성을 보장하려면
ANALYZE TABLE
명령을 사용하세요. -
자동 통계 수집 활성화:
hive.stats.autogather=true
와 같은 데이터 작업 중에 통계를 자동으로 수집하려면INSERT OVERWRITE
을 설정하세요.
위 내용은 'WHERE master_id IS NOT NULL' 절을 추가하면 Hive에서 'COUNT(*)'가 증가하는 이유는 무엇입니까?의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

이 기사에서는 MySQL의 "공유 라이브러리를 열 수 없음"오류를 다룹니다. 이 문제는 MySQL이 필요한 공유 라이브러리 (.so/.dll 파일)를 찾을 수 없음에서 비롯됩니다. 솔루션은 시스템 패키지 M을 통한 라이브러리 설치 확인과 관련이 있습니다.

이 기사는 Docker에서 MySQL 메모리 사용을 최적화합니다. 모니터링 기술 (Docker Stats, Performance Schema, 외부 도구) 및 구성 전략에 대해 설명합니다. 여기에는 Docker 메모리 제한, 스와핑 및 CGroups와 함께 포함됩니다

이 기사는 MySQL의 Alter Table 문을 사용하여 열 추가/드롭 테이블/열 변경 및 열 데이터 유형 변경을 포함하여 테이블을 수정하는 것에 대해 설명합니다.

이 기사는 Linux에 MySQL을 직접 설치하는 것과 Phpmyadmin이없는 Podman 컨테이너 사용을 비교합니다. 각 방법에 대한 설치 단계에 대해 자세히 설명하면서 Podman의 격리, 이식성 및 재현성의 장점을 강조하지만 또한

이 기사는 자체 포함 된 서버리스 관계형 데이터베이스 인 SQLITE에 대한 포괄적 인 개요를 제공합니다. SQLITE의 장점 (단순성, 이식성, 사용 용이성) 및 단점 (동시성 제한, 확장 성 문제)에 대해 자세히 설명합니다. 기음

기사는 인증서 생성 및 확인을 포함하여 MySQL에 대한 SSL/TLS 암호화 구성에 대해 설명합니다. 주요 문제는 자체 서명 인증서의 보안 영향을 사용하는 것입니다. [문자 수 : 159]

이 안내서는 Homebrew를 사용하여 MacOS에 여러 MySQL 버전을 설치하고 관리하는 것을 보여줍니다. 홈 브루를 사용하여 설치를 분리하여 갈등을 방지하는 것을 강조합니다. 이 기사에는 설치, 서비스 시작/정지 서비스 및 Best Pra에 대해 자세히 설명합니다

기사는 MySQL Workbench 및 Phpmyadmin과 같은 인기있는 MySQL GUI 도구에 대해 논의하여 초보자 및 고급 사용자를위한 기능과 적합성을 비교합니다. [159 자].


핫 AI 도구

Undresser.AI Undress
사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover
사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool
무료로 이미지를 벗다

Clothoff.io
AI 옷 제거제

AI Hentai Generator
AI Hentai를 무료로 생성하십시오.

인기 기사

뜨거운 도구

맨티스BT
Mantis는 제품 결함 추적을 돕기 위해 설계된 배포하기 쉬운 웹 기반 결함 추적 도구입니다. PHP, MySQL 및 웹 서버가 필요합니다. 데모 및 호스팅 서비스를 확인해 보세요.

VSCode Windows 64비트 다운로드
Microsoft에서 출시한 강력한 무료 IDE 편집기

Dreamweaver Mac版
시각적 웹 개발 도구

SublimeText3 영어 버전
권장 사항: Win 버전, 코드 프롬프트 지원!

메모장++7.3.1
사용하기 쉬운 무료 코드 편집기
