찾다
백엔드 개발파이썬 튜토리얼Pandas를 사용한 CSV 파일의 데이터 조작: 단계 및 팁

Pandas를 사용한 CSV 파일의 데이터 조작: 단계 및 팁

Jan 10, 2024 am 11:54 AM
pandas데이터 작업CSV 파일

Pandas를 사용한 CSV 파일의 데이터 조작: 단계 및 팁

데이터 조작을 위해 팬더를 사용하여 CSV 파일을 읽는 단계 및 기술

소개:
데이터 분석 및 처리에서는 CSV 파일에서 데이터를 읽고 추가 작업 및 분석을 수행해야 하는 경우가 많습니다. pandas는 데이터 처리 및 분석을 위한 도구 세트를 제공하여 CSV 파일을 쉽게 처리하고 조작할 수 있게 해주는 강력한 Python 라이브러리입니다. 이 기사에서는 Pandas를 기반으로 CSV 파일을 읽는 단계와 기술을 소개하고 구체적인 코드 예제를 제공합니다.

1. 팬더 라이브러리 가져오기
팬더 라이브러리를 사용하기 전에 먼저 라이브러리를 가져와야 합니다. 다음 코드를 통해 이를 달성할 수 있습니다.

pandas를 pd로 가져오기

2. CSV 파일 읽기
CSV 파일 읽기는 pandas의 중요한 기능입니다. pandas는 후속 데이터 작업 및 분석을 용이하게 하기 위해 CSV 파일을 DataFrame 객체로 읽을 수 있는 read_csv() 함수를 제공합니다. 다음은 CSV 파일을 읽는 기본 코드 예제입니다.

data = pd.read_csv('file.csv')

위 코드에서 'file.csv'는 읽고 싶은 CSV 파일의 경로입니다. . 읽은 후 데이터는 data라는 DataFrame 개체에 저장됩니다.

3. 데이터 보기
CSV 파일을 읽은 후 head() 함수를 사용하여 데이터의 처음 몇 줄을 볼 수 있습니다. 이는 데이터의 구조와 데이터 정리의 필요성을 이해하는 데 매우 도움이 됩니다. 다음은 데이터를 보기 위한 코드 예제입니다.

print(data.head())

이 코드는 데이터의 처음 5개 행을 출력합니다.

4. 데이터 처리 및 운영
pandas는 데이터를 처리하고 운영하는 다양한 기능과 방법을 제공합니다. 아래에서는 일반적으로 사용되는 몇 가지 데이터 처리 기술을 소개합니다.

4.1 데이터 필터링
Pandas에서 제공하는 조건부 필터링 기능을 사용하면 필요한 데이터를 빠르게 필터링할 수 있습니다. 예를 들어 데이터에서 "city"가 "Beijing"인 데이터를 찾으려면 다음 코드를 사용할 수 있습니다.

filtered_data = data[data['city'] == 'Beijing']

In the 위 코드에서 data[' City'] == 'Beijing'은 데이터의 각 행이 조건을 충족하는지 여부를 나타내는 부울 값 시리즈를 반환합니다. 그런 다음 이 부울 시리즈를 인덱스로 사용하여 조건을 충족하는 데이터를 필터링하고 이를filtered_data에 저장합니다.

4.2 데이터 정렬
pandas는 데이터를 정렬하는 sort_values() 함수를 제공합니다. 다음은 "sales" 열을 기준으로 데이터를 내림차순으로 정렬하는 코드 예제입니다.

sorted_data = data.sort_values(by='sales', climbing=False)

위 코드는 데이터를 "sales" 열에 따라 정렬합니다. "sales" 열 내림차순으로 정렬하고 정렬된 결과를 sorted_data에 저장합니다.

4.3 데이터 그룹화 및 집계
pandas는 데이터 그룹화 및 집계 작업을 쉽게 구현할 수 있는 groupby() 함수와 agg() 함수를 제공합니다. 다음은 "City" 열을 기준으로 데이터를 그룹화하고 각 도시의 총 매출을 계산하는 코드 예제입니다.

grouped_data = data.groupby('City').agg({'Sales':'sum'})

위 코드는 "City" 열을 기준으로 데이터를 그룹화하고 agg() 함수를 사용하여 각 그룹(도시)의 총 매출을 계산합니다. 결과는 grouped_data에 저장됩니다.

5. 데이터 출력
데이터를 처리한 후 데이터를 CSV 파일이나 다른 형식의 파일로 출력할 수 있습니다. DataFrame 객체를 CSV 파일로 출력하려면 pandas의 to_csv() 함수를 사용하세요. 다음은 grouped_data를 CSV 파일로 출력하는 코드 예제입니다.

grouped_data.to_csv('grouped_data.csv')

위 코드는 grouped_data를 'grouped_data.csv'라는 이름의 CSV 파일로 출력합니다.

결론:
이 문서에서는 팬더를 사용하여 데이터 조작을 위해 CSV 파일을 읽는 기본 단계와 일반적인 기술을 소개하고 구체적인 코드 예제를 제공합니다. 이러한 기술을 익히면 CSV 파일을 쉽게 읽고 처리할 수 있으며 데이터 분석 및 데이터 작업을 빠르게 수행할 수 있습니다. Pandas 라이브러리를 사용하면 데이터 처리 효율성이 크게 향상되어 데이터 분석 작업이 더욱 편리하고 효율적으로 이루어집니다.

위 내용은 Pandas를 사용한 CSV 파일의 데이터 조작: 단계 및 팁의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
Python 학습 : 2 시간의 일일 연구가 충분합니까?Python 학습 : 2 시간의 일일 연구가 충분합니까?Apr 18, 2025 am 12:22 AM

하루에 2 시간 동안 파이썬을 배우는 것으로 충분합니까? 목표와 학습 방법에 따라 다릅니다. 1) 명확한 학습 계획을 개발, 2) 적절한 학습 자원 및 방법을 선택하고 3) 실습 연습 및 검토 및 통합 연습 및 검토 및 통합,이 기간 동안 Python의 기본 지식과 고급 기능을 점차적으로 마스터 할 수 있습니다.

웹 개발을위한 파이썬 : 주요 응용 프로그램웹 개발을위한 파이썬 : 주요 응용 프로그램Apr 18, 2025 am 12:20 AM

웹 개발에서 Python의 주요 응용 프로그램에는 Django 및 Flask 프레임 워크 사용, API 개발, 데이터 분석 및 시각화, 머신 러닝 및 AI 및 성능 최적화가 포함됩니다. 1. Django 및 Flask 프레임 워크 : Django는 복잡한 응용 분야의 빠른 개발에 적합하며 플라스크는 소형 또는 고도로 맞춤형 프로젝트에 적합합니다. 2. API 개발 : Flask 또는 DjangorestFramework를 사용하여 RESTFULAPI를 구축하십시오. 3. 데이터 분석 및 시각화 : Python을 사용하여 데이터를 처리하고 웹 인터페이스를 통해 표시합니다. 4. 머신 러닝 및 AI : 파이썬은 지능형 웹 애플리케이션을 구축하는 데 사용됩니다. 5. 성능 최적화 : 비동기 프로그래밍, 캐싱 및 코드를 통해 최적화

Python vs. C : 성능과 효율성 탐색Python vs. C : 성능과 효율성 탐색Apr 18, 2025 am 12:20 AM

Python은 개발 효율에서 C보다 낫지 만 C는 실행 성능이 높습니다. 1. Python의 간결한 구문 및 풍부한 라이브러리는 개발 효율성을 향상시킵니다. 2.C의 컴파일 유형 특성 및 하드웨어 제어는 실행 성능을 향상시킵니다. 선택할 때는 프로젝트 요구에 따라 개발 속도 및 실행 효율성을 평가해야합니다.

Python in Action : 실제 예제Python in Action : 실제 예제Apr 18, 2025 am 12:18 AM

Python의 실제 응용 프로그램에는 데이터 분석, 웹 개발, 인공 지능 및 자동화가 포함됩니다. 1) 데이터 분석에서 Python은 Pandas 및 Matplotlib를 사용하여 데이터를 처리하고 시각화합니다. 2) 웹 개발에서 Django 및 Flask 프레임 워크는 웹 응용 프로그램 생성을 단순화합니다. 3) 인공 지능 분야에서 Tensorflow와 Pytorch는 모델을 구축하고 훈련시키는 데 사용됩니다. 4) 자동화 측면에서 파이썬 스크립트는 파일 복사와 같은 작업에 사용할 수 있습니다.

Python의 주요 용도 : 포괄적 인 개요Python의 주요 용도 : 포괄적 인 개요Apr 18, 2025 am 12:18 AM

Python은 데이터 과학, 웹 개발 및 자동화 스크립팅 필드에 널리 사용됩니다. 1) 데이터 과학에서 Python은 Numpy 및 Pandas와 같은 라이브러리를 통해 데이터 처리 및 분석을 단순화합니다. 2) 웹 개발에서 Django 및 Flask 프레임 워크를 통해 개발자는 응용 프로그램을 신속하게 구축 할 수 있습니다. 3) 자동 스크립트에서 Python의 단순성과 표준 라이브러리가 이상적입니다.

파이썬의 주요 목적 : 유연성과 사용 편의성파이썬의 주요 목적 : 유연성과 사용 편의성Apr 17, 2025 am 12:14 AM

Python의 유연성은 다중 파리가 지원 및 동적 유형 시스템에 반영되며, 사용 편의성은 간단한 구문 및 풍부한 표준 라이브러리에서 나옵니다. 유연성 : 객체 지향, 기능 및 절차 프로그래밍을 지원하며 동적 유형 시스템은 개발 효율성을 향상시킵니다. 2. 사용 편의성 : 문법은 자연 언어에 가깝고 표준 라이브러리는 광범위한 기능을 다루며 개발 프로세스를 단순화합니다.

파이썬 : 다목적 프로그래밍의 힘파이썬 : 다목적 프로그래밍의 힘Apr 17, 2025 am 12:09 AM

Python은 초보자부터 고급 개발자에 이르기까지 모든 요구에 적합한 단순성과 힘에 호의적입니다. 다목적 성은 다음과 같이 반영됩니다. 1) 배우고 사용하기 쉽고 간단한 구문; 2) Numpy, Pandas 등과 같은 풍부한 라이브러리 및 프레임 워크; 3) 다양한 운영 체제에서 실행할 수있는 크로스 플랫폼 지원; 4) 작업 효율성을 향상시키기위한 스크립팅 및 자동화 작업에 적합합니다.

하루 2 시간 안에 파이썬 학습 : 실용 가이드하루 2 시간 안에 파이썬 학습 : 실용 가이드Apr 17, 2025 am 12:05 AM

예, 하루에 2 시간 후에 파이썬을 배우십시오. 1. 합리적인 학습 계획 개발, 2. 올바른 학습 자원을 선택하십시오. 3. 실습을 통해 학습 된 지식을 통합하십시오. 이 단계는 짧은 시간 안에 Python을 마스터하는 데 도움이 될 수 있습니다.

See all articles

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

뜨거운 도구

VSCode Windows 64비트 다운로드

VSCode Windows 64비트 다운로드

Microsoft에서 출시한 강력한 무료 IDE 편집기

메모장++7.3.1

메모장++7.3.1

사용하기 쉬운 무료 코드 편집기

MinGW - Windows용 미니멀리스트 GNU

MinGW - Windows용 미니멀리스트 GNU

이 프로젝트는 osdn.net/projects/mingw로 마이그레이션되는 중입니다. 계속해서 그곳에서 우리를 팔로우할 수 있습니다. MinGW: GCC(GNU Compiler Collection)의 기본 Windows 포트로, 기본 Windows 애플리케이션을 구축하기 위한 무료 배포 가능 가져오기 라이브러리 및 헤더 파일로 C99 기능을 지원하는 MSVC 런타임에 대한 확장이 포함되어 있습니다. 모든 MinGW 소프트웨어는 64비트 Windows 플랫폼에서 실행될 수 있습니다.

WebStorm Mac 버전

WebStorm Mac 버전

유용한 JavaScript 개발 도구

SublimeText3 Linux 새 버전

SublimeText3 Linux 새 버전

SublimeText3 Linux 최신 버전