Python 正規表現は、テキスト データを処理するための強力なツールです。正規表現は、テキストからデータを抽出、変換、視覚化するのに役立ちます。この記事では、Python 正規表現を使用してデータを視覚化する方法を紹介します。
- 関連ライブラリのインポート
開始する前に、必要な Python ライブラリ (Pandas、Matplotlib、Re) をインストールする必要があります。 pipを使用してインストールできます。
pip install pandas matplotlib re
次に、これらのライブラリを Python ファイルにインポートする必要があります。
import pandas as pd import matplotlib.pyplot as plt import re
- データの読み取り
この記事では、インフルエンザのパンデミック中の収入と支出に関するデータを含むスプレッドシート ファイルを使用します。まず、pandas ライブラリの read_excel 関数を使用して、スプレッドシート ファイルのデータを読み取る必要があります。
df = pd.read_excel('data.xlsx')
- データ前処理
正規表現を使用してデータを視覚化する前に、いくつかのデータ前処理操作を実行する必要があります。この記事では、次の 2 つの前処理手順について説明します。
- データの書式を解除する: スプレッドシート ファイルの各セルには、通貨値やパーセンテージなどの書式設定されたデータが含まれる場合があります。次のステップに進むには、これらのフォーマットされたデータをフォーマット解除する必要があります。
- データの抽出: 視覚化するには、各セルからデータを抽出する必要があります。正規表現を使用して特定のデータを抽出できます。
次の関数はデータの書式を解除できます:
def strip_currency(val): return re.sub(r'[^d.]', '', val)
次の関数は特定のデータを抽出できます:
def extract_number(val): return re.findall(r'd+.?d*', val)[0]
次の関数は、apply 関数を使用してスプレッドシートに適用できます。それぞれの細胞。上記の関数を適用するコードは次のとおりです:
df['income'] = df['income'].apply(strip_currency).apply(extract_number).astype(float) df['expenses'] = df['expenses'].apply(strip_currency).apply(extract_number).astype(float)
- データの視覚化
各セルからデータをフォーマット解除して抽出したら、Matplotlib ライブラリを使用できるようになります。それを視覚化します。この記事では、散布図を使用して収入と支出の関係を表します。
plt.scatter(df['income'], df['expenses']) plt.xlabel('Income') plt.ylabel('Expenses') plt.show()
このコードは、横軸に収入、縦軸に支出をとった散布図を作成します。
これは、データ視覚化に Python 正規表現を使用する方法の基本的な手順です。データをより深く理解するために、必要に応じてデータの処理と視覚化を続けることができます。
以上がデータ視覚化に Python 正規表現を使用する方法の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

PythonはゲームとGUI開発に優れています。 1)ゲーム開発は、2Dゲームの作成に適した図面、オーディオ、その他の機能を提供し、Pygameを使用します。 2)GUI開発は、TKINTERまたはPYQTを選択できます。 TKINTERはシンプルで使いやすく、PYQTは豊富な機能を備えており、専門能力開発に適しています。

Pythonは、データサイエンス、Web開発、自動化タスクに適していますが、Cはシステムプログラミング、ゲーム開発、組み込みシステムに適しています。 Pythonは、そのシンプルさと強力なエコシステムで知られていますが、Cは高性能および基礎となる制御機能で知られています。

2時間以内にPythonの基本的なプログラミングの概念とスキルを学ぶことができます。 1.変数とデータ型、2。マスターコントロールフロー(条件付きステートメントとループ)、3。機能の定義と使用を理解する4。

Pythonは、Web開発、データサイエンス、機械学習、自動化、スクリプトの分野で広く使用されています。 1)Web開発では、DjangoおよびFlask Frameworksが開発プロセスを簡素化します。 2)データサイエンスと機械学習の分野では、Numpy、Pandas、Scikit-Learn、Tensorflowライブラリが強力なサポートを提供します。 3)自動化とスクリプトの観点から、Pythonは自動テストやシステム管理などのタスクに適しています。

2時間以内にPythonの基本を学ぶことができます。 1。変数とデータ型を学習します。2。ステートメントやループの場合などのマスター制御構造、3。関数の定義と使用を理解します。これらは、簡単なPythonプログラムの作成を開始するのに役立ちます。

10時間以内にコンピューター初心者プログラミングの基本を教える方法は?コンピューター初心者にプログラミングの知識を教えるのに10時間しかない場合、何を教えることを選びますか...

fiddlereveryversings for the-middleの測定値を使用するときに検出されないようにする方法

Python 3.6のピクルスファイルのロードレポートエラー:modulenotFounderror:nomodulenamed ...


ホットAIツール

Undresser.AI Undress
リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover
写真から衣服を削除するオンライン AI ツール。

Undress AI Tool
脱衣画像を無料で

Clothoff.io
AI衣類リムーバー

AI Hentai Generator
AIヘンタイを無料で生成します。

人気の記事

ホットツール

VSCode Windows 64 ビットのダウンロード
Microsoft によって発売された無料で強力な IDE エディター

SublimeText3 Linux 新バージョン
SublimeText3 Linux 最新バージョン

ZendStudio 13.5.1 Mac
強力な PHP 統合開発環境

SublimeText3 英語版
推奨: Win バージョン、コードプロンプトをサポート!

AtomエディタMac版ダウンロード
最も人気のあるオープンソースエディター
