Python
 Computer >> コンピューター >  >> プログラミング >> Python

【Python Pandas】DataFrameの行数・列数を取得する方法|shape属性の使い方を解説

PandasのDataFrameにおける行数と列数を確認するには、shape属性を使用します。shape属性はタプル形式で「(行数, 列数)」を返してくれるため、データサイズの把握に非常に便利です。

本記事では、CSVファイルを読み込んだDataFrameを例に、shape属性を使って行数と列数をカウントする方法を解説します。

前提条件:CSVファイルの準備

まず、デスクトップ上に以下のパスでCSVファイルが保存されているものとします。

C:\Users\amit_\Desktop\CarRecords.csv

CSVファイルの読み込み

pandasのread_csv()関数を使って、CSVファイルをDataFrameとして読み込みます。

dataFrame = pd.read_csv("C:\Users\amit_\Desktop\CarRecords.csv")

shape属性で行数と列数をカウントする

読み込んだDataFrameに対して、以下のようにshape属性を参照するだけで、行数と列数を一度に取得できます。

dataFrame.shape

サンプルコード全体

以下は、CSVファイルの読み込みから行数・列数の表示、さらにhead()メソッドによる先頭5行の抽出までを行う完全なコード例です。

import pandas as pd

# CSVファイルを読み込む
dataFrame = pd.read_csv("C:\Users\amit_\Desktop\CarRecords.csv")
print("DataFrame...\n", dataFrame)

# DataFrameの行数と列数をカウントする
print("\nNumber of rows and column in our DataFrame = ", dataFrame.shape)

# 先頭5行のレコードを表示する
print("\nDataFrame with specific number of rows...\n", dataFrame.head(5))

実行結果

上記のコードを実行すると、以下のような出力が得られます。

DataFrame...
             Car        Place   UnitsSold
0          Audi    Bangalore          80
1       Porsche       Mumbai         110
2    RollsRoyce         Pune         100
3           BMW        Delhi          95
4      Mercedes    Hyderabad          80
5   Lamborghini   Chandigarh          80
6          Audi       Mumbai         100
7      Mercedes         Pune         120
8   Lamborghini        Delhi         100

Number of rows and column in our DataFrame = (9, 3)

DataFrame with specific number of rows ...
           Car      Place   UnitsSold
0         Audi   Bangalore          80
1      Porsche     Mumbai         110
2   RollsRoyce       Pune         100
3          BMW      Delhi          95
4     Mercedes   Hyderabad          80

ポイント解説

  • dataFrame.shape(行数, 列数)のタプルを返します。この例では「(9, 3)」となり、9行3列のDataFrameであることがわかります。
  • 行数だけが必要な場合はdataFrame.shape[0]、列数だけが必要な場合はdataFrame.shape[1]のようにインデックスを指定します。
  • なお、len(dataFrame)でも行数を取得できますが、列数も同時に知りたい場合はshape属性が便利です。
  1. Python Pandas – locを使って行と列を組み合わせたサブセットを選択する方法

    はじめに Pandasで行と列を組み合わせたサブセットを選択するには、locを使用します。インデックス演算子(角括弧 [ ] )と組み合わせ、locの中に条件を設定することで、目的のデータだけを効率的に抽出できます。 本記事では、Microsoft Excelで開いた以下のようなCSVファイルを例に解説します。このデータには、車名(Car)、登録価格(Reg_Price)、販売台数(Units)の3つの列が含まれています。 CSVファイルからデータを読み込む まず、CSVファイルからデータをPandas DataFrameに読み込みます。 dataFrame = pd.read_csv(C:\

  2. 【Python】Pandas DataFrameからnull(欠損値)行を削除する方法|dropna()の使い方

    PandasのDataFrameからnull(NaN)行を削除するには、dropna()メソッドを使用します。この記事では、NaNを含むCSVファイルを読み込み、dropna()で欠損値を含む行を取り除くまでの手順を、サンプルコードと実行結果とともにわかりやすく解説します。前提:NaNを含むCSVファイル今回の例では、一部にNaN(null値)が含まれる以下のようなCSVファイル(CarRecords.csv)を使用します。手順1:read_csv()でCSVファイルを読み込むまずpandasをインポートし、read_csv()を使ってCSVファイルを読み込みます。ここではデスクトップ上に保存