【Python Pandas】DataFrameの行数・列数を取得する方法|shape属性の使い方を解説
PandasのDataFrameにおける行数と列数を確認するには、shape属性を使用します。shape属性はタプル形式で「(行数, 列数)」を返してくれるため、データサイズの把握に非常に便利です。
本記事では、CSVファイルを読み込んだDataFrameを例に、shape属性を使って行数と列数をカウントする方法を解説します。
前提条件:CSVファイルの準備
まず、デスクトップ上に以下のパスでCSVファイルが保存されているものとします。
C:\Users\amit_\Desktop\CarRecords.csv
CSVファイルの読み込み
pandasのread_csv()関数を使って、CSVファイルをDataFrameとして読み込みます。
dataFrame = pd.read_csv("C:\Users\amit_\Desktop\CarRecords.csv")shape属性で行数と列数をカウントする
読み込んだDataFrameに対して、以下のようにshape属性を参照するだけで、行数と列数を一度に取得できます。
dataFrame.shape
サンプルコード全体
以下は、CSVファイルの読み込みから行数・列数の表示、さらにhead()メソッドによる先頭5行の抽出までを行う完全なコード例です。
import pandas as pd
# CSVファイルを読み込む
dataFrame = pd.read_csv("C:\Users\amit_\Desktop\CarRecords.csv")
print("DataFrame...\n", dataFrame)
# DataFrameの行数と列数をカウントする
print("\nNumber of rows and column in our DataFrame = ", dataFrame.shape)
# 先頭5行のレコードを表示する
print("\nDataFrame with specific number of rows...\n", dataFrame.head(5))実行結果
上記のコードを実行すると、以下のような出力が得られます。
DataFrame...
Car Place UnitsSold
0 Audi Bangalore 80
1 Porsche Mumbai 110
2 RollsRoyce Pune 100
3 BMW Delhi 95
4 Mercedes Hyderabad 80
5 Lamborghini Chandigarh 80
6 Audi Mumbai 100
7 Mercedes Pune 120
8 Lamborghini Delhi 100
Number of rows and column in our DataFrame = (9, 3)
DataFrame with specific number of rows ...
Car Place UnitsSold
0 Audi Bangalore 80
1 Porsche Mumbai 110
2 RollsRoyce Pune 100
3 BMW Delhi 95
4 Mercedes Hyderabad 80ポイント解説
dataFrame.shapeは(行数, 列数)のタプルを返します。この例では「(9, 3)」となり、9行3列のDataFrameであることがわかります。- 行数だけが必要な場合は
dataFrame.shape[0]、列数だけが必要な場合はdataFrame.shape[1]のようにインデックスを指定します。 - なお、
len(dataFrame)でも行数を取得できますが、列数も同時に知りたい場合はshape属性が便利です。
-
Python Pandas – locを使って行と列を組み合わせたサブセットを選択する方法
はじめに Pandasで行と列を組み合わせたサブセットを選択するには、locを使用します。インデックス演算子(角括弧 [ ] )と組み合わせ、locの中に条件を設定することで、目的のデータだけを効率的に抽出できます。 本記事では、Microsoft Excelで開いた以下のようなCSVファイルを例に解説します。このデータには、車名(Car)、登録価格(Reg_Price)、販売台数(Units)の3つの列が含まれています。 CSVファイルからデータを読み込む まず、CSVファイルからデータをPandas DataFrameに読み込みます。 dataFrame = pd.read_csv(C:\
-
【Python】Pandas DataFrameからnull(欠損値)行を削除する方法|dropna()の使い方
PandasのDataFrameからnull(NaN)行を削除するには、dropna()メソッドを使用します。この記事では、NaNを含むCSVファイルを読み込み、dropna()で欠損値を含む行を取り除くまでの手順を、サンプルコードと実行結果とともにわかりやすく解説します。前提:NaNを含むCSVファイル今回の例では、一部にNaN(null値)が含まれる以下のようなCSVファイル(CarRecords.csv)を使用します。手順1:read_csv()でCSVファイルを読み込むまずpandasをインポートし、read_csv()を使ってCSVファイルを読み込みます。ここではデスクトップ上に保存