Python
 Computer >> コンピューター >  >> プログラミング >> Python

Pandas DataFrameの行のグループにアクセスする方法|loc()の使い方を解説

PandasのDataFrameで特定の行のグループにアクセスするには、loc()メソッドを使用します。例えばdf.loc[2:5]と指定すると、ラベル2から5までのすべての行を選択できます。

手順

  • 二次元・サイズ可変・異なるデータ型を格納できる表形式データとして、DataFrame dfを作成します。
  • 入力となるDataFrame dfを出力して確認します。
  • df.loc[2:5]を使って、ラベル2〜5の行を選択します。
  • 選択後のDataFrameを出力します。

サンプルコード

import pandas as pd

df = pd.DataFrame(
   {
      "x": [5, 2, 7, 0, 7, 0, 5, 2],
      "y": [4, 7, 5, 1, 5, 1, 4, 7],
      "z": [9, 3, 5, 1, 5, 1, 9, 3]
   }
)

print("入力DataFrame:\n", df)
df = df.loc[2:5]
print("新しいDataFrame:\n", df)

実行結果

入力DataFrame:
   x  y  z
0  5  4  9
1  2  7  3
2  7  5  5
3  0  1  1
4  7  5  5
5  0  1  1
6  5  4  9
7  2  7  3

新しいDataFrame:
   x  y  z
2  7  5  5
3  0  1  1
4  7  5  5
5  0  1  1

補足:locとilocの違い

locはラベルベースのインデックス指定であり、範囲指定した場合は終端のラベルも含まれます。一方、ilocは位置(行番号)ベースの指定で、Pythonのスライスと同様に終端は含まれません。用途に応じて両者を使い分けることで、意図した通りの行抽出が可能になります。

  1. Pandasデータフレームを日付ごとに集計してプロットする方法

    Pandasデータフレームを日付ごとに集計してグラフ化したい場合、groupby()とagg()を組み合わせることで簡単に実現できます。本記事では、Matplotlibを使って集計結果を棒グラフとして可視化するまでの具体的な手順を、サンプルコード付きで解説します。 手順 図のサイズを設定し、サブプロット間およびその周囲のパディング(余白)を調整します。 2次元で、サイズ変更可能、かつ異なるデータ型を含みうる表形式データを持つデータフレーム df を作成します。 groupby() と agg([sum]) を使って、日付ごとに値を集計したデータフレームを取得します。 kind=bar を指定

  2. 【Python】Pandas DataFrameからnull(欠損値)行を削除する方法|dropna()の使い方

    PandasのDataFrameからnull(NaN)行を削除するには、dropna()メソッドを使用します。この記事では、NaNを含むCSVファイルを読み込み、dropna()で欠損値を含む行を取り除くまでの手順を、サンプルコードと実行結果とともにわかりやすく解説します。前提:NaNを含むCSVファイル今回の例では、一部にNaN(null値)が含まれる以下のようなCSVファイル(CarRecords.csv)を使用します。手順1:read_csv()でCSVファイルを読み込むまずpandasをインポートし、read_csv()を使ってCSVファイルを読み込みます。ここではデスクトップ上に保存