Python Pandas入門 – DataFrameから特定の行数を表示する方法
PandasのDataFrameから特定の行数だけを表示したい場合は、head()関数を使用します。引数に取得したい行数を指定することで、DataFrameの先頭から任意の件数のレコードを簡単に取り出せます。例えば、先頭10行を表示したい場合は、次のように記述します。
dataFrame.head(10)
なお、引数を省略した場合、head()はデフォルトで先頭5行を返します。逆に末尾の行を取得したい場合はtail()関数を使うと便利です。
準備:ライブラリのインポート
まず、必要なライブラリをエイリアス(別名)を付けてインポートします。
import pandas as pd
CSVファイルの読み込み
今回使用するCSVファイルは、デスクトップに以下のパスで保存されているものとします。
C:\Users\amit_\Desktop\CarRecords.csv
read_csv()関数を使ってCSVファイルを読み込み、Pandas DataFrameを作成しましょう。
dataFrame = pd.read_csv("C:\Users\amit_\Desktop\CarRecords.csv")
特定の行数を表示する
特定の行数を返すには、head()の引数に行数を指定します。ここでは、先頭の5行分のレコードを取得しています。
dataFrame.head(5)
サンプルコード
以下に、ここまでの手順をまとめた完全なコードを示します。
import pandas as pd
# CSVファイルを読み込む
dataFrame = pd.read_csv("C:\Users\amit_\Desktop\CarRecords.csv")
print("DataFrame...\n",dataFrame)
# 先頭5行のレコードを取得して表示
print("DataFrame with specific number of rows...\n",dataFrame.head(5))
実行結果
上記のコードを実行すると、次のような出力が得られます。最初にDataFrame全体(9行)が表示され、その後head(5)によって先頭5行のみが抽出されていることが確認できます。
DataFrame... Car Place UnitsSold 0 Audi Bangalore 80 1 Porsche Mumbai 110 2 RollsRoyce Pune 100 3 BMW Delhi 95 4 Mercedes Hyderabad 80 5 Lamborghini Chandigarh 80 6 Audi Mumbai 100 7 Mercedes Pune 120 8 Lamborghini Delhi 100 DataFrame with specific number of rows ... Car Place UnitsSold 0 Audi Bangalore 80 1 Porsche Mumbai 110 2 RollsRoyce Pune 100 3 BMW Delhi 95 4 Mercedes Hyderabad 80
-
【Python】Pandas DataFrameからnull(欠損値)行を削除する方法|dropna()の使い方
PandasのDataFrameからnull(NaN)行を削除するには、dropna()メソッドを使用します。この記事では、NaNを含むCSVファイルを読み込み、dropna()で欠損値を含む行を取り除くまでの手順を、サンプルコードと実行結果とともにわかりやすく解説します。前提:NaNを含むCSVファイル今回の例では、一部にNaN(null値)が含まれる以下のようなCSVファイル(CarRecords.csv)を使用します。手順1:read_csv()でCSVファイルを読み込むまずpandasをインポートし、read_csv()を使ってCSVファイルを読み込みます。ここではデスクトップ上に保存
-
Python Pandas:read_csvのskipinitialspaceでCSV読み込み時の先頭スペースをスキップする方法
PandasでCSVの先頭スペースをスキップするには?PandasでDataFrameを読み込む際、データの先頭にある余分な空白(初期スペース)を取り除きたい場合は、read_csv()メソッドのskipinitialspaceパラメータを使用します。このパラメータをTrueに設定すると、区切り文字(カンマなど)の直後にある空白が自動的にスキップされます。CSVファイルの中には、カンマの後に不要なスペースが混ざっているケースが少なくありません。そのまま読み込むと、列名や値の先頭に空白が残り、条件検索やグループ化の際にデータが正しく一致しない原因となります。skipinitialspace=Tr