Python Pandas:read_csvのskipinitialspaceでCSV読み込み時の先頭スペースをスキップする方法
PandasでCSVの先頭スペースをスキップするには?
PandasでDataFrameを読み込む際、データの先頭にある余分な空白(初期スペース)を取り除きたい場合は、read_csv()メソッドのskipinitialspaceパラメータを使用します。このパラメータをTrueに設定すると、区切り文字(カンマなど)の直後にある空白が自動的にスキップされます。
CSVファイルの中には、カンマの後に不要なスペースが混ざっているケースが少なくありません。そのまま読み込むと、列名や値の先頭に空白が残り、条件検索やグループ化の際にデータが正しく一致しない原因となります。skipinitialspace=Trueを指定しておけば、こうした問題を事前に防ぐことができます。
ここでは、次のようなCSVファイル(CarRecords.csv)を例に見ていきましょう。

skipinitialspaceパラメータを有効にして読み込むと、先頭の空白が取り除かれた状態でDataFrameが出力されます。

サンプルコード(完全版)
以下が完全なコードです。
import pandas as pd
# 通常どおりCSVファイルを読み込む
dataFrame = pd.read_csv("C:/Users/amit_/Desktop/CarRecords.csv")
print("DataFrame...")
print(dataFrame)
# 先頭の空白をスキップしてCSVファイルを読み込む
dataFrame = pd.read_csv("C:/Users/amit_/Desktop/CarRecords.csv", skipinitialspace=True)
print("DataFrame...")
print(dataFrame)
コードのポイント
まず、通常の方法でCSVファイルを読み込みます。ここでは、デスクトップに保存された「CarRecords.csv」を使用しています。
dataFrame = pd.read_csv("C:/Users/amit_/Desktop/CarRecords.csv")読み込む際にskipinitialspace = Trueを指定すると、各項目の先頭にある空白をまとめて削除できます。
dataFrame = pd.read_csv("C:/Users/amit_/Desktop/CarRecords.csv", skipinitialspace=True)実行結果
上記のコードを実行すると、次のような出力が得られます。1つ目のDataFrameでは列名や値の先頭に空白が含まれていますが、2つ目(skipinitialspace=True適用後)では空白がきれいに除去されていることが確認できます。
DataFrame...
Car Place UnitsSold
0 Audi Bangalore 80
1 Porsche Mumbai 110
2 RollsRoyce Pune 100
3 BMW Delhi 200
4 Mercedes Hyderabad 80
5 Lamborghini Chandigarh 80
6 Audi Mumbai 60
7 Mercedes Pune 120
8 Lamborghini Delhi 100
DataFrame...
Car Place UnitsSold
0 Audi Bangalore 80
1 Porsche Mumbai 110
2 RollsRoyce Pune 100
3 BMW Delhi 200
4 Mercedes Hyderabad 80
5 Lamborghini Chandigarh 80
6 Audi Mumbai 60
7 Mercedes Pune 120
8 Lamborghini Delhi 100
このように、skipinitialspaceパラメータを一行追加するだけで、CSV読み込み時の余分な空白を簡単に除去できます。外部から受け取ったCSVデータの前処理として、ぜひ活用してみてください。
-
PythonでPandas DataFrameを棒グラフとして可視化する方法
データ分析において、PandasのDataFrameを視覚的に表現することは非常に重要です。この記事では、CSVファイルから読み込んだデータをmatplotlibを使って棒グラフ(バーチャート)として表示する方法を解説します。 前提条件:サンプルデータ 今回は以下のような内容のCSVファイル(SalesData.csv)を使用します。 Car Reg_Price 0 BMW 2000 1 Lexus 1500 2 Audi 1500 3 Jaguar 2000 4 Mustang
-
【Python】Pandas DataFrameからnull(欠損値)行を削除する方法|dropna()の使い方
PandasのDataFrameからnull(NaN)行を削除するには、dropna()メソッドを使用します。この記事では、NaNを含むCSVファイルを読み込み、dropna()で欠損値を含む行を取り除くまでの手順を、サンプルコードと実行結果とともにわかりやすく解説します。前提:NaNを含むCSVファイル今回の例では、一部にNaN(null値)が含まれる以下のようなCSVファイル(CarRecords.csv)を使用します。手順1:read_csv()でCSVファイルを読み込むまずpandasをインポートし、read_csv()を使ってCSVファイルを読み込みます。ここではデスクトップ上に保存