Python・Pandas DataFrameの列値を小数点以下の桁数で丸める方法
PandasでDataFrameの数値を小数点以下の指定した桁数で丸めて表示するには、display.precision属性を使用します。なお、この設定はあくまで「表示」にのみ影響するものであり、DataFrame内に保持されている実際のデータ値が変更されるわけではない点に注意してください。
1. Pandasライブラリのインポート
まず、必要なPandasライブラリをインポートします。
import pandas as pd
2. DataFrameの作成
次に、「Car」と「Reg_Price」の2つの列を持つDataFrameを作成します。Reg_Price列には小数点以下の桁数が異なる数値が含まれています。
dataFrame = pd.DataFrame(
{
"Car": ['BMW', 'Lexus', 'Tesla', 'Mustang', 'Mercedes', 'Jaguar'],
"Reg_Price": [7000.5057, 1500, 5000.9578, 8000, 9000.75768, 6000]
}
)
3. set_option()メソッドで表示精度を設定する
set_option()メソッドを使って表示精度(小数点以下の桁数)を設定します。ここでは、小数点以下2桁に設定しています。
pd.set_option('display.precision', 2)
この設定を行うと、以降の出力ではすべての浮動小数点数が小数点以下2桁で表示されるようになります。
完全なコード例
以下に、ここまでの手順をまとめた完全なコードを示します。
import pandas as pd
# DataFrameを作成
dataFrame = pd.DataFrame(
{
"Car": ['BMW', 'Lexus', 'Tesla', 'Mustang', 'Mercedes', 'Jaguar'],
"Reg_Price": [7000.5057, 1500, 5000.9578, 8000, 9000.75768, 6000]
}
)
print("DataFrame ...\n", dataFrame)
# 表示精度を小数点以下2桁に設定
pd.set_option('display.precision', 2)
print("\n小数値を丸めた後のDataFrame...\n", dataFrame)
実行結果
上記のコードを実行すると、次のような出力が得られます。
DataFrame ...
Car Reg_Price
0 BMW 7000.50570
1 Lexus 1500.00000
2 Tesla 5000.95780
3 Mustang 8000.00000
4 Mercedes 9000.75768
5 Jaguar 6000.00000
小数値を丸めた後のDataFrame...
Car Reg_Price
0 BMW 7000.51
1 Lexus 1500.00
2 Tesla 5000.96
3 Mustang 8000.00
4 Mercedes 9000.76
5 Jaguar 6000.00
補足:実際のデータ値を丸めたい場合
display.precisionは表示のみを制御するため、データそのものを丸めたい場合はround()メソッドを使用します。
dataFrame = dataFrame.round(2) # 実際の値を小数点以下2桁に丸める
用途に応じて、表示だけを整えたいのか、データ自体を加工したいのかを見分けて使い分けることが重要です。
-
【Python Pandas】unique()メソッドで単一の列から一意の値を抽出する方法
Pandas DataFrameの特定の列から重複を除いた一意の値を取得したい場合は、unique()メソッドを使います。例えば、従業員データを管理するDataFrameでは、同名の従業員が存在する可能性があるため、名前が重複することがあります。そのような場合に、unique()を使えば重複のない従業員名の一覧を簡単に抽出できます。ライブラリのインポートまず、必要なライブラリをインポートします。ここでは、pdというエイリアスを設定しています。import pandas as pdDataFrameの作成次に、サンプル用のDataFrameを作成します。ここでは「EmpName」(従業員名)と「
-
Python Pandasのnotnull()メソッドでNULL値(NaN)を確認する方法
Pandasのnotnull()メソッドは、ブール値(True / False)を返すメソッドです。DataFrameにNULL値(NaN)が含まれている場合はFalseを返し、NULL値でない場合はTrueを返します。ここでは、NaN(NULL値)をいくつか含む次のCSVファイルを例にして説明します。CSVファイルの読み込みまず、read_csv()を使ってCSVファイルを読み込みます。dataFrame = pd.read_csv("C:\\Users\\amit_\\Desktop\\CarRecords.csv")NULL値以外(有効なデータ)の確認notnull(