Pythonのデータ型と型変換をわかりやすく解説
この記事では、Pythonにおける主要なデータ型の種類と、それぞれの使い方、そしてデータ型同士を変換する方法について詳しく解説します。
Pythonの組み込みデータ型一覧
Pythonでは変数を作成・宣言する際に、さまざまなデータ型を持たせることができます。Pythonには以下のような組み込みデータ型が用意されています。
- str(文字列)
- int、float、complex(数値)
- list、tuple(シーケンス)
- dict(辞書)
- set(集合)
- bool(ブール値)
- bytes、bytearray(バイナリ)
それでは、各データ型の特徴と作成方法を順番に見ていきましょう。
文字列型: str
strは文字列変数を宣言したいときに使用するデータ型です。ダブルクォートまたはシングルクォートで囲むか、str()関数を使って生成できます。
x = "some string"
y = str("another string")
数値型: int、float、complex
数値を扱う変数を作成する場合は、整数ならint、小数ならfloat、複素数ならcomplexを使用します。
# int(整数)
a = 5
b = int(5)
# float(浮動小数点数)
c = 5.5
d = float(5.5)
# complex(複素数)
e = 1j
f = complex(1j)
シーケンス型: list、tuple
複数の要素を順序付きで管理したい場合は、list(リスト)またはtuple(タプル)を使用します。
- list: 順序があり、後から内容を変更できる(ミュータブル)。重複した要素も許可されます。
- tuple: 順序がありますが、作成後に内容を変更できない(イミュータブル)。重複した要素は許可されます。
# list の例
colors = ['red', 'green', 'blue']
colors_list = list(('red', 'green', 'blue'))
# tuple の例
fruits = ('apple', 'orange', 'banana')
fruits_tuple = tuple(('apple', 'orange', 'banana'))
マッピング型: dict
キーと値のペアでデータを管理したい場合は、dict(辞書)を使用します。
辞書(dict)は、変更可能でインデックスアクセスが可能なコレクションです。データは「キー」と「値」のペアとして格納されます。
people = {"name": "John", "age": "45"}
people_dict = dict(name="John", age=45)
集合型: set
set(セット)は、順序がなくインデックスアクセスができないコレクションです。重複する要素は自動的に削除されるという特徴もあります。
セットを作成するには、波括弧{}またはset()関数を使います。
status_codes = {"200", "300", "400", "500"}
status_codes = set(("200", "300", "400", "500"))
ブール型: bool
boolは、真(True)または偽(False)のいずれかの値を持つブール型変数を作成するときに使用します。
is_valid = False
valid = bool(is_valid)
バイナリ型: bytes、bytearray
バイナリデータを扱うためのデータ型は、以下のようにして作成できます。
# bytes の例
a = b"some_text"
b = bytes(5)
# bytearray の例
c = bytearray(3)
変数の型を確認する方法
変数がどのデータ型であるかを確認したい場合は、type()関数を使います。引数に調べたい変数を渡すだけで、その型情報を取得できます。
colors_list = list(('red', 'green', 'blue'))
print(type(colors_list))
print(colors_list)
fruits_tuple = tuple(('apple', 'orange', 'banana'))
print(type(fruits_tuple))
print(fruits_tuple)
実行結果:
<class 'list'>
['red', 'green', 'blue']
<class 'tuple'>
('apple', 'orange', 'banana')
Pythonでの型変換(キャスト)
Pythonには、あるデータ型を別のデータ型へ直接変換するための関数が用意されています。これにより、文字列を数値にしたり、その逆を行ったりといった処理が簡単に実現でき、非常に便利です。
以下に、よく使われる型変換の具体例を紹介します。
intからfloatへの変換
整数を浮動小数点数に変換するにはfloat()関数を使います。
x = 5
y = float(x)
print(y)
実行結果:
5.0
floatからintへの変換
浮動小数点数を整数に変換するにはint()関数を使います。小数点以下は切り捨てられる点に注意してください。
x = 5.0
y = int(x)
print(y)
実行結果:
5
文字列からlistへの変換
文字列をlist()に渡すと、1文字ずつの要素に分解されたリストが生成されます。
s = "devqa"
t = list(s)
print(t)
実行結果:
['d', 'e', 'v', 'q', 'a']
文字列からtupleへの変換
tuple()を使うと、文字列を1文字ずつの要素に分解したタプルを作成できます。
s = "devqa"
t = tuple(s)
print(t)
実行結果:
('d', 'e', 'v', 'q', 'a')
文字列からsetへの変換
set()を使うと、文字列から重複を除いた集合を作成できます。出力結果の並び順は保証されない点にも注意しましょう。
s = "devqa"
t = set(s)
print(t)
実行結果:
{'d', 'e', 'a', 'v', 'q'}
まとめ
Pythonのデータ型は大きく分けて文字列、数値、シーケンス、マッピング、集合、ブール、バイナリの7種類があります。それぞれの型には固有の特徴があるため、用途に応じて適切な型を選択することが重要です。また、type()関数による型の確認や、各種変換関数によるキャストを活用すれば、柔軟なデータ処理が可能になります。日常的なコーディングの中で積極的に使ってみてください。
-
Pandasで学ぶPythonデータ分析と可視化の基本
Pandas(パンダス)は、データサイエンスやデータ分析の分野で最も人気のあるPythonライブラリの一つです。データの操作・分析・クレンジング(前処理)を得意としており、C言語で実装された低レベルライブラリ「NumPy」の上位に位置する高レベルな抽象化として機能します。本記事では、アナリストやデータサイエンティストとして必ず押さえておきたい重要ポイントを順を追って解説します。ライブラリのインストール必要なライブラリはpipコマンドで簡単にインストールできます。ターミナル(コマンドプロンプト)で以下のコマンドを実行してください。pip install pandasDataFrame と Ser
-
Pythonによるデータ分析と可視化入門|pandasの基本を徹底解説
Pythonによるデータ分析と可視化の概要 Pythonには、データ分析と可視化のための強力なライブラリが数多く用意されています。代表的なものとしては、NumPy、pandas、matplotlib、seabornなどが挙げられます。本記事では、その中でも中心的な役割を果たすpandasについて詳しく解説します。pandasはNumPyをベースに構築されたオープンソースライブラリで、高速なデータ分析やデータのクリーニング・前処理を効率的に行えます。さらに、pandas自体にも便利な可視化機能が組み込まれています。 pandasのインストール方法 pandasをインストールするには、ターミナル