MySQL
 Computer >> コンピューター >  >> プログラミング >> MySQL

MySQLで最初の文字が英数字ではない行を抽出する方法

MySQLでは、REGEXP演算子と正規表現を組み合わせることで、カラムの最初の文字が英数字ではない行(記号などで始まる行)を簡単に抽出できます。この記事では、具体的なパターンとサンプルコードを使って解説します。

正規表現パターンの基本

ケース1:数字で始まる行を取得する場合

先頭が数字である行だけを取り出したいときは、次のような構文を使用します。

SELECT * FROM yourTableName
WHERE yourColumnName REGEXP '^[0-9]';

パターン内の「^」は文字列の先頭を意味し、「[0-9]」は先頭の1文字が0〜9のいずれかの数字であることを表しています。

ケース2:英数字以外の文字で始まる行を取得する場合

先頭が英数字(A〜Z、a〜z、0〜9)以外、つまり記号や特殊文字で始まる行を取得したい場合は、次の構文を使います。

SELECT * FROM yourTableName
WHERE yourColumnName REGEXP '^[^0-9A-Za-z]';

ここでのポイントは、角括弧内の「^」です。これは否定(NOT)を意味し、「先頭の1文字が英数字ではない」条件になります。したがって、「@」や「#」などの記号から始まる行が該当します。

動作確認用テーブルの作成

実際に動きを理解するために、テスト用のテーブルを作成しましょう。以下のクエリを実行します。

mysql> create table getRowsFirstNotAlphanumeric
-> (
-> Id int NOT NULL AUTO_INCREMENT,
-> UserPassword varchar(20),
-> PRIMARY KEY(Id)
-> );
Query OK, 0 rows affected (0.61 sec)

続いて、INSERT文でサンプルデータを挿入します。

mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('@123456');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('#7666666');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('98876Carol');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('$12345Carol');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('%David567');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('123456Larry');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('909Robert');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('3333Maxwell');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('_123456Bob');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('5767676Chris');
mysql> insert into getRowsFirstNotAlphanumeric(UserPassword) values('(88883Mike');

SELECT文ですべてのレコードを表示して確認してみましょう。

mysql> select *from getRowsFirstNotAlphanumeric;

実行結果は以下のとおりです。

+----+--------------+
| Id | UserPassword |
+----+--------------+
|  1 | @123456      |
|  2 | #7666666     |
|  3 | 98876Carol   |
|  4 | $12345Carol  |
|  5 | %David567    |
|  6 | 123456Larry  |
|  7 | 909Robert    |
|  8 | 3333Maxwell  |
|  9 | _123456Bob   |
| 10 | 5767676Chris |
| 11 | (88883Mike   |
+----+--------------+
11 rows in set (0.00 sec)

各パターンでの抽出結果

ケース1:数字で始まる行の抽出

先頭が数字の行をすべて取得するクエリは以下のとおりです。

mysql> SELECT *FROM getRowsFirstNotAlphanumeric
-> WHERE UserPassword REGEXP '^[0-9]';

実行結果:

+----+--------------+
| Id | UserPassword |
+----+--------------+
|  3 | 98876Carol   |
|  6 | 123456Larry  |
|  7 | 909Robert    |
|  8 | 3333Maxwell  |
| 10 | 5767676Chris |
+----+--------------+
5 rows in set (0.00 sec)

先頭が数字の5件のみが抽出されていることがわかります。

ケース2:英数字以外で始まる行の抽出

先頭が記号などの英数字以外の文字である行を取得するクエリは以下のとおりです。

mysql> SELECT *FROM getRowsFirstNotAlphanumeric
-> WHERE UserPassword REGEXP '^[^0-9A-Za-z]';

実行結果:

+----+--------------+
| Id | UserPassword |
+----+--------------+
|  1 | @123456      |
|  2 | #7666666     |
|  4 | $12345Carol  |
|  5 | %David567    |
|  9 | _123456Bob   |
| 11 | (88883Mike   |
+----+--------------+
6 rows in set (0.00 sec)

「@」「#」「$」「%」「_」「(」といった記号で始まる6件が正しく抽出されました。

まとめ

MySQLのREGEXPを使えば、先頭文字の種類による絞り込みを柔軟に行えます。特に「^[^0-9A-Za-z]」のような否定パターンは、バリデーション前のデータクリーニングや不正な形式のレコード検出に役立ちます。用途に応じてパターンを調整し、活用してみてください。

  1. 【MySQL】FLOOR()関数を使って小数部分が整数(.00)のレコードだけを抽出する方法

    DECIMAL型のカラムから「55.00」や「9.00」のように小数部分が0(整数値と等しい)レコードだけを取り出したい場合、FLOOR()関数を使うと簡単に実現できます。FLOOR()関数による抽出の考え方FLOOR()は引数の値を切り捨てて整数にする関数です。元の値とFLOOR()した値が一致していれば、その値は小数部分を持たない(小数点以下が0の)数値だと判断できます。たとえば、5.23、8.76、12.00、22.68といったレコードの中から、12.00のようなレコードのみを抽出するイメージです。1. テーブルを作成するまず、検証用のテーブルを作成します。mysql> creat

  2. 【MySQL】特定の列の値が0のみの行を別の列でグループ化して抽出する方法

    はじめに 「ある列の値が0のみの行を抽出し、さらに別の列でグループ化したい」,そんな場合には、GROUP BY句とHAVING句を組み合わせるのが効果的です。この記事では、実際にテーブルを作成し、データを挿入しながら、目的の結果を得るまでの手順を具体例とともに解説します。 1. サンプルテーブルの作成 まずはCREATE TABLE文でテーブルを作成しましょう。 mysql> create table DemoTable1344 -> ( -> `SequenceId` int NOT NULL AUTO_INCREMENT PRIMARY KEY,