JavaScriptのcharCodeAt()メソッドで文字のUnicode値を取得する方法
charCodeAt()メソッドとは
JavaScriptのcharCodeAt()メソッドは、指定されたインデックス位置にある文字のUnicode値を示す数値を返します。Unicodeのコードポイントは0から1,114,111までの範囲にあり、最初の128個のコードポイントはASCII文字エンコーディングと完全に一致しています。
なお、絵文字などBMP(基本多言語面)外の文字を扱う場合は、サロゲートペアが考慮されるcodePointAt()メソッドを使用するのが適切です。
構文とパラメータ
charCodeAt(index)では、以下のパラメータがサポートされています。
- index − 0以上、文字列の長さより1小さい整数。省略した場合はデフォルトで0が設定されます。
使用例
以下のコードを実行すると、指定した位置の文字のUnicode値を数値として取得できます。
<html>
<head>
<title>JavaScript String charCodeAt() Method</title>
</head>
<body>
<script>
var str = new String( "This is string" );
document.write("str.charCodeAt(0) is:" + str.charCodeAt(0));
document.write("<br />str.charCodeAt(1) is:" + str.charCodeAt(1));
document.write("<br />str.charCodeAt(2) is:" + str.charCodeAt(2));
document.write("<br />str.charCodeAt(3) is:" + str.charCodeAt(3));
document.write("<br />str.charCodeAt(4) is:" + str.charCodeAt(4));
document.write("<br />str.charCodeAt(5) is:" + str.charCodeAt(5));
</script>
</body>
</html>
出力結果
上記のコードを実行すると、文字列「This is string」の各文字に対応するUnicode値が以下のように表示されます。
str.charCodeAt(0) is:84 str.charCodeAt(1) is:104 str.charCodeAt(2) is:105 str.charCodeAt(3) is:115 str.charCodeAt(4) is:32 str.charCodeAt(5) is:105
たとえば、インデックス0の「T」は84、インデックス4の半角スペースは32というように、各文字が対応する数値に変換されていることがわかります。
-
PHPのmb_chr()関数でUnicodeコードポイントから文字を取得する方法を徹底解説
PHPには、Unicodeコードポイント値から対応する文字を取得できるmb_chr()関数が用意されています。この関数は、指定された文字エンコーディングでエンコードされた文字列を返します。マルチバイト文字を扱う際に非常に便利な関数なので、ぜひ使い方をマスターしておきましょう。mb_chr()関数の基本構文string mb_chr(int $codepoint, string $encoding)パラメータの説明mb_chr()関数が受け付けるパラメータは、以下の2つです。$codepoint − 変換対象となるUnicodeコードポイントの値を指定します。例えば、U+1F418(ゾウの絵文字
-
C#でUnicode文字が区切り文字かどうかを判定する方法
Unicode文字が区切り文字(セパレーター)であるかどうかを確認するには、Char.IsSeparator() メソッドを使用します。このメソッドは、指定されたUnicode文字が区切り文字カテゴリに分類される場合に true を、そうでない場合に false を返します。それでは、具体的なコード例を見ていきましょう。例1:カンマの場合using System; public class Demo { public static void Main(){ bool res; char val = ,; Console.WriteLine(Value