2026-01-20
初心者のための正規表現の使い方
正規表現(regex)は、テキスト検索パターンを構成する文字の並びです。ほぼすべてのプログラミング言語で、入力検証、テキスト検索、文字列操作に広く使用されています。
正規表現の基本概念は、そのまま一致するリテラル文字から始まります。他にも、任意の1文字を表すドット(.)、0回以上の繰り返しを意味するアスタリスク(*)、1回以上の繰り返しを意味するプラス記号(+)などのメタ文字があります。
[a-z]のような文字クラスは特定の文字範囲に一致させるために使われ、\dは数字、\wは単語文字(文字・数字・アンダースコア)、\sは空白文字を表します。これらの要素を組み合わせることで、非常に具体的な検索パターンを構築できます。
最も一般的な用途の1つはメールアドレスの形式検証で、例えば[\w.-]+@[\w.-]+\.\w+のようなパターンを使って、ユーザー入力が有効なメール構造を含んでいることを確認します。同様のパターンは、電話番号、郵便番号、URLの検証にもよく使われます。
キャレット(^)やドル記号($)などのアンカーは、文字列の開始と終了を示すのに便利で、テキストの一部だけでなく入力全体がパターンに一致することを保証できます。
正規表現を学ぶ最良の方法は、実際にインタラクティブに試してみることです。ToolHubのRegex Testerを使って、サンプルテキストに対してパターンをリアルタイムでテストし、マッチング結果をすぐに確認できます。