このツールとは?
このツールは2つの選択可能なモードで、テキストから不要な文字を除去します。「句読点のみ」は、ピリオド、カンマ、感嘆符、引用符、括弧など一般的な句読点だけを対象にし、文字・数字・その他の文字はそのままにします。「すべての特殊文字」はより広範囲で、文字・数字・空白以外のものをすべて除去します。Unicode対応のマッチングを使うため、アクセント付き文字や非ラテン文字(中国語、キリル文字、アラビア語など)は正しく文字として認識され、誤って除去されません。
「スペースを残す」チェックボックスで、除去した文字の位置に隙間を残す(スペースを保持)か、残った単語同士を詰めて単一スペースに正規化するかを制御できます。
なぜこれを使うのか?
- 「句読点のみ」と「すべての特殊文字」という2つの明確なモード—固定的な単一動作ではありません。
- Unicode対応:アクセント付き文字や非ラテン文字を特殊文字ではなく正しく文字として保持します。
- 除去した文字が残した隙間を保持するか詰めるか選択可能。
- ローカル処理—テキストがブラウザの外に出ることはありません。
- 登録不要、制限なし、無料。
使い方
- テキストを入力ボックスに貼り付けます。
- 「句読点のみ除去」または「すべての特殊文字を除去」を選択します。
- 隙間を残したいかどうかに応じて「スペースを残す」を切り替えます。
- 「除去」をクリックして結果をコピーします。
例
入力
Hello, World! (test)出力
Hello World test句読点のみモードではカンマ、感嘆符、括弧が除去され、単語は元のスペースで区切られたままになります。
よくある使い方
- 単語頻度カウンターや検索インデックスに投入する前にテキストをクリーンアップする。
- PDFやスキャン文書からコピーしたテキストの書式残留物を除去する。
- 語学学習やNLPスクリプト向けにトークン化前のテキストを準備する。
- 重複除去の前に、リストから引用符や句読点を取り除く。
よくある質問
「句読点」と「すべての特殊文字」の違いは何ですか?
句読点のみモードは、文を構成する . , ! ? ; : ' " ( ) [ ] { } などの記号を除去します。すべての特殊文字モードはより広範囲で、厳密には句読点ではないものの文字でも数字でもない @ # $ % ^ & * のような記号も除去します。
中国語、アラビア語、アクセント付き文字も削除されますか?
されません。どちらのモードもUnicode対応の文字マッチングを使うため、あらゆる文字体系の文字—éやüのようなアクセント付きラテン文字を含む—は正しく文字として認識され、特殊文字として扱われずに保持されます。
句読点を除去すると、スペースはどうなりますか?
「スペースを残す」がオンの場合、単語間の元のスペースは保持されます(意図しない連続スペースのみ統合)。オフの場合、すべての空白は単一スペースに正規化され、前後の空白はトリムされます。
数字には影響しますか?
どちらのモードでも数字が除去されることはありません—除去されるのは句読点または英数字以外の記号のみで、数字は常に保持されます。
テキストはどこかにアップロードされますか?
されません。処理はブラウザ内のローカルJavaScriptで行われ、サーバーには何も送信されません。