スラッグとは、Webアドレスの末尾にある人間が読める部分のことです。たとえば example.com/blog/my-first-post の my-first-post がこれにあたります。これは、ユーザーがクリックするかどうかを決める前に読む部分であり、検索エンジンがページの内容を説明する短いテキストとして読み取る部分でもあります。そのため、データベースのIDや日付よりも慎重に決める価値があります。この無料ジェネレーターは、あらゆるテキストをスラッグに変換します。「変換するテキスト」にタイトルを貼り付けて「生成」を押すと、結果がコピーボタンとともに表示されます。デフォルトの設定は、「小文字にする」、単語間のダッシュ、「ストップワードを削除」、ラテン文字以外の翻字といった、多くのサイトで求められる設定になっています。そのため、クリックするだけで使えるスラッグができあがります。もちろん、これらの設定はすべてスイッチで変更できます。
すべての処理はあなた自身のデバイス上で行われます。ページは小さなJavaScriptエンジンを読み込み、ローカルで実行します。入力したタイトルがアップロードされたり、記録されたりすることはなく、インターネット接続を切ってもツールは機能し続けます。設定を変更した瞬間に結果が更新されるのもそのためです。結果を予測しやすくするために、処理の順序を知っておくと便利です。貼り付けられたリンクは最初に最後のパス部分だけが抽出されます。次に、テキストが小文字に変換され、ストップワードが削除され、ラテン文字以外の文字が翻字されます。設定している場合は数字と特殊文字が削除され、残ったものが区切り文字で結合されます。その後、結果は最大長に合わせて切り詰められ、最後に重複がある場合は末尾に数字が追加されます。「変換するテキスト」は一度に最大500,000文字まで受け付けるため、数千件の記事件名を一気に処理できます。
1行の入力につき、1つのスラッグを出力します。タイトルのリストを丸ごと貼り付けると、各行がそれぞれ番号付きのスラッグになります。元のタイトルはグレー色で上に表示されるため、50件のバッチ処理でも、どのスラッグがどの見出しのものかすぐにわかります。すでにファイルにまとめられているリストをクリップボード経由で貼り付ける必要はありません。入力フィールドの横にある「ファイルからロード」ボタンを使えば、.txt、.csv、.md、.json などのプレーンテキストファイルを開き、その内容を直接フィールドに入力できます。ブラウザはこのファイルを、あなたが手で入力したテキストと同じように読み取ります。データがどこかにアップロードされることはありません。「入力の分割方法」では、リストをどのように区切るかを指定します。デフォルトは「自動検出」です。改行は常に項目を区切りますが、カンマは1行の入力データがそれぞれ独立した値に見える場合にのみ区切ります。そのため、"価格 1,500円" や "第5章: 結果, 結論" は分割されず、そのまま保持されます。データの形式があらかじめ分かっている場合は、「改行」、「カンマ」、「スペース」を選択して分割方法を固定できます。「出力形式」は、処理後のバッチ結果をどのように受け取るかを決めます。「改行」、「スペース区切り」、「カンマ区切り」のいずれかを選択でき、「すべてコピー」および「ファイルに保存」の両方がこの設定に従います。「履歴」には過去10回分のバッチがブラウザ内に保存されるため、1時間前に変換したリストもまだそこにあります。
ラテン文字以外のテキストの扱いは、多くのスラッグジェネレーターが大まかにしか対応しておらず、正確に処理できるものは少数です。URLはプレーンなASCII文字にするのが最も安全であるため、キリル文字、ギリシャ文字、アラビア文字、中国語、ヨーロッパ言語のアクセント記号付きの文字などは変換する必要があります。問題は、どのルールに従うかです。このページでは2つのレイヤーでこれに対応しています。一般的なレイヤーは、すべての文字体系をカバーしています。入力可能なほぼすべての文字に対して適切なASCIIの答えを返す翻字ライブラリであり、どのテーブルにも載っていない文字はここが引き受けます。特定のレイヤーは、一般的なルールがその国で実際に使われているものと異なる言語向けに手動で作成されたテーブルのセットで、日本語もその一つです。選ぶものはありません。かな用のヘボン式テーブルがこのページで最初から読み込まれています。一般的なレイヤーはかなを一文字ずつ読むため、小さな「ゃゅょ」を大きな文字として扱い、きょう が kiyou に、しゃしん が shiyashin になっていました。小さな「っ」も t になり、がっこう は gatkou でした。テーブルはこれを直します。きょう は kyou、がっこう は gakkou、キャベツ は kyabetsu、まっちゃ は matcha です。長音記号「ー」はそのまま落とします。ラーメン が ramen になるのは、日本語のURLで実際によく使われる書き方だからです。読み込まれたテーブルは「翻字ルール」の下の編集可能なグリッドに並び、各文字はテキストフィールドになっていて自由に変更でき、「ルールをデフォルトにリセット」で元に戻せます。ウクライナ語のテーブルは、ウクライナのパスポートに印刷される標準である2010年の内閣決議第55号に従っています。これには、見落とされがちな細部も含まれています。たとえば、жと区別するために зг は zh ではなく zgh になり、є, ї, й, ю, я は単語の先頭と途中で異なる形を取ります。アポストロフィと軟音符は新しい単語を始めずに削除されるため、Знам'янка は znamyanka ではなく znamianka になります。ドイツ語のデフォルトでは、ドイツのアドレスで実際に使用されている ä → ae、ö → oe、ü → ue への拡張が適用されますが、お好みでシンプルな ä → a のバリアントを使用することもできます。
「ストップワードを削除」はデフォルトでオンになっています。これは、英語の a, the, and, of, for などの小さなつなぎの単語を削除する機能です。これらはスラッグを長くするだけで、意味を付け加えることはありません。「ストップワード」の下にあるリストは完全に編集可能で、最初から入力された状態で表示されます。英語のリストに加えて、現在開いているページの言語用リストも用意されています。そのため、ウクライナ語のページでは в, на, та, і を認識し、ドイツ語のページでは der, die, das を認識します。独自の単語を追加したり、残したい単語を削除したり、この機能自体を完全にオフにしたりすることもできます。オフにした場合、フィールドはグレー表示になります。この機能に関する2つの正直な注意点があります。ストップワードの削除は、検索順位を上げるための要素ではなく、アドレスを短くすっきりさせるためのものです。また、タイトルのすべての単語がたまたまリストに含まれていた場合、結果は完全に空になります。そのため、ツールは空のボックスを返す代わりに、その旨をメッセージとして伝えます。
残りのスイッチはスラッグの形を決定します。「スラッグ内の区切り文字」は、単語の間に何を置くかを選択します。デフォルトがダッシュになっているのは好みの問題ではありません。Googleはダッシュを単語の区切りとして読み取り、アンダースコアを結合文字として読み取ります。つまり、my_first_post はクローラーには1つの長い単語として認識されますが、my-first-post は3つの単語として認識されます。「アンダースコア (_)」は、システムがそれを要求する場合のために用意されています。「小文字にする」はオンになっています。なぜなら、ほとんどのサーバーはアドレスの大文字と小文字を区別して処理するため、大文字と小文字が混ざっていると、1つのページに2つのURLができてしまう可能性があるからです。「特殊文字を削除」は、文字、数字、スペース、ダッシュ、アンダースコア以外のすべてを取り除きます。これにより、句読点、引用符、絵文字がアドレスに入り込むのを防ぎます。特に絵文字は翻字の前に削除されるため、ロケットの絵文字が「rocket」という単語に変換されることはありません。「数字を削除」はオフになっています。タイトルの数字は通常、タイトル自体の一部だからです。「最大長」は10から200の間で設定でき、デフォルトは80です。スラッグがそれより長くなる場合、エンジンは単語の途中で切るのではなく、収まる最後の単語全体を残すように切り詰めます。各結果の横にある数字は文字数を示し、60を超えると赤くなります。これは厳密な制限ではありませんが、検索結果でスラッグが省略され始め、メッセージに貼り付けるには不格好になり始める目安です。
一括変換を1クリックの作業に戻すための2つのスイッチが用意されています。「スラッグを重複させない」は、2つの異なるタイトルが同じスラッグになってしまうケースを防ぎます。たとえば「トップ 10 のコツ」と「トップ-10 のコツ」はどちらも toppu-10-nokotsu になりますが、この機能により2つ目には -2、3つ目には -3 が付与されます。接尾辞を追加することで最大長を超えてしまう場合は、まずベース部分が短縮されます。1つのアドレスに2つのページが割り当てられてしまう問題は、CMS内で対処するよりもこのリストの段階で修正する方がはるかに簡単です。「URLからスラッグを抽出」は逆の方向に機能します。完全なリンクを貼り付けると、ツールはパスの最後の部分を取り出し、クエリ文字列や .html や .php などの拡張子を削除し、パーセントエンコーディングをデコードします。そのため、Wikipediaの %D0%9B%D1%8C%D0%B2%D1%96%D0%B2 で終わるアドレスは、16進数の羅列ではなく lviv として返されます。この機能は行全体がリンクである場合にのみトリガーされるため、文中に引用されたアドレスはそのまま保持されます。
なぜこのスラッグジェネレーターを選ぶべきなのでしょうか?
- ブラウザ専用: タイトルは決してアップロードされず、オフラインでも機能し続けます
- 貼り付けやテキストファイルからの一括変換に対応し、各スラッグの上に元のタイトルを表示します
- すべての言語で1つの汎用テーブルを使うのではなく、言語ごとの実際の翻字規格に対応しています
- パスポートで使用されているスペルである、2010年決議第55号に基づくウクライナ語の翻字
- すべてのルールが1文字ずつ編集可能で、1クリックでリセットできます
- 自動的に -2 や -3 の接尾辞を追加し、バッチ内のスラッグが衝突するのを防ぎます
- リンクを貼り付けるだけで、パーセントエンコーディングをデコードしてスラッグを抽出します
- あなたの言語に合わせた内容が事前に入力された、編集可能なストップワードリスト
- 単語の途中で切れない安全な切り詰めと、各結果の横にある文字数カウント
- 無料かつ無制限: サインアップ不要、制限なし、サーバーにデータは保存されません
スラッグは、ページが読みやすいアドレスを持つ必要がある場所で必ず求められます。ブログやニュースサイトはすべての見出しをスラッグに変換します。このツールはそのようなケースを想定して作られました。1週間分の見出しを貼り付けて、1週間分のURLを取得できます。オンラインショップでも、製品名やカテゴリ名について同じことを行います。通常はインポート後に一括で行われ、アドレスが対応していない文字を持つ言語で処理されることが一般的です。ドキュメントやナレッジベースでも、アンカーやファイル名を同じ方法で構築します。Webアドレス以外でも、このクリーンな文字列は役立ちます。別のオペレーティングシステムで壊れないファイル名、ログで人間が読めるデータベースキー、ブランチ名、メディアライブラリの画像名、または静的サイトジェネレーターのセクション識別子などに使えます。人間が読める名前を機械が読み取れるフィールドに入力する必要がある場所ならどこにでも、スラッグの出番があります。
このツールに依存する前に、いくつかの制限事項を知っておく必要があります。これはジェネレーターであり、バリデーターではありません。ツールはあなたのサイトに何が含まれているかを知らないため、サイト上でそのスラッグがすでに使われているかどうかは確認しません。ここで保証される重複の排除は、いま目の前にあるバッチ内でのみ有効です。リダイレクトもあなた自身の作業です。公開済みのページのスラッグを変更すると、古いアドレスはリンク切れになります。それはこのツールではなく、あなたのCMSで判断すべきことです。「ファイルに保存」は、CSVやJSONではなくプレーンテキストを書き出します。自動分割機能は、ほとんどすべてのケースでカンマについて正しい判断を下しますが、完璧ではありません。だからこそ、「入力の分割方法」でその動作をオーバーライドできるようになっています。そして、翻字は翻訳ではなく慣例です。Münchenは Munich ではなく muenchen になります。そのため、対象言語でそのページにすでに定着した名前がある場合、元のタイトルを自動変換したものよりも、その名前をスラッグとして使うほうが適しています。