URLスラッグジェネレーター

あらゆるタイトルをブラウザ上でクリーンなURLスラッグに変換します。1つずつでも、リスト全体でも一括で処理可能。キリル文字やアクセント記号の正確な翻字規格、編集可能なルールを備え、データがアップロードされることはありません。

変換するテキストを入力してください
詳細オプション
翻字ルール
文字 ラテン文字 単語内の位置
っきゃ
っきゅ
っきょ
っぎゃ
っぎゅ
っぎょ
っしゃ
っしゅ
っしょ
っじゃ
っじゅ
っじょ
っちゃ
っちゅ
っちょ
っぢゃ
っぢゅ
っぢょ
っひゃ
っひゅ
っひょ
っびゃ
っびゅ
っびょ
っぴゃ
っぴゅ
っぴょ
っみゃ
っみゅ
っみょ
っりゃ
っりゅ
っりょ
ッキャ
ッキュ
ッキョ
ッギャ
ッギュ
ッギョ
ッシャ
ッシュ
ッショ
ッジャ
ッジュ
ッジョ
ッチャ
ッチュ
ッチョ
ッヂャ
ッヂュ
ッヂョ
ッヒャ
ッヒュ
ッヒョ
ッビャ
ッビュ
ッビョ
ッピャ
ッピュ
ッピョ
ッミャ
ッミュ
ッミョ
ッリャ
ッリュ
ッリョ
きゃ
きゅ
きょ
ぎゃ
ぎゅ
ぎょ
しゃ
しゅ
しょ
じゃ
じゅ
じょ
ちゃ
ちゅ
ちょ
ぢゃ
ぢゅ
ぢょ
っか
っが
っき
っぎ
っく
っぐ
っけ
っげ
っこ
っご
っさ
っざ
っし
っじ
っす
っず
っせ
っぜ
っそ
っぞ
った
っだ
っち
っぢ
っつ
っづ
って
っで
っと
っど
っは
っば
っぱ
っひ
っび
っぴ
っふ
っぶ
っぷ
っへ
っべ
っぺ
っほ
っぼ
っぽ
っま
っみ
っむ
っめ
っも
っや
っゆ
っよ
っら
っり
っる
っれ
っろ
っわ
にゃ
にゅ
にょ
ひゃ
ひゅ
ひょ
びゃ
びゅ
びょ
ぴゃ
ぴゅ
ぴょ
みゃ
みゅ
みょ
りゃ
りゅ
りょ
キャ
キュ
キョ
ギャ
ギュ
ギョ
シャ
シュ
ショ
ジャ
ジュ
ジョ
チャ
チュ
チョ
ヂャ
ヂュ
ヂョ
ッカ
ッガ
ッキ
ッギ
ック
ッグ
ッケ
ッゲ
ッコ
ッゴ
ッサ
ッザ
ッシ
ッジ
ッス
ッズ
ッセ
ッゼ
ッソ
ッゾ
ッタ
ッダ
ッチ
ッヂ
ッツ
ッヅ
ッテ
ッデ
ット
ッド
ッハ
ッバ
ッパ
ッヒ
ッビ
ッピ
ッフ
ッブ
ップ
ッヘ
ッベ
ッペ
ッホ
ッボ
ッポ
ッマ
ッミ
ッム
ッメ
ッモ
ッヤ
ッユ
ッヨ
ッラ
ッリ
ッル
ッレ
ッロ
ッワ
ニャ
ニュ
ニョ
ヒャ
ヒュ
ヒョ
ビャ
ビュ
ビョ
ピャ
ピュ
ピョ
ミャ
ミュ
ミョ
リャ
リュ
リョ
ア
イ
ウ
エ
オ
カ
ガ
キ
ギ
ク
グ
ケ
ゲ
コ
ゴ
サ
ザ
シ
ジ
ス
ズ
セ
ゼ
ソ
ゾ
タ
ダ
チ
ヂ
ツ
ヅ
テ
デ
ト
ド
ナ
ニ
ヌ
ネ
ノ
ハ
バ
パ
ヒ
ビ
ピ
フ
ブ
プ
ヘ
ベ
ペ
ホ
ボ
ポ
マ
ミ
ム
メ
モ
ヤ
ユ
ヨ
ラ
リ
ル
レ
ロ
ワ
ヲ
ン

スラッグとは、Webアドレスの末尾にある人間が読める部分のことです。たとえば example.com/blog/my-first-post の my-first-post がこれにあたります。これは、ユーザーがクリックするかどうかを決める前に読む部分であり、検索エンジンがページの内容を説明する短いテキストとして読み取る部分でもあります。そのため、データベースのIDや日付よりも慎重に決める価値があります。この無料ジェネレーターは、あらゆるテキストをスラッグに変換します。「変換するテキスト」にタイトルを貼り付けて「生成」を押すと、結果がコピーボタンとともに表示されます。デフォルトの設定は、「小文字にする」、単語間のダッシュ、「ストップワードを削除」、ラテン文字以外の翻字といった、多くのサイトで求められる設定になっています。そのため、クリックするだけで使えるスラッグができあがります。もちろん、これらの設定はすべてスイッチで変更できます。

すべての処理はあなた自身のデバイス上で行われます。ページは小さなJavaScriptエンジンを読み込み、ローカルで実行します。入力したタイトルがアップロードされたり、記録されたりすることはなく、インターネット接続を切ってもツールは機能し続けます。設定を変更した瞬間に結果が更新されるのもそのためです。結果を予測しやすくするために、処理の順序を知っておくと便利です。貼り付けられたリンクは最初に最後のパス部分だけが抽出されます。次に、テキストが小文字に変換され、ストップワードが削除され、ラテン文字以外の文字が翻字されます。設定している場合は数字と特殊文字が削除され、残ったものが区切り文字で結合されます。その後、結果は最大長に合わせて切り詰められ、最後に重複がある場合は末尾に数字が追加されます。「変換するテキスト」は一度に最大500,000文字まで受け付けるため、数千件の記事件名を一気に処理できます。

1行の入力につき、1つのスラッグを出力します。タイトルのリストを丸ごと貼り付けると、各行がそれぞれ番号付きのスラッグになります。元のタイトルはグレー色で上に表示されるため、50件のバッチ処理でも、どのスラッグがどの見出しのものかすぐにわかります。すでにファイルにまとめられているリストをクリップボード経由で貼り付ける必要はありません。入力フィールドの横にある「ファイルからロード」ボタンを使えば、.txt、.csv、.md、.json などのプレーンテキストファイルを開き、その内容を直接フィールドに入力できます。ブラウザはこのファイルを、あなたが手で入力したテキストと同じように読み取ります。データがどこかにアップロードされることはありません。「入力の分割方法」では、リストをどのように区切るかを指定します。デフォルトは「自動検出」です。改行は常に項目を区切りますが、カンマは1行の入力データがそれぞれ独立した値に見える場合にのみ区切ります。そのため、"価格 1,500円" や "第5章: 結果, 結論" は分割されず、そのまま保持されます。データの形式があらかじめ分かっている場合は、「改行」、「カンマ」、「スペース」を選択して分割方法を固定できます。「出力形式」は、処理後のバッチ結果をどのように受け取るかを決めます。「改行」、「スペース区切り」、「カンマ区切り」のいずれかを選択でき、「すべてコピー」および「ファイルに保存」の両方がこの設定に従います。「履歴」には過去10回分のバッチがブラウザ内に保存されるため、1時間前に変換したリストもまだそこにあります。

ラテン文字以外のテキストの扱いは、多くのスラッグジェネレーターが大まかにしか対応しておらず、正確に処理できるものは少数です。URLはプレーンなASCII文字にするのが最も安全であるため、キリル文字、ギリシャ文字、アラビア文字、中国語、ヨーロッパ言語のアクセント記号付きの文字などは変換する必要があります。問題は、どのルールに従うかです。このページでは2つのレイヤーでこれに対応しています。一般的なレイヤーは、すべての文字体系をカバーしています。入力可能なほぼすべての文字に対して適切なASCIIの答えを返す翻字ライブラリであり、どのテーブルにも載っていない文字はここが引き受けます。特定のレイヤーは、一般的なルールがその国で実際に使われているものと異なる言語向けに手動で作成されたテーブルのセットで、日本語もその一つです。選ぶものはありません。かな用のヘボン式テーブルがこのページで最初から読み込まれています。一般的なレイヤーはかなを一文字ずつ読むため、小さな「ゃゅょ」を大きな文字として扱い、きょう が kiyou に、しゃしん が shiyashin になっていました。小さな「っ」も t になり、がっこう は gatkou でした。テーブルはこれを直します。きょう は kyou、がっこう は gakkou、キャベツ は kyabetsu、まっちゃ は matcha です。長音記号「ー」はそのまま落とします。ラーメン が ramen になるのは、日本語のURLで実際によく使われる書き方だからです。読み込まれたテーブルは「翻字ルール」の下の編集可能なグリッドに並び、各文字はテキストフィールドになっていて自由に変更でき、「ルールをデフォルトにリセット」で元に戻せます。ウクライナ語のテーブルは、ウクライナのパスポートに印刷される標準である2010年の内閣決議第55号に従っています。これには、見落とされがちな細部も含まれています。たとえば、жと区別するために зг は zh ではなく zgh になり、є, ї, й, ю, я は単語の先頭と途中で異なる形を取ります。アポストロフィと軟音符は新しい単語を始めずに削除されるため、Знам'янка は znamyanka ではなく znamianka になります。ドイツ語のデフォルトでは、ドイツのアドレスで実際に使用されている ä → ae、ö → oe、ü → ue への拡張が適用されますが、お好みでシンプルな ä → a のバリアントを使用することもできます。

「ストップワードを削除」はデフォルトでオンになっています。これは、英語の a, the, and, of, for などの小さなつなぎの単語を削除する機能です。これらはスラッグを長くするだけで、意味を付け加えることはありません。「ストップワード」の下にあるリストは完全に編集可能で、最初から入力された状態で表示されます。英語のリストに加えて、現在開いているページの言語用リストも用意されています。そのため、ウクライナ語のページでは в, на, та, і を認識し、ドイツ語のページでは der, die, das を認識します。独自の単語を追加したり、残したい単語を削除したり、この機能自体を完全にオフにしたりすることもできます。オフにした場合、フィールドはグレー表示になります。この機能に関する2つの正直な注意点があります。ストップワードの削除は、検索順位を上げるための要素ではなく、アドレスを短くすっきりさせるためのものです。また、タイトルのすべての単語がたまたまリストに含まれていた場合、結果は完全に空になります。そのため、ツールは空のボックスを返す代わりに、その旨をメッセージとして伝えます。

残りのスイッチはスラッグの形を決定します。「スラッグ内の区切り文字」は、単語の間に何を置くかを選択します。デフォルトがダッシュになっているのは好みの問題ではありません。Googleはダッシュを単語の区切りとして読み取り、アンダースコアを結合文字として読み取ります。つまり、my_first_post はクローラーには1つの長い単語として認識されますが、my-first-post は3つの単語として認識されます。「アンダースコア (_)」は、システムがそれを要求する場合のために用意されています。「小文字にする」はオンになっています。なぜなら、ほとんどのサーバーはアドレスの大文字と小文字を区別して処理するため、大文字と小文字が混ざっていると、1つのページに2つのURLができてしまう可能性があるからです。「特殊文字を削除」は、文字、数字、スペース、ダッシュ、アンダースコア以外のすべてを取り除きます。これにより、句読点、引用符、絵文字がアドレスに入り込むのを防ぎます。特に絵文字は翻字の前に削除されるため、ロケットの絵文字が「rocket」という単語に変換されることはありません。「数字を削除」はオフになっています。タイトルの数字は通常、タイトル自体の一部だからです。「最大長」は10から200の間で設定でき、デフォルトは80です。スラッグがそれより長くなる場合、エンジンは単語の途中で切るのではなく、収まる最後の単語全体を残すように切り詰めます。各結果の横にある数字は文字数を示し、60を超えると赤くなります。これは厳密な制限ではありませんが、検索結果でスラッグが省略され始め、メッセージに貼り付けるには不格好になり始める目安です。

一括変換を1クリックの作業に戻すための2つのスイッチが用意されています。「スラッグを重複させない」は、2つの異なるタイトルが同じスラッグになってしまうケースを防ぎます。たとえば「トップ 10 のコツ」と「トップ-10 のコツ」はどちらも toppu-10-nokotsu になりますが、この機能により2つ目には -2、3つ目には -3 が付与されます。接尾辞を追加することで最大長を超えてしまう場合は、まずベース部分が短縮されます。1つのアドレスに2つのページが割り当てられてしまう問題は、CMS内で対処するよりもこのリストの段階で修正する方がはるかに簡単です。「URLからスラッグを抽出」は逆の方向に機能します。完全なリンクを貼り付けると、ツールはパスの最後の部分を取り出し、クエリ文字列や .html や .php などの拡張子を削除し、パーセントエンコーディングをデコードします。そのため、Wikipediaの %D0%9B%D1%8C%D0%B2%D1%96%D0%B2 で終わるアドレスは、16進数の羅列ではなく lviv として返されます。この機能は行全体がリンクである場合にのみトリガーされるため、文中に引用されたアドレスはそのまま保持されます。

なぜこのスラッグジェネレーターを選ぶべきなのでしょうか?

スラッグは、ページが読みやすいアドレスを持つ必要がある場所で必ず求められます。ブログやニュースサイトはすべての見出しをスラッグに変換します。このツールはそのようなケースを想定して作られました。1週間分の見出しを貼り付けて、1週間分のURLを取得できます。オンラインショップでも、製品名やカテゴリ名について同じことを行います。通常はインポート後に一括で行われ、アドレスが対応していない文字を持つ言語で処理されることが一般的です。ドキュメントやナレッジベースでも、アンカーやファイル名を同じ方法で構築します。Webアドレス以外でも、このクリーンな文字列は役立ちます。別のオペレーティングシステムで壊れないファイル名、ログで人間が読めるデータベースキー、ブランチ名、メディアライブラリの画像名、または静的サイトジェネレーターのセクション識別子などに使えます。人間が読める名前を機械が読み取れるフィールドに入力する必要がある場所ならどこにでも、スラッグの出番があります。

このツールに依存する前に、いくつかの制限事項を知っておく必要があります。これはジェネレーターであり、バリデーターではありません。ツールはあなたのサイトに何が含まれているかを知らないため、サイト上でそのスラッグがすでに使われているかどうかは確認しません。ここで保証される重複の排除は、いま目の前にあるバッチ内でのみ有効です。リダイレクトもあなた自身の作業です。公開済みのページのスラッグを変更すると、古いアドレスはリンク切れになります。それはこのツールではなく、あなたのCMSで判断すべきことです。「ファイルに保存」は、CSVやJSONではなくプレーンテキストを書き出します。自動分割機能は、ほとんどすべてのケースでカンマについて正しい判断を下しますが、完璧ではありません。だからこそ、「入力の分割方法」でその動作をオーバーライドできるようになっています。そして、翻字は翻訳ではなく慣例です。Münchenは Munich ではなく muenchen になります。そのため、対象言語でそのページにすでに定着した名前がある場合、元のタイトルを自動変換したものよりも、その名前をスラッグとして使うほうが適しています。

FAQ

URLスラッグを作成するにはどうすればよいですか?

「変換するテキスト」にタイトルを貼り付けて「生成」を押してください。結果がコピーボタンとともに表示されます。多くのサイトが好むデフォルト設定(小文字にする、単語間にダッシュを入れる、ストップワードを削除、ラテン文字以外を翻字する)で変換されます。これらはすべてスイッチで変更できます。また、「詳細オプション」には、区切り文字、最大長、ストップワードのリスト、翻字ルールなどのその他の設定が含まれています。

タイトルのリスト全体を一度に変換できますか?

はい。最大500,000文字(数千件の見出し)を貼り付けることができます。または、入力ボックスの横にある「ファイルからロード」ボタンを使えば、ファイルから直接読み込むこともできます。この処理はブラウザ内で行われるため、アップロードはされません。各行はそれぞれ番号付きのスラッグになり、元のタイトルが上に表示されるため、簡単に照合できます。「入力の分割方法」でリストの区切り方をコントロールし、「出力形式」でバッチ結果を改行区切り、スペース区切り、カンマ区切りのどれで返すかを決定します。「すべてコピー」および「ファイルに保存」の両方で、結果を一度に取得できます。

キリル文字やアクセント付きの文字はどのように処理されますか?

これらは2つのレイヤーでASCIIに翻字されます。キリル文字、ギリシャ文字、アラビア文字、アクセント付きのラテン文字など、あらゆる文字は一般的な翻字ライブラリでカバーされ、どのテーブルにも載っていない文字はここが引き受けます。その上に、一般的なルールがその国で実際に使われているものと異なる言語向けの手動テーブルが載っており、日本語もその一つです。かな用のヘボン式テーブルが最初から読み込まれているので、きょう は kyou、がっこう は gakkou、キャベツ は kyabetsu になります。各文字は編集可能です。ただし漢字は別です。下のよくある質問で説明しているとおり、漢字には日本語の読みが付きません。

日本語にはどの翻字標準が使われますか?

かなについてはヘボン式です。きょう は kyou、しゃしん は shashin、がっこう は gakkou、まっちゃ は matcha。カタカナも同じで、キャベツ は kyabetsu、シャツ は shatsu になります。長音記号「ー」は落とすので、ラーメン は ramen です。

漢字については、正直にお伝えする必要があります。このツールは漢字に日本語の読みを付けられません。一般的な翻字ライブラリは漢字を中国語として読むため、東京 は tokyo ではなく dongjing、大阪 は osaka ではなく daban になります。漢字の読みは字ではなく語によって決まるので、一文字ずつの表では原理的に解決できず、辞書と形態素解析が必要です。

ですから漢字を含む見出しをそのまま貼り付けても、使えるスラッグにはなりません。読みをひらがなかローマ字で入力してください。とうきょうのしゃしん と入力すれば toukyou-no-shashin になります。それ以外の機能 — 一括変換、ストップワード、最大長、重複への -2 と -3 — は日本語でもそのまま働きます。

特定の文字の翻字方法を変更することはできますか?

はい。「翻字ルール」を開くと、テーブルの各文字がテキストフィールドになっています。その文字をどのように変換したいかを入力すると、入力と同時に結果が更新されます。フィールドを空にすると、その文字は完全に削除されます。編集内容は次回の利用のためにブラウザ内に保存されます。「ルールをデフォルトにリセット」を押せば、いつでも標準のテーブルに戻すことができます。

ストップワードとは何ですか?削除したほうがよいですか?

ストップワードとは、a, the, and, of, for などの小さなつなぎの単語のことで、スラッグを長くするだけで意味を明確にすることはありません。これらを削除する機能はデフォルトでオンになっており、「ストップワード」の下にあるリストは編集可能です。英語のリストに加えて、閲覧しているページの言語用リストが事前に入力された状態で提供されます。ただし、メリットについて正直に言うと、これは検索順位を上げるためではなく、アドレスを短くすっきりさせるためのものです。タイトルがストップワードだけで構成されている場合、ツールは空のスラッグを返すのではなく、その旨をメッセージとして表示します。

スラッグにはダッシュとアンダースコアのどちらを使用すべきですか?

技術的なシステムが別の文字を要求しない限り、ダッシュ(ハイフン)を使用してください。Googleはダッシュを単語の区切りとして扱い、アンダースコアを文字の結合として扱います。つまり、my_first_post は1つの長い単語として読まれますが、my-first-post は3つの単語として読まれます。この理由から、ジェネレーターのデフォルトはダッシュになっています。「スラッグ内の区切り文字」には、それを必要とするシステムのために「アンダースコア (_)」も用意されています。

URLスラッグの長さはどのくらいが適切ですか?

一目で読めるくらい短くするのがよいでしょう。最初の数単語が意味を持ち、残りは通常、文の末尾にすぎません。各結果の横にある数字は文字数を示しており、60を超えると赤くなります。これは、検索結果でスラッグが省略され始め、メッセージに貼り付けるには不格好になり始める大まかな目安です。「最大長」は10から200文字までの厳密な上限を設定でき、デフォルトは80です。

スラッグが長すぎる場合、単語の途中で途切れますか?

いいえ。スラッグが最大長を超えた場合、エンジンは収まる範囲の最後の単語全体まで戻ってそこで切り詰めます。そのため、切り詰められたスラッグでも単語の途中の音節で終わることなく、単語として読むことができます。重複に対して数字の接尾辞を追加する場合も同様です。ベース部分が先に短縮されるため、完成したスラッグは常にあなたの設定した制限を守ります。

2つのタイトルが同じスラッグになった場合はどうなりますか?

「スラッグを重複させない」がデフォルトでオンになっており、これを処理します。1つ目は通常のスラッグを保持し、2つ目には -2、3つ目には -3 と付与されます。これは、「トップ 10 のコツ」と「トップ-10 のコツ」がどちらも toppu-10-nokotsu になってしまうような一般的なケースを防ぎます。これをオフにすると、重複したままの生の出力が得られます。なお、重複の排除が保証されるのは、いま変換したバッチ内のみであることに注意してください。ツールはあなたのサイトにすでに何が存在するかを知ることはできません。

タイトルの代わりにURLを貼り付けることはできますか?

はい。「URLからスラッグを抽出」はデフォルトでオンになっています。行全体がリンクの場合、ツールはパスの最後の部分を取り出し、クエリ文字列や .html、.php の拡張子を削除し、パーセントエンコーディングをデコードします。そのため、%D0%9B%D1%8C%D0%B2%D1%96%D0%B2 で終わる Wikipedia のアドレスは、16進数の羅列ではなく lviv として返されます。この機能は行全体が完全にリンクである場合にのみトリガーされるため、文中に引用されたURLは通常のテキストとして処理されます。

入力したテキストはサーバーに送信されますか?

いいえ。変換処理は、ローカルのJavaScriptとしてブラウザ内で実行されます。何もアップロードされず、何も記録されず、ページが読み込まれた後はオフラインでも機能し続けます。未公開の見出し、社内の製品名、クライアントのデータなどはあなたのマシンにとどまります。これが、この特定の作業においてサーバー側のツールよりもローカルのツールを選ぶべき実用的な理由です。

1つの文が2つのスラッグに分割されてしまったのはなぜですか?

カンマが含まれており、「入力の分割方法」が「自動検出」に設定されていたためです。このモードは、改行を明確な区切り文字として扱い、カンマを可能性のある区切り文字として扱います。カンマで分割されるのは、1行のデータがそれぞれ独立した値に見える場合のみです。3,5 のような小数や、コロンを含む文は意図的にそのまま保持されます。タイトルが不適切に分割されてしまう場合は、「入力の分割方法」を「改行」に設定してください。そうすれば、実際にEnterキーを押した場所でのみ分割されるようになります。