乱雑なリストをA~Zに整理する、12ステップのアルファベット順序付けシステム
重複、大文字小文字、スペース、アクセント、複数部分のレコードを処理しながら、名前、参照文献、キーワード、大量にコピーペーストされたリストを一貫して並べ替える方法。
短いリストを手作業でアルファベット順に並べるのは簡単に見えます。しかし、リストに数百のエントリ、大文字小文字の表記ゆれ、重複した行、余分なスペース、アクセント付き文字、タイトル、姓、数字、または各名前に紐付く必要がある情報が含まれている場合、このタスクは意外と間違いやすくなります。
不正確な並べ替えにより、顧客情報とメールアドレスが分かれてしまったり、製品が在庫コードから離れてしまったり、同じエントリが複数の場所に配置されたり、学術参考文献リストが引用文献の間違った部分に従って整理されたりする可能性があります。結果は見た目がきれいに見えても、信頼性が低くなる可能性があります。
このガイドでは、リストの有用な構造を失わずに整理するための一貫したシステムを紹介します。準備、並べ替えの方向、大文字小文字、空白、重複、名前、組織、参照文献、キーワード、多言語エントリ、最終確認について説明します。目標は、単に単語をA~Z順に配置することではありません。正確で、理解しやすく、次の用途に対応するリストを作成することです。
1. 1つのリスト項目が何を表すかを定義する
並べ替える前に、リスト内の1つの項目が実際に何を表すかを決定します。1つの単語、1つの完全な行、1人の人物、1つの企業、1つの書誌エントリ、または複数の関連フィールドを含む1つのレコードである可能性があります。
この決定は、その後のすべてを制御します。各行に1つの製品名が含まれている場合、行を並べ替えるのは簡単です。各製品が3行を占める場合(名前、在庫コード、価格),個々の行を並べ替えると、それらの詳細間の関係が破壊されます。
この例を考えてみましょう。
Alpine Desk Lamp | SKU-184 | In stock
Cedar Office Chair | SKU-207 | Low stock
Brookfield Table | SKU-153 | In stock
有用な並べ替え単位は、スペースまたは縦棒で区切られた各単語ではなく、完全な製品レコードです。製品名で並べ替えた後、すべての在庫コードと利用可能性ステータスは、元の製品に接続されたままである必要があります。
「各行は1つの完全な製品レコードを表し、最初のフィールドが並べ替えキーです。」シンプルなルールにより、後で誤った再構成を防ぐことができます。
続行する前に折り返された行を探してください。長い書誌エントリまたはアドレスは視覚的に2行を占めますが、技術的には1つの段落のままである可能性があります。逆に、コピーされたスプレッドシートデータは1行のように見えますが、複数の列を分離するタブが含まれている可能性があります。
並べ替え単位が不明な場合は、自動化を開始しないでください。まず、すべての項目が予測可能な境界を持つようにデータを再編成してください。
2. 正しい並べ替え方向を選択する
ほとんどのアルファベット順タスクは昇順のA~Z順を使用しますが、逆順のZ~A順は逆方向の閲覧が必要な場合に役立つ可能性があります。正しい方向は、完成したリストがどのように使用されるかに依存します。
| リストタイプ | 一般的な方向 | 理由 |
|---|---|---|
| 用語集 | A~Z | 読者は辞書スタイルの検索を期待している |
| 従業員ディレクトリ | A~Z | 名前を見つけやすくする |
| 参考文献リスト | A~Z | 通常は最初の著者の姓で整理される |
| キーワード在庫 | A~Z | 重複と変種を特定するのに役立つ |
| 逆方向閲覧エクササイズ | Z~A | 大規模なリストの末尾をチェックするのに役立つ |
アルファベット順は、年代順、数値順、優先度順、またはパフォーマンスベースの順序と混同されるべきではありません。プロジェクトのリストはアルファベット順の方が見つけやすい場合がありますが、タスクリストは期限または重要度でソートされている場合の方がより有用である可能性があります。
リストが数字で始まる場合、数字が文字の前に表示されるかどうか、および数値順序が必要かどうかを決定してください。単純なテキスト並べ替えでは、「100」、「11」、「2」が数値ではなく、最初の文字に従って配置される場合があります。
リストが共有される場合は、ファイル名または見出しに方向を記録してください。「顧客ディレクトリ(A~Z)」や「製品インデックス(Z~A)」などのラベルは、ドキュメントの次のユーザーの不確実性を排除します。
3. 複数部分のレコードを保護する
最も有害な並べ替えの誤りは、関連情報を分離することです。顧客名、メールアドレス、注文番号、ステータスは、1つのレコードとして一緒に移動する必要がある場合があります。
並べ替える前に、構造を検査してください。
- すべての行に同じタイプの情報が含まれていますか?
- フィールドはコンマ、タブ、セミコロン、または縦棒で区切られていますか?
- 値に同じセパレータが含まれていますか?
- 上部に残すべきヘッダーがありますか?
- メモは上または下の行に属していますか?
- 空白行はカテゴリーを分離するために使用されていますか?
データに複数の列がある場合、通常、プレーンテキストソーターよりもスプレッドシートの方が安全です。GoogleのGoogle Sheetsのデータの並べ替えとフィルタリングに関する公式ガイドでは、選択した範囲を並べ替え、複数の並べ替えルールを追加する方法について説明しています。隣接するデータから列を切断できるため、完全な範囲を選択することが重要です。
単純なテキストリストの場合は、並べ替える前に、各レコードを1行に変換してください。同じ文字がデータ内で既に予測不可能に使用されていない限り、タブや縦棒などの一貫したセパレータを使用できます。
元のリストの変更されていないコピーを保存します。並べ替えされた結果は、元の順序の一意の識別子またはレコードがない場合、逆転させるのが難しい場合があります。
4. スペースと改行をクリーンアップする
見えないフォーマットは、見えるソートの問題を引き起こす可能性があります。スペースで始まるエントリは、文字で始まるすべてのエントリの前に表示される場合があります。空白行は空のリスト項目になる可能性があります。末尾のスペースにより、視覚的に同じ2行が重複として認識されるのを防ぐことができます。
リストを確認してください。
- 最初の文字の前のスペース
- 最後の文字の後のスペース
- 単語間の繰り返されたスペース
- スプレッドシートからペーストされたタブ
- エントリ間の空白行
- Webサイトからコピーされたノーブレークスペース
- 誤った改行で分割された単語
クリーンアップとは、すべての意図的なスペースを削除することを意味しません。最初の名前と姓の間のスペースは意味があり、複数単語の製品名は変わらないままにする必要があります。目標は、情報を追加せずに並べ替えキーを変更するフォーマットを削除することです。
リストがPDF、Webサイト、メール、またはスキャンされたドキュメントから取得された場合は、サンプルをソースと比較してください。ページヘッダーとナビゲーションラベルはコピー中にリストに入った可能性があります。実際のエントリのように見える行は、実際にはボタンラベルまたは繰り返されるドキュメント見出しである可能性があります。
クリーンアップ後、行をカウントしてください。数を予想総数と比較してください。リストに250人の参加者が含まれているはずですが、247行しかない場合は、空白行、折り返されたエントリ、または重複が差を説明する前に、並べ替えを行う必要があります。
5. 大文字小文字と句読点の扱いを決定する
大文字小文字は並べ替え順序に影響を与える可能性があります。大文字小文字を区別するシステムは、大文字のエントリを小文字のエントリと別にグループ化する場合があります。読者は一緒に表示されることを期待しています。
たとえば、大文字小文字を区別した結果は次のようになる場合があります。
Apple
Banana
apricot
blueberry
大文字小文字を区別しない並べ替えでは、通常、大文字小文字を別のグループを作成できるようにしないで、文字を比較します。
Apple
apricot
Banana
blueberry
一般的なディレクトリ、語彙リスト、キーワード、製品名の場合、ケースを無視すると通常、より自然な結果が生成されます。大文字小文字を区別した並べ替えは、テクニカル識別子、ユーザー名、変数、コード、または大文字と小文字の文字が異なる意味を持つシステムに適切である場合があります。
| 要素 | 可能な処理 | 確認質問 |
|---|---|---|
| 大文字 | ケースを無視する | 大文字小文字はデータにとって意味がありますか? |
| 引用符 | 保持する場合がありますが、並べ替え時に無視する可能性があります | 正式なタイトルの一部ですか? |
| ハイフン | 保持する | ハイフンは名前または識別子の一部ですか? |
| ハッシュタグ | 並べ替えキーから保持または削除する | 読者は単語またはシンボルで検索しますか? |
| 括弧 | 通常保持する | 括弧内のテキストはエントリを区別しますか? |
リストが後で装飾的なUnicodeスタイルを使用する場合は、プレーンテキストのままの間に並べ替えプロセスを完了してください。承認後、選択した表示テキストは、Mr.Gena Fancy Text Generatorを使用して変換できます。スタイルされた文字は、通常の文字と同じ並べ替え動作をしない可能性があります。
6. 冠詞、タイトル、接頭辞を処理する
エントリが一般的な冠詞またはタイトルで始まる場合、アルファベット順は複雑になります。「The Creative Handbook」は「The」のTの下に表示されるべきか、「Creative」のCの下に表示されるべきか?「Dr. Taylor Morgan」はD、T、またはMの下に表示されるべきか?
答えはリストの目的とスタイルルールに依存します。
図書館とインデックスは、タイトルを配置する際に「A」、「An」、「The」などの初期冠詞を無視する場合があります。一般的なインベントリは、書かれているとおりに並べ替える場合があります。人物のディレクトリは、タイトルが最初に表示されている場合でも、通常は姓を使用します。
隠された一時的な並べ替えキーを作成することを検討してください。
| 表示エントリ | 並べ替えキー |
|---|---|
| The Creative Handbook | Creative Handbook |
| An Introduction to Color | Introduction to Color |
| Dr. Taylor Morgan | Morgan, Taylor |
| Saint James Studio | Saint James Studio |
並べ替え中は接頭辞を無視する必要があるからといって、最終的に表示されるエントリから接頭辞を削除しないでください。プレゼンテーションを組織から分離してください。読者は完全な公式名を見る必要がありますが、システムは適切なキーを使用します。
「de」、「De」、「van」、「von」、「al」、「bin」などの姓接頭辞には、文化的およびスタイル固有の判断が必要です。すべての接頭辞を削除または移動できると仮定することは避けてください。正確性が重要な場合は、個人の優先プレゼンテーションまたは関連機関のルールに従ってください。
7. アルファベット順序付けを実行する
各項目が独自の行にあり、クリーニングルールが定義されたら、リストをMr.Gena Alphabetize Toolに貼り付けてください。
適切な方向を選択してください。
- 昇順。 A~Z
- 降順。 Z~A
大文字小文字を無視するかどうかを選択してください。通常の読者向けのリストの場合、大文字小文字を区別しないソートは通常、閲覧が簡単です。コードまたはテクニカル値の場合は、大文字小文字の区別が意味を持つ場合に大文字小文字の区別を保持してください。
重複が不要であることを既に決定していない限り、自動的に重複削除を有効にしないでください。まず、すべてのエントリが保持されたソートバージョンを作成してください。並べ替えは自然に同じまたは類似したエントリを一緒に移動し、重複の確認を簡単にします。
MicrosoftのWordのリストをアルファベット順に並べ替えるための公式ガイドでは、1レベルのリストを昇順または降順に配置する方法について説明しています。また、リスト並べ替えはWordのWebではなくデスクトップWordで利用可能であることも指摘しています。オンラインソーターは、元のドキュメントを変更せずにプレーンテキストを整理したい場合に役立ちます。
- バージョン1。元のリスト
- バージョン2。クリーニングされたリスト
- バージョン3。重複を含むソート済みリスト
- バージョン4。レビューおよび重複排除されたリスト
このバージョンシーケンスにより、誤りを簡単に診断して逆転させることができます。
8. 重複を安全に確認して削除する
重複削除は有用ですが、2つの類似したエントリは必ずしも重複ではありません。「Green Valley Ltd」と「Green Valley Limited」は同じ企業、2つの公式な命名変更、または調査が必要な個別のレコードを表す可能性があります。
完全な重複から始めてください。これらは、不要な先頭スペースと末尾スペースを削除した後、同じ文字を含む行です。次に、近い重複を手動で確認してください。
一般的な近い重複パターンには、以下が含まれます。
- 異なる大文字小文字。「North Studio」と「NORTH STUDIO」
- 追加のスペース。「Blue Market」と「Blue Market」
- 句読点。「Miller Inc.」と「Miller, Inc.」
- 頭字語。「Company」と「Co.」
- アクセント差。「Jose」と「José」
- 更新された名前。「Oak Media」と「Oak Media Group」
- タイピングエラー。「Creative House」と「Creatve House」
類似性だけに基づいてレコードを統合しないでください。メールアドレス、識別子、URL、日付、または2つのエントリが同じ項目を表すかどうかを確認できる他のフィールドを比較してください。
参加者または顧客リストの場合は、削除されたものを示す監査メモを保持してください。削除された重複は、2つの有効な登録または2つの個別のトランザクションを表した可能性があります。データクリーニングの利便性は、プロセスの規則を上書きするべきではありません。
9. 人名と組織名を正しく並べ替える
フルネームのリストは、名または姓で整理できます。どちらの方法も普遍的に正しくはありません。有用な選択は読者がどのように検索するかに依存します。
カジュアルな参加者リストは最初の名前を使用する可能性があります。
Aisha Khan
Daniel Wilson
Maria Lopez
専門ディレクトリ、書誌、または形式的なインデックスは姓を使用する場合があります。
Khan, Aisha
Lopez, Maria
Wilson, Daniel
名前が「First Last」形式で書かれているが、姓で並べ替える必要がある場合は、別の姓フィールドまたは並べ替えキーを作成してください。最終スペースが常に姓をマークしていると仮定することは避けてください。複数部分の姓、接尾辞、ミドルネーム、および異なる文化的命名システムは、より慎重な処理が必要です。
組織名は他の質問を提示します。頭字語を書かれているとおりに保持するかどうかを決定し、初期冠詞を無視するかどうかを決定してください。公式な大文字小文字を標準化する前に確認してください。「YouTube」、「eBay」、およびその他のスタイル化された名前は、リストを視覚的に統一するために変更されるべきではありません。
並べ替えられた名前が公開される場合は、周囲の説明をMr.Gena Grammar Checkerで実行してください。並べ替えは順序を変更しますが、スペル、文法、役職、または説明は修正されません。文法ツールはすべての固有名詞を認識しない可能性があるため、名前を別に確認してください。
10. 参考文献、用語集、キーワードを整理する
学術参考文献リストには、一般的なA~Z並べ替えよりも多くが必要です。並べ替えキーは通常、最初の著者の姓ですが、引用スタイルには、繰り返される著者、組織の著者、著者の不在、および同じ年からの複数の作品に関する追加ルールが含まれる場合があります。
Purdue OWLのAPAリファレンスリストガイドラインでは、エントリは最初の著者の姓でアルファベット順に並べられるべきであると述べています。また、同じ著者または同じ著者グループからの複数の作品は、通常、最も早いから最も最近までの時系列で配置されることを説明しています。
並べ替える前に、各完全な引用を1行または1つの段落として保持してください。引用文が視覚的に折り返される場合は、折り返しが新しいエントリの開始として解釈されないようにしてください。
参考文献を配置した後、Mr.Gena Plagiarism Checkerを個別のレビューとして使用して、言語の重複と可能なソースを確認してください。ソートされた参考文献は、すべての借用アイデアが正しく引用されていることを確認しません。論文の剽窃をチェックする方法に関するガイドでは、引用符、パラフレーズ、引用、一致する通路をまとめてレビューする必要がある理由について説明しています。
用語集
用語集の場合は、シンボルまたは数字で始まる用語がアルファベットの前に表示されるかどうかを決定してください。各定義を用語に接続したままにしてください。定義が複数の行を占める場合は、すべての行を独立して並べ替えるのではなく、構造化された形式を使用してください。
キーワード
アルファベット順の並べ替えは、繰り返されたキーワード、複数形の変種、スペルの不一致、大文字小文字の違いを明らかにすることができます。同じキーワードが同じ検索意図を持っていると仮定しないでください。マージする前に意味を確認してください。
語彙エクササイズ
教師と言語学習者は、Mr.Gena Random Word Generatorを使用してプラクティスリストを作成してから、それをアルファベット順にすることができます。学習者に結果を確認する前に、順序を手動で予測するよう促します。
11. 並べ替えられたリストを運用ワークフローで使用する
アルファベット順のリストは、最終的な目標ではなく、中間製品であることが多いです。それはディレクトリ、在庫、キャンペーン、顧客データベース、イベント登録、チェックリスト、またはギブアウェイを供給する場合があります。
運用作業の場合は、一意の識別子を保持してください。2人の顧客は同じ名前を共有でき、2つの製品は同じタイトルを持つことができ、2つのキャンペーンエントリは同じユーザー名を使用できます。並べ替えはナビゲーションを改善すべきですが、区別を消すべきではありません。
有用な運用例には、以下が含まれます。
- 手動レビュー前に顧客名を整理する
- 製品ラベルをグループ化してスペルの変種を見つける
- A~Zスタッフディレクトリを準備する
- カテゴリー化前にキーワード在庫をクリーニングする
- チェックイン前に参加者を配置する
- ギブアウェイ前に参加者名を確認する
クリーニングされたリストがランダム選択に使用される場合は、検証されたエントリをMr.Gena Raffle Toolに転送します。アルファベット順はランダムな選択に影響を与えるべきではありませんが、最初に並べ替えることにより、抽選前に正確な重複とフォーマットの問題を特定しやすくなります。
アルファベット順は記録を整理します。適格性を検証したり、身元を確認したり、ランダム性を作成したりしません。これらのチェックを別に実施してください。
リストに適用された正規化ルールを文書化してください。企業接尾辞が標準化された場合、スペースが削除された場合、または重複がマージされた場合、次のチームメンバーはそれらの決定を理解できる必要があります。
12. 最終リストをスポットチェックしてエクスポートする
リストがAで始まり、Zで終わるからといって、リストが正しいと仮定しないでください。検証では、注文、完全性、レコード整合性、重複、フォーマットを検査する必要があります。
境界チェックから始めてください。最初の10個と最後の10個のエントリを確認してください。次に、A~B、M~N、Y~Zなど、複数の文字間の遷移を検査してください。同じ接頭辞を含むグループを詳しく見てください。
Market
Marketing
Marketplace
Market Street
注文が明らかになるまで、文字を比較し続けてください。複数のエントリが同じ最初の単語を共有する場合、2番目以降の単語がそれらの相対的な位置を決定します。
ラインの合計をクリーニング済みのソート前バージョンと比較してください。重複削除が無効になっていた場合、合計は一致する必要があります。重複が削除された場合は、正確に何行が消えて、なぜかを記録してください。
- すべてのアイテムに明確な境界があります。
- 複数フィールドレコードは接続されたままです。
- 正しいA~ZまたはZ~A方向が選択されました。
- ヘッダーはソートされたデータから除外されていました。
- 先頭と末尾のスペースが削除されました。
- 大文字小文字の区別は意図的に選択されました。
- 句読点とアクセント文字が確認されました。
- 冠詞、タイトル、姓接頭辞は定義されたルールに従います。
- 重複は削除前に調査されました。
- レコードの総数が調整されました。
- 複数のアルファベット遷移がスポットチェックされました。
- 最終リストはその宛先形式でテストされました。
リストがブログ記事、ディレクトリ、またはダウンロード可能なリソースになる場合は、単語と文字を正確にカウントする方法についてのガイドに基づいて、計画プロセスの最終サイズを比較してください。並べ替えとカウント一緒にすると、エントリの欠落、重複した行、および予期外に大きなセクションを明らかにすることができます。
ソースを上書きしないでください。「customer-directory-a-z-reviewed」や「references-apa-sorted」などの説明的なファイル名を使用してください。可能な場合は、日付またはバージョン番号を含めてください。
アルファベット順序付けに関するよくある質問
数字は文字の前に表示されるべきですか?
多くのテキスト並べ替えシステムは数値文字を文字の前に配置しますが、正しいプレゼンテーションはリストに依存します。製品カタログは番号付けされた製品を別にグループ化する場合がありますが、インデックスは数字を綴るか、特定の編集ルールに従う場合があります。
タイトルをソートするときに「The」を無視する必要がありますか?
選択したスタイルに依存します。図書館やインデックスは初期冠詞を無視することが多いですが、リテラルなコンピュータソートはすべての「The」タイトルをTの下に配置する場合があります。並べ替える前にルールを定義し、一貫して適用してください。
大文字の単語が別に表示されるのはなぜですか?
並べ替え方法は大文字小文字を区別する可能性があります。通常の読者向けのリストでは、大文字小文字を区別しないオプションを選択してください。大文字小文字は、テクニカル値または識別子を区別する場合を除きます。
アクセント付き文字はどのようにソートされるべきですか?
結果は言語、ロケール、ソフトウェアによって異なる場合があります。一部のシステムはアクセント付き文字をアクセントなし形式でグループ化し、他のシステムは異なる文字順序を適用します。正しいスペルを保持し、聴衆の言語ルールに従って多言語リストを手動で確認してください。
フルネームを自動的に姓で並べ替えることはできますか?
一貫したフィールドまたは信頼できる並べ替えキーに姓が保存されている場合のみ。すべての名前を最後のスペースで分割すると、複数部分の姓、接尾辞、ミドルネーム、および異なる文化的命名規約で失敗する可能性があります。
重複は常に削除する必要がありますか?
いいえ。繰り返しは有効な2番目の登録、トランザクション、ソース、または製品変動を表す可能性があります。2つのエントリが同じレコードを表すことを確認してから、どちらかを削除してください。
参考文献リストを通常のワードリストのように手動で並べ替えることはできますか?
アルファベット順ソーターを出発点として使用できますが、選択した引用スタイルの姓、組織の著者、著者の不在、繰り返された著者、および発行日のルールに従う必要があります。
結論、良いソートはA~Zの前に始まる
信頼できるアルファベット順リストは、ソートボタンではなく、構造から始まります。真の項目境界を特定し、関連フィールドを保護し、偶発的なフォーマットをクリーニングし、大文字小文字と句読点のルールを選択し、名前、冠詞、重複をどのように処理するかを決定する必要があります。
これらの決定が行われたら、アルファベット順ツールは、大規模で一貫性のないリストを数秒以内に整理されたリソースに変えることができます。最終的な責任はユーザーにあります。合計を比較し、エッジケースを検査し、文化的およびテクニカル精度を保持し、すべてのレコードが並べ替え前に含まれていた情報を引き続き含むことを確認してください。
A~Z順は情報を見つけやすくするため有用です。よく設計された並べ替えワークフローは、その情報が見つけに値することを確認します。