CSV列抽出器

列を抽出

CRM、分析プラットフォーム、またはデータベースからエクスポートするデータには、実際には必要な3列しか含まれていないにもかかわらず、通常30列が含まれています。このツールはCSVファイルを読み取り、カンマ区切りで1番から順に並んだ列インデックスのリストを取得し、指定した順序に従ってその列のみを含む新しいCSVファイルを返します。ヘッダー行とデータ行は同じように処理されるため、ヘッダーの列1はすべてのデータ行において列1として扱われます。

列を抽出する方法

  1. 1

    CSVを貼り付けます

    完全なファイルまたはスニペット。行はCR、LF、またはCRLFで区切りられており、各行は標準的なCSVルールに基づいて解析されます。

  2. 2

    保持する列をリスト化します

    カンマで区切られた1から始まるインデックスを使用します(例:`1,3,5`)。出力結果はその順序に従います、列の順序はリアルタイムで変更できます。

  3. 3

    抽出を実行します

    各行は要求されたセルのみを用いて書き換えられます。セル内のカンマは自動的に引用符で表現されます。

  4. 4

    コピーまたは保存

    結果をExcel、データベースインポートウィザード、またはCSVを読み込むことができる任意のツールに貼り付けてください。

エクストラクタが難しい部分をどのように処理するか

CSVは、カンマや引用符を含むセルに出くわすまでは見た目がシンプルに見えます。このエクストラクタは、各行をRFC 4180スタイルのCSVルールに従って解析します。

入力解析ルール

  • 行は任意のUnicodeの改行で区切られるため、Windows、macOS、Linuxのいずれのファイルも問題なく扱えます。
  • 引用符で囲まれたセルには、カンマ、改行、エスケープされた引用符("")を含めることができます。
  • 空の末尾の行は削除されます。

出力の書式設定

  • 出力における列の順序は、入力時の順序ではなく、あなたが入力した順序に従います。
  • カンマを含むセルは二重引用符で囲み直され、後続のパーサーが内容を正しく読み取れるようにします。
  • カンマを含まないセルは、出力を簡潔に保つためそのまま出力されます。

注意すべき落とし穴

シナリオ 何が起こるか
最後の列を超えるインデックス その位置に空文字列が出力されます。
負またはゼロのインデックス 1未満のインデックスは無視されます。
セルに引用符が含まれる 厳格なパーサーが正しく読み戻せるよう、出力時にRFC 4180に従って引用符で囲み直されます("")。
重複インデックス(例:1,1,2 列1が2回出力されます、スプレッドシートのキーの重複処理に便利です。

非常に大きなファイル(数百万行)の場合は、専用のライブラリを用いてCSVデータをストリーミングで処理することを検討してください。このツールはすべてのデータをメモリに保持するため、行数が数十万行を超えると処理速度が低下します。

よくある質問

インデックスは、最も左側の列から1から始まります。ヘッダー名で抽出する場合は、CSVファイルのヘッダー行を確認し、名称を位置に変換してください。

はい。出力結果にはインデックスリストの順序が保持されます。3,1,2は、ヘッダーを含むすべての行について、まず列3を、次に列1を、最後に列2を表示します。

欠損セルには空の文字列が入力されます。これにより出力結果が矩形形状を保ち、下流のツールが不規則な行でエラーが発生しないようにします。

はい。列を抽出するため、CSVファイルは当社のサーバーに送信されて処理され、結果がお使いのブラウザーに返されます。保存はされず、ページのリンクにも追加されません。

関連ツール

このツールは他の言語でも利用できます