コンテンツにスキップ
Coverton ブログ
この記事では
テーブルとデータ

TSVをCSVに変換:区切りと改行を確認

受信システムが CSV を受け入れる場合、タブ分離されたスプレッドシートを再保存します フィールドにはコマスまたは改行が含まれるので、各タブを平らなテキストのコマで置き換えることは、細胞の境界を保存するのに十分ではありません。

ツールを開く →このツールの使用方法 ↓
TSVをCSVに変換
このツールの操作の流れを示した図です。アップロードされたファイルの処理結果ではありません。

このツールの使用方法

  1. TSV, TXTファイルを選択します。最大1ファイルを選べます。
  2. 入力文字コードを確認し、処理を開始します。
  3. CSVの結果をダウンロードし、内容と品質を確認します。

設定を選ぶ

ソースが UTF-8 または EUC-KR 互換のエンコーディングを使用しているかどうかを確認し、それに応じて選択します。入力フィールドはタブで読み取られますが、保存された CSV は区切り文字としてカンマを使用します。

サポートされている入力
  • TSV, TXT
出力
  • CSV
利用可能な設定
  • 入力文字コード

作業前の準備

値の意味と列の構造を決めてから処理する

データを変える前に、一行が注文、商品、商品オプションのどれを表すか整理してください。同じ商品名でも記録の単位が違えば結合や重複除去の基準は変わります。別システムに入れる表か、人が読む報告かも区別します。形式変更が不足した値や業務ルールを補うとは考えず、受け渡し先の列名と必須項目を原本に照合してください。何を一件として数えるかを曖昧にしたまま行数だけ比較しないようにします。

表を読む処理ではヘッダー行とシートを先に確認します。説明行をデータとして読むと列名や行数がずれる場合があります。同じ意味の列でも綴りや周囲の空白が違えば別の列になり得るため、原本で揃えます。CSVでは文字コード、区切り、引用符内の改行も確認してください。文字化けを見つけたら値を書き換える前に、元のバイト列を正しい文字コードで読んでいるか調べます。誤った解釈のまま保存しないようにしてください。

商品コードや長い識別子は計算用の数字と区別します。先頭のゼロや末尾まで必要なら、原本にその文字が残っているか先に見てください。失われた桁を処理が推測して復元するわけではありません。日付の月日順や小数・桁区切りも原本の規則が必要です。規則が混じる列に一つの解釈を使うより、同じ規則の記録を分け、未解決の値を個別に調べます。表示が数字らしく見えることと、計算してよい値であることは別です。

比較や接続では記録を区別する列を選び、入力ファイルの順を確認してください。空白や大文字小文字を無視すると別のコードが同じ値になり得ます。重複除去では同じキーの金額や状態を比べ、最初と最後のどちらを残すか決めます。参照表のキー重複は接続を止める場合があります。セルを複数行へ展開すると他列も繰り返されるため、その金額を再集計する前に同じ記録が何回出力されたか確認してください。

報告と元の行を一緒に読んで検証する

出力の行数が増減した理由を確認します。結合では原本の件数と出所、分割では空の値によるグループも見てください。列移動やマッピングは名前だけでなく値が正しい列に入ったか比較します。入れ子を持つJSONと平面の表では表現できる内容が違います。文字列、空値、配列がどう保存されたか具体的な記録を選んで確かめ、似た見た目だけで同じとは判断しないでください。必要な構造が失われていないかを用途に合わせて読みます。

検証や除去報告が元の行番号を示すなら、その位置の値を見ます。エラーなしは指定した規則についての結果であり、業務条件全体の保証ではありません。集計は一つのグループを原本に照合し、件数が何を数えたか確認してください。数値列の通貨記号や文字は意味を把握してから整理します。空値を補わない報告は不足値を判断する資料として使います。正しいと認めた条件を報告と一緒に残すと、後の確認で判断範囲が分かります。

印刷表、サイズ表、コードラベルでは表示値と実寸を確認します。単位変換やコード発行まで行うとは考えず、原本の値がどう使われるか読んでください。QRやバーコードは名前と正しく対応するか見て、使用サイズで印刷して読み取ります。Base64ではファイルのバイト表現と文字コード、暗号化を区別します。XMLとJSONのようにデータモデルが異なる形式は、拡張子だけでなくフィールドと構造を比較し、受け取り側の要求を確認してください。

ダウンロード後は使うソフトへ読み込み直してください。CSVで識別子が数字や日付に変わるか、数式列が保存済み計算結果として読まれるか見ます。文字化け済み原本、切れた長い数値、存在しない列は再実行だけでは戻りません。失敗時は示された列と規則を先に確認し、原本の問題か設定の問題かを分けます。未解決行を残して確認済み値と追跡できるようにすると、次の修正でもどの範囲を見たかを見失いません。

入力と出力の例

タブ別名/コント → comma別 CSV

例でワークフローを説明します。結果はソース ファイルと設定によって異なります。

保存する前に結果を確認する

ヘッダーの幅とデータ行数をソースと比較します。カンマを含むアドレスまたは引用符を含む説明を調べて、それぞれが 1 つのセルのままであることを確認します。

結果が期待したものと異なる場合

閉じていない引用符や標準以外のフィールド構文は、解析エラーを引き起こす可能性があります。出力が 1 列に表示される場合は、受信アプリケーションのインポート設定でもカンマ区切り文字が使用されていることを確認してください。

利用上の制限

  • 引用符、区切り文字、改行には正しい構文が必要です。数式のようなセルはエスケープされます。

次の作業を選ぶ

CSVをJSONに変換

最初の CSV 行は、各データ行の JSON オブジェクトのキーを提供します。セル値は文字列として保存されるため、数値またはブール値を期待するシステムに結果を渡す前に、その型を検査してください。

ソースコードを選択し、自動デリミッター検出を使用するか、実際のデリミッターを選択します. 空っぽまたは複数のヘッドを解決し、それぞれの列がヘッドと同じ数の列を持っていることを確認します。

ツールを開く →

JSONをCSVに変換

各要素がオブジェクトになっている配列を用意してください。入れ子のオブジェクトを別々の列に展開するか、セル内の JSON 文字列として残すかによって、表の読み方が変わります。

フラット化を有効にすると、入れ子のプロパティ名をドットでつないだ列見出しに変換します。配列は複数行に展開されないため、各要素を分析する場合は該当セルを別途確認してください。

ツールを開く →

このガイドでは、ブラウザで使える公開ツールを説明します。元のファイルのコピーを保管し、共有する前に結果を確認してください。

この翻訳はソフトウェアの支援を利用して作成されました。英語版も読むことができます。 英語で読む