a11y.skipToMainContent
1

CSVデータプロファイラ

CSV または TSV ファイルをドラッグ&ドロップして、即時の列ごとの統計情報を取得する — 自動検出されたデータタイプ、数値統計、テキストの頻度、アウターの検出、および分散スパークライン。 プロフィールをJSONとしてエクスポートします.

Drag a .csv or .tsv file here, paste from clipboard (Ctrl+V), or

Your file stays in your browser -- nothing is uploaded.

More options
Was this tool helpful?
Send output to:
Advertisement

How to use CSV Data Profiler

  1. .csv または .tsv ファイルをドロップ ゾーンにドラッグ アンド ドロップするか、クリックしてブラウズします.
  2. ツールは、区切り文字とヘッダ行を自動検出し、必要に応じてこれらの設定を調整します.
  3. データ型、値カウント、nullパーセンテージ、および型固有の統計情報を示すカラムのステータスカードを確認します.
  4. カードビューとサマリーテーブルビューを切り替えて、コンパクトな概要を表示します.
  5. エクスポートプロファイルをクリックすると、JSONファイルとしてフル統計プロファイルをダウンロードできます.

CSVデータプロファイラとは?

CSVデータプロファイラは、CSVファイルやTSVファイル内のすべての列の包括的な統計プロファイルを提供するクライアント側データ探査ツールです。 ファイルをドロップしたり、データを貼り付けたり、各列のデータ型を即座に自動検出します。数値、テキスト、日付、ブール値、または混合値で、そのタイプの関連統計を計算します。

数値列の場合、最小値、最大値、平均値、中央値、合計値、標準偏差値、さらに自動アウトリア検出値(平均3以上の標準偏差値)を取得します。 テキスト列の場合、最小/最大長、最も一般的な値(モード)、一意の値数、周波数分布バーを示します。 日付の列は、時刻/レートの日付と配信時刻を表示します。

各列は、値分布を一目で示すスパークラインまたは水平バーチャートを表示し、nullのパーセンテージはカラーコード(緑色=低、黄色=中、赤=高)です。 読みやすいサマリーテーブルは、1つのビューのすべての列のコンパクトなステータスを提供します。 完全なプロファイルをJSONとしてエクスポートし、ドキュメント、レポート、さらに解析を行います。

すべての処理は、お使いのブラウザで完全に行われます。CSVデータはデバイスを離れません。 アップロードなし、サーバーなし、データ保持なし。

Advertisement

FAQ

CSVデータはどこにでもアップロードされますか?
いいえ。 すべての解析、解析、および統計計算は、JavaScriptを使用してブラウザで完全に行われます。 あなたのデータは、デバイスを離れることはありません.
どのようなファイル形式をサポートしていますか?
CSV(コンマ区切り)、TSV(タブ区切り)、パイプ区切りファイル。 ツールは、最初の行から区切りを自動検出し、区切りのセレクターを介して手動でオーバーライドすることができます.
どのようなデータタイプが検出できますか?
プロファイラは数値、テキスト、日付(ISOおよびスラッシュフォーマット)、ブール(true/false、はい/no、1/0)、および混合タイプを検出します。 1つのタイプの80%未満の列は、混合されるようにフラグが付けられます.
アウターの検出方法は?
数値列の場合、平均から3以上の標準の偏差を落とす値は、その列のstatsカードにoutlierとしてフラグ付けされ、リストされています.
エクスポートされたJSONプロファイルで何ができますか?
JSON エクスポートには、すべてのカラムの統計、値、周波数分布、メタデータ(ファイル名、行数、解析タイムスタンプ)が含まれます。 ドキュメント、データ品質レポート、またはパイプライン内の他のツールに送ることができます.

Related tools

Author

SC
Sarah Chen"The Data Whisperer"

Data Analyst & CSV Specialist

Sarah has spent more than a decade wrangling spreadsheets, debugging CSV exports, and teaching teams how to make data work for them. She previously led data-quality initiatives at a fintech unicorn, where she reduced reporting errors by 40 percent through automated validation pipelines. When she is not optimizing queries or writing about data tooling, you will find her mentoring junior analysts at local bootcamps and speaking at data literacy meetups.

Advertisement