본문으로 건너뛰기
AZ Tools

CSV 분석기

첫 줄에서 구분자(쉼표·탭·세미콜론·파이프) 자동 감지, RFC 4180 인용 처리로 파싱. 컬럼별로 빠른 타입 추론(number·boolean·date·string) + 빈 셀 수·고유값 수·샘플. 전체 행 중복은 별도 지표.

5

6

중복

0

컬럼
컬럼타입빈 셀고유값샘플
id숫자051
name문자열04Alice
email문자열14alice@example.com
age숫자1430
signup날짜042024-01-15
verified02true

모두 브라우저에서 처리 — 데이터가 기기를 떠나지 않음.

사용법

  1. CSV·TSV 파일 드롭 또는 박스에 직접 붙여넣기.
  2. 데이터에 맞게 헤더 행 체크박스 토글.
  3. 행·열·중복 카드 → 컬럼별 타입 표 확인.

자주 묻는 질문

중복 기준?
모든 필드 완전 일치. 한 셀이 한 글자만 달라도 중복 아님. 퍼지 매칭이 필요하면 별도 dedupe 단계 사용.
타입 추론 정확도?
최선 추측. 비어있지 않은 모든 셀이 숫자로 파싱될 때만 `number`로 인정, boolean·ISO 풍 날짜도 동일. 혼합 컬럼은 추측 대신 `string`으로 폴백.
구분자가 잘못 감지되는 이유는?
감지는 첫 줄만 읽는다. 첫 줄이 헤더가 아니라 제목이거나, 헤더의 따옴표 안에 쉼표가 들어 있으면 추측이 엉뚱한 문자로 기운다. 파일 전체 대신 대표적인 데이터 몇 줄을 붙여넣으면 대개 제대로 읽힌다.
한 행만 열 수가 유난히 많은 이유는?
거의 언제나 그 위 어딘가에서 따옴표 짝이 맞지 않는 것이 원인이다. 큰따옴표 하나가 잘못 남으면 파서는 다음 따옴표를 만날 때까지 뒤따르는 내용을 전부 하나의 긴 인용 필드로 취급하므로, 행이 합쳐지고 필드 수가 요동친다. 깨져 보이는 행이 아니라 따옴표를 고쳐야 한다. 손상은 그보다 앞에서 시작된다.

이 주제의 가이드

관련 도구