CSV 분석기
첫 줄에서 구분자(쉼표·탭·세미콜론·파이프) 자동 감지, RFC 4180 인용 처리로 파싱. 컬럼별로 빠른 타입 추론(number·boolean·date·string) + 빈 셀 수·고유값 수·샘플. 전체 행 중복은 별도 지표.
—
행
5
열
6
중복
0
컬럼
| 컬럼 | 타입 | 빈 셀 | 고유값 | 샘플 |
|---|---|---|---|---|
| id | 숫자 | 0 | 5 | 1 |
| name | 문자열 | 0 | 4 | Alice |
| 문자열 | 1 | 4 | alice@example.com | |
| age | 숫자 | 1 | 4 | 30 |
| signup | 날짜 | 0 | 4 | 2024-01-15 |
| verified | 불 | 0 | 2 | true |
모두 브라우저에서 처리 — 데이터가 기기를 떠나지 않음.
사용법
- CSV·TSV 파일 드롭 또는 박스에 직접 붙여넣기.
- 데이터에 맞게 헤더 행 체크박스 토글.
- 행·열·중복 카드 → 컬럼별 타입 표 확인.
자주 묻는 질문
- 중복 기준?
- 모든 필드 완전 일치. 한 셀이 한 글자만 달라도 중복 아님. 퍼지 매칭이 필요하면 별도 dedupe 단계 사용.
- 타입 추론 정확도?
- 최선 추측. 비어있지 않은 모든 셀이 숫자로 파싱될 때만 `number`로 인정, boolean·ISO 풍 날짜도 동일. 혼합 컬럼은 추측 대신 `string`으로 폴백.
- 구분자가 잘못 감지되는 이유는?
- 감지는 첫 줄만 읽는다. 첫 줄이 헤더가 아니라 제목이거나, 헤더의 따옴표 안에 쉼표가 들어 있으면 추측이 엉뚱한 문자로 기운다. 파일 전체 대신 대표적인 데이터 몇 줄을 붙여넣으면 대개 제대로 읽힌다.
- 한 행만 열 수가 유난히 많은 이유는?
- 거의 언제나 그 위 어딘가에서 따옴표 짝이 맞지 않는 것이 원인이다. 큰따옴표 하나가 잘못 남으면 파서는 다음 따옴표를 만날 때까지 뒤따르는 내용을 전부 하나의 긴 인용 필드로 취급하므로, 행이 합쳐지고 필드 수가 요동친다. 깨져 보이는 행이 아니라 따옴표를 고쳐야 한다. 손상은 그보다 앞에서 시작된다.
이 주제의 가이드
관련 도구
CSV 컬럼 추출기
CSV/TSV 붙여넣고 원하는 컬럼 클릭 → 줄·CSV·인용 콤마·SQL IN 절로 반환.
파일 0 0
고정폭 텍스트 → CSV / JSON 파서
고정폭/고정 열 텍스트를 열 너비로 잘라 필드로 나누고 CSV 또는 JSON으로 내보냅니다. 브라우저에서 동작합니다.
변환 0 0
CSV ↔ JSON 변환기
CSV를 JSON으로, JSON을 CSV로 변환하세요(구분자 선택 가능).
파일 0 0
엑셀(XLSX) → CSV · JSON · 마크다운 변환
브라우저에서 .xlsx 통합 문서를 열어 원하는 시트를 CSV·JSON·마크다운 표로 내보냅니다. 파일은 기기를 벗어나지 않습니다.
파일 0 0
CSV → 엑셀(XLSX) 변환기
CSV·TSV를 브라우저에서 진짜 .xlsx 파일로 변환합니다. 앞자리 0, 긴 ID, SEPT1 같은 코드가 입력한 그대로 유지됩니다.
파일 0 0
CSV 분할기 (행 단위)
큰 CSV를 행 수 기준으로 잘게 분할 — 청크마다 헤더 반복, 한 번에 모두 다운로드.
파일 0 0