본문으로 건너뛰기
AZ Tools

CSV 컬럼 추출기

넓은 CSV에서 스프레드시트 안 열고 초점 잡힌 추출. RFC 4180 스타일 CSV 파싱(임베디드 구분자·이스케이프 인용 포함 인용 필드), 탭/세미콜론/파이프 구분자 선택. 헤더명 또는 인덱스로 컬럼 선택, 옵션으로 중복 제거·정렬, 다음 단계 맞는 형식으로 출력 — 다른 도구 파이프엔 줄당 행, SQL 에디터엔 `(...)` IN 절.

출력 · 행: 3
ana@x.com
bae@y.com
cai@z.com

파싱은 RFC 4180 — 인용 필드에 구분자·줄바꿈 포함 가능, 이중 인용은 단일 인용으로 디코딩.

사용법

  1. CSV/TSV 붙여넣고 헤더 토글이 데이터와 일치 확인.
  2. 유지할 컬럼 칩 클릭 — 출력 순서는 컬럼 순서 따름.
  3. 출력 형식(plain·CSV·인용 리스트·SQL IN) 선택 후 복사.

자주 묻는 질문

인용 필드와 이스케이프 인용 처리?
응. 큰따옴표로 감싼 필드는 언쿼트, 임베디드 구분자·줄바꿈 보존, `""`는 RFC 4180 따라 리터럴 큰따옴표로 처리.
왜 SQL IN 절 옵션?
CSV에 ID 리스트 있고 `WHERE id IN (...)` 작성해야 할 때 수동 인용 절약. 형식은 단일 인용도 이스케이프함.
IN 절이 숫자에도 따옴표를 붙이는데 괜찮나?
문제가 될 수 있다. 숫자 리터럴에 따옴표를 붙이면 데이터베이스에게 문자열과 숫자를 비교하라고 요구하는 셈이고, 그다음 동작은 엔진마다 다르다. 조용히 변환하는 곳도, 오류를 내는 곳도, 해당 열의 인덱스를 쓰지 않게 되어 빠른 조회가 전체 훑기로 바뀌는 곳도 있다. 열의 타입을 확인하고 숫자라면 따옴표를 빼라.
중복 제거 결과가 예상보다 적은 이유는?
값을 정확히 그대로 비교하기 때문에 공백, 대소문자, 보이지 않는 문자까지 모두 계산에 들어간다. 똑같아 보여도 끝에 공백 하나가 더 있으면 별개로 남는다. 스프레드시트나 웹페이지에서 복사해 온 데이터에서 흔한 일이니, 그런 경우에는 추출 전에 원본 열을 다듬어라.

관련 도구