스프레드시트 원본 데이터를 정리할 때 먼저 맞춰야 할 기준
스프레드시트 원본 데이터가 뒤섞여 있을 때 열 구조, 날짜 형식, 빈칸, 중복값, 원본 보존 순서로 정리하는 실무 기준을 설명합니다.
스프레드시트 데이터를 정리할 때 가장 흔한 실수는 보기 좋게 꾸미는 것부터 시작하는 것입니다. 색을 넣고 열 너비를 맞춰도 날짜 형식이 제각각이거나 한 셀에 여러 정보가 섞여 있으면 필터, 정렬, 피벗, 수식에서 계속 문제가 생깁니다.
원본 데이터를 정리할 때는 모양보다 구조를 먼저 맞추는 것이 중요합니다. 열 하나에는 한 종류의 정보만 두고, 같은 의미의 값은 같은 형식으로 맞춘 뒤, 중복과 빈칸을 확인하는 순서가 안정적입니다.
원본 파일을 바로 덮어쓰지 않는다
정리를 시작하기 전에 가장 먼저 할 일은 원본을 보존하는 것입니다.
받은 파일을 그대로 수정하면 어떤 값이 원래부터 잘못됐는지, 내가 정리 과정에서 바꾼 것인지 구분하기 어려워집니다. 원본은 읽기 전용처럼 두고 작업본을 별도로 만들어 사용하는 편이 좋습니다.
파일 이름에는 날짜나 작업 상태를 붙여 구분할 수 있습니다. 다만 “최종”, “진짜최종”처럼 의미가 모호한 이름보다 작업 단계가 드러나는 이름을 쓰는 편이 낫습니다.
파일명 규칙 자체를 정리하려면 업무 파일 이름을 헷갈리지 않게 만드는 규칙과 함께 적용할 수 있습니다.
열 하나에는 한 종류의 정보만 둔다
한 열에 제품명과 규격이 함께 들어 있거나, 프로젝트명과 상태 메모가 한 셀에 섞여 있으면 나중에 정렬하거나 조건을 걸기 어려워집니다.
예를 들어 제품명, 규격, 등록일, 수량, 상태, 메모처럼 열을 나누는 편이 좋습니다.
정리 기준은 간단합니다. 한 열에 들어간 값들을 같은 규칙으로 비교할 수 있는지를 보면 됩니다.
날짜와 숫자 형식을 통일한다
같은 날짜가 2026-09-30, 9/30, 2026.9.30처럼 섞여 있으면 눈으로는 같은 날짜처럼 보여도 프로그램이 서로 다른 형식으로 해석할 수 있습니다.
숫자도 1,000개, 1000, 1,000처럼 텍스트와 숫자가 섞이면 합계나 정렬이 제대로 되지 않을 수 있습니다.
먼저 열별로 어떤 형식을 쓸지 정한 뒤 같은 열 안에서 통일합니다. 화면 표시 형식만 바꾸는 것과 실제 값이 텍스트에서 숫자나 날짜로 변환되는 것은 다를 수 있으므로, 변환 후 정렬이나 간단한 계산이 정상적으로 되는지 확인하는 편이 좋습니다.
빈칸은 의미를 먼저 구분한다
빈칸을 보면 무조건 0이나 없음으로 채우고 싶어질 수 있습니다. 하지만 빈칸이 항상 같은 뜻은 아닙니다.
예를 들어 아직 입력하지 않음, 해당 사항 없음, 값이 0임, 확인하지 못함은 서로 다른 상태일 수 있습니다.
이 차이를 무시하고 같은 값으로 채우면 나중에 집계 결과가 왜곡될 수 있습니다. 빈칸을 처리하기 전에 해당 열에서 빈칸이 어떤 의미인지 먼저 확인하고, 필요하다면 “미입력”, “해당없음”처럼 구분 가능한 값을 쓰는 편이 낫습니다.
중복값은 삭제 전에 기준을 정한다
이름이 같다고 같은 항목이라고 볼 수 없는 경우가 있고, 식별 번호가 같다면 같은 기록일 가능성이 높습니다. 즉, 중복 판단 기준은 데이터마다 다릅니다.
중복을 찾기 전에 무엇이 같을 때 같은 행으로 볼지 먼저 정해야 합니다.
예를 들어 재고 데이터라면 품목 코드가 기준이 될 수 있고, 작업 기록이라면 작업 번호와 날짜 조합이 기준일 수 있습니다.
중복 후보를 찾았더라도 바로 삭제하지 말고 서로 다른 열의 값이 충돌하는지 확인하세요.
상태값은 표현을 줄인다
업무 데이터에서 자주 생기는 문제는 같은 상태를 여러 표현으로 적는 것입니다.
예를 들어 완료, 완료됨, 처리완료, done이 한 열에 섞여 있으면 같은 의미인데도 필터에서는 서로 다른 값이 됩니다.
상태값은 가능한 한 대기, 진행중, 완료, 보류처럼 몇 개의 정해진 표현으로 줄이는 편이 좋습니다. 새 값을 자유롭게 쓰게 해야 하는 상황과 정해진 값 중 하나를 고르게 해야 하는 상황을 구분하면 관리가 쉬워집니다.
불필요한 병합 셀은 원본 데이터 영역에서 피한다
보고서나 요약표에서는 병합 셀이 보기 좋을 수 있지만, 원본 데이터 표에서는 정렬과 필터를 방해할 수 있습니다.
특히 여러 행을 하나의 제목 아래 묶기 위해 병합한 경우에는 각 행에 필요한 기준값을 반복해서 넣는 편이 데이터 처리에는 더 유리합니다.
원본 데이터와 보고용 화면을 한 시트에서 모두 해결하려 하지 말고, 원본은 단순한 표 구조로 유지하고 요약은 별도 시트에서 만드는 방식이 안정적입니다.
정리가 끝나면 필터와 정렬로 검수한다
데이터 정리가 끝났다면 눈으로 전체를 훑는 것보다 필터와 정렬을 이용해 이상값을 찾는 편이 빠릅니다.
- 날짜 열을 정렬했을 때 이상하게 튀는 값이 있는지
- 숫자 열에 텍스트가 섞여 있지 않은지
- 상태값 필터에 예상하지 못한 표현이 있는지
- 주요 기준 열에 빈칸이 남아 있지 않은지
- 같은 식별값이 여러 번 나타나지 않는지
이 과정을 거치면 단순 오타나 형식 혼합을 비교적 쉽게 찾을 수 있습니다.
공유하기 전에는 원본과 작업본을 구분한다
정리된 파일을 다른 사람과 공유할 때는 어느 파일이 원본이고 어느 파일이 정리본인지 명확하게 보여야 합니다.
공유 폴더에서 여러 사람이 같은 파일을 수정한다면 작업 중 파일과 기준 파일을 구분하는 규칙이 필요합니다. 협업 파일 관리 기준은 공유 폴더에서 작업 파일을 헷갈리지 않는 규칙과 함께 적용할 수 있습니다.
정리 순서는 이렇게 잡으면 된다
- 원본을 보존하고 작업본을 만든다.
- 열 하나에 한 종류의 정보만 남긴다.
- 날짜와 숫자 형식을 통일한다.
- 빈칸의 의미를 확인한다.
- 중복 판단 기준을 정한 뒤 후보를 검토한다.
- 상태값 표현을 줄인다.
- 필터와 정렬로 이상값을 검수한다.
- 공유 전 원본과 정리본을 구분한다.
스프레드시트 정리는 보기 좋게 만드는 작업보다 나중에 정렬하고 계산하고 다시 사용할 수 있는 구조로 바꾸는 작업에 가깝습니다. 구조가 먼저 맞아 있으면 수식이나 자동화는 그다음에 훨씬 수월해집니다.