‘근로소득 상위 0.1%의 평균 연봉이 약 10억원’이라는 숫자를 봤다면 먼저 원문 표의 행과 단위를 확인해야 합니다. 국세청이 공공데이터포털에 공개한 파일에서 상위 0.1% 행의 인원은 21,078명, 총급여는 210,647억원입니다. 이 두 값을 같은 행에서 나누면 1인당 평균 총급여는 999,369,010원, 읽기 쉽게 반올림하면 약 9억 9,937만원입니다.
다만 이 결과를 ‘상위 0.1%에 들어가는 연봉 기준’으로 읽으면 안 됩니다. 공개 파일이 제공하는 값은 그 행에 속한 사람들의 총급여 합계와 인원입니다. 구간에서 가장 낮은 사람의 총급여, 가장 높은 사람의 총급여, 중앙에 있는 사람의 총급여는 이 두 열만으로 알 수 없습니다.
이 글은 2026년 8월 19일에 공공데이터포털의 현재 파일을 다시 내려받아 열 이름과 첫 두 행을 확인했습니다.
어느 연도의 누구를 센 자료인가
국세청 근로소득 백분위(천분위) 자료의 현재 파일명은 국세청_근로소득 백분위(천분위) 자료_20251231입니다. 파일명 끝의 날짜만 보고 2025년 귀속 급여라고 판단해서는 안 됩니다. 제공 페이지의 ‘데이터 한계’에는 2024년 근로소득에 대한 2025년 신고 자료라고 명시돼 있습니다.
분모도 전체 국민이나 모든 취업자가 아닙니다. 이 파일이 집계한 2025년 근로소득 신고자가 기준입니다. 따라서 계산 결과를 ‘국민 1,000명 중 1명의 평균’이나 ‘전체 가구의 상위 0.1%’로 바꿔 표현할 근거는 없습니다. 비교하려는 통계가 가구소득인지, 임금근로자 월평균 임금인지, 근로소득 신고자의 총급여인지에 따라 모집단과 금액의 정의가 달라집니다.
공공데이터포털은 인원의 단위를 명, 총급여의 단위를 억원으로 표시하고, 각 분위에 대한 근로소득 합계라고 설명합니다. 상위 1% 안에서는 0.1% 단위 행을 제공합니다. 평균을 다시 계산할 때에는 다른 행의 인원이나 전체 신고자 수를 가져오지 말고, 선택한 행의 인원과 총급여를 한 쌍으로 써야 합니다.
상위 0.1% 행을 그대로 옮기면
공식 CSV의 첫 행을 열 이름과 숫자 그대로 옮기면 아래 표가 됩니다.
표는 옆으로 밀어 전체 항목을 비교할 수 있습니다.
| 공식 CSV 열 | 상위 0.1% 행의 값 | 단위 |
|---|---|---|
| 구분 | 상위 0.1% | 분위 표시 |
| 인원 | 21,078 | 명 |
| 총급여 | 210,647 | 억원 |
| 근로소득금액 | 206,692 | 억원 |
| 소득공제금액 | 9,707 | 억원 |
| 과세표준 | 196,985 | 억원 |
| 결정세액 | 72,676 | 억원 |
평균 총급여를 구할 때 쓰는 열은 총급여와 인원 두 개뿐입니다. 근로소득금액은 이름이 비슷하지만 별도 열입니다. 과세표준이나 결정세액도 총급여에 더하거나 빼지 않습니다. 표에서 비슷해 보이는 숫자를 섞지 않는 것이 첫 번째 검산입니다.
구간 행과 누적값을 먼저 구분한다
CSV의 행 이름만 보면 상위 0.2%가 첫 행까지 포함한 누적값처럼 보일 수 있습니다. 그러나 현재 파일의 두 번째 행에는 인원 21,079명, 총급여 92,533억원이 적혀 있습니다. 첫 행의 21,078명과 인원 규모가 거의 같고, 총급여는 첫 행의 210,647억원보다 작습니다. 만약 두 번째 행이 상위 0.1%까지 포함한 누적행이라면 인원과 총급여가 첫 행보다 작아질 수 없으므로 실제 열 구조와 맞지 않습니다.
공공데이터포털도 이 파일을 “각 분위에 대한 근로소득 합계”라고 설명합니다. 이를 첫 두 행의 값과 함께 읽으면, 첫 행은 최상위 0.1% 구간이고 두 번째 행은 그다음 0.1% 구간으로 보는 것이 자연스럽습니다. 다만 “구간 행”이라는 표현은 포털 설명과 행별 인원·합계 구조에서 도출한 해석입니다. 원자료에 별도의 구간 하한이나 개인별 순위 열이 있다는 뜻은 아닙니다.
표는 옆으로 밀어 전체 항목을 비교할 수 있습니다.
| CSV 행 | 인원 | 총급여 | 그 행만의 평균 총급여 |
|---|---|---|---|
| 상위 0.1% | 21,078명 | 210,647억원 | 999,369,010원 |
| 상위 0.2% | 21,079명 | 92,533억원 | 438,981,925원 |
첫 두 구간을 합친 값을 보고 싶다면 평균 두 개를 단순히 더해 2로 나누면 안 됩니다. 행마다 인원이 다르므로 총급여와 인원을 각각 합친 뒤 다시 나눠야 합니다. 현재 CSV의 수치를 합치면 아래 값이 나옵니다.
첫 두 구간 인원 = 21,078 + 21,079 = 42,157명
첫 두 구간 총급여 = 210,647 + 92,533 = 303,180억원
합친 구간의 평균
= 303,180 × 100,000,000 ÷ 42,157
= 719,168,821.310…원
= 719,168,821원(원 단위 반올림)
반면 두 행의 표시 평균 999,369,010원과 438,981,925원을 단순평균하면 719,175,468원이 됩니다. 가중 재계산값보다 6,647원 큽니다. 차이가 작아 보여도 계산 방식은 다릅니다. 인원이 크게 다른 행을 합치면 오차도 커질 수 있으므로, 여러 행을 합칠 때에는 반올림된 행 평균이 아니라 원래의 총급여와 인원을 사용해야 합니다.
210,647억원을 원으로 바꾼 뒤 인원으로 나눈다
억원 단위 합계를 사람 수로 바로 나누면 결과도 억원 단위입니다. 계산기에서 원 단위 결과를 보여 주려면 먼저 1억원이 100,000,000원이라는 단위 환산을 반영합니다.
총급여 합계(원) = 210,647 × 100,000,000
= 21,064,700,000,000원
1인당 평균 총급여 = 21,064,700,000,000 ÷ 21,078
= 999,369,010.342…원
원 단위 반올림 결과 = 999,369,010원
계산기의 기본값도 이 행과 동일합니다. 같은 행의 총급여 합계에는 210,647억원, 같은 행의 신고 인원에는 21,078명을 넣습니다. 결과는 선택한 행의 1인당 평균 총급여 999,369,010원으로 표시됩니다. 계산 과정에서 중간값을 만원이나 억원 단위로 먼저 반올림하지 않고, 나눗셈이 끝난 뒤 원 단위로 한 번만 반올림합니다.
스프레드시트에서 글자가 깨지면 가져오기 기능으로 인코딩을 바꾸고 머리글이 읽히는지 확인합니다.
스프레드시트로 열면 인원은 두 번째 열, 총급여는 세 번째 열입니다. 다만 다운로드 도구가 별도의 순번 열을 붙이면 화면의 열 문자가 달라질 수 있으므로 B열·C열이라는 위치만 외우기보다 머리글 이름을 확인해야 합니다. 총급여 셀은 억원 단위이므로 100,000,000을 곱하고, 인원 셀은 명 단위 정수 그대로 씁니다.
여러 행은 총급여와 인원을 각각 합친 뒤 나눕니다. 중간 반올림을 피하면 합친 집단의 평균을 같은 방식으로 재현할 수 있습니다.
다른 행을 확인할 때도 식은 같습니다.
선택한 행의 1인당 평균 총급여
= 선택한 행의 총급여(억원) × 100,000,000 ÷ 선택한 행의 인원(명)
인원은 1명 이상의 정수여야 하고, 총급여는 CSV에 표시된 0 이상의 정수 억원 값을 입력합니다. 빈칸이나 읽히지 않는 셀을 0으로 대신 넣으면 안 됩니다. 행 이름, 인원, 총급여 중 하나라도 확인되지 않으면 계산을 멈추고 원본 파일을 다시 내려받는 편이 안전합니다.
- 내 영수증 총급여
- 100,000,000원이라고 가정
- 공개 상위 0.1% 행 평균
- 999,369,010원
- 이 비교로 확인한 사실
- 내 금액이 그 행 평균보다 작음
- 이 비교로 알 수 없는 값
- 나의 정확한 분위·구간 진입선
“평균보다 작으니 이 구간 밖”이라는 판단도 성립하지 않습니다. 평균 이하인 사람이 같은 구간 안에 있을 수 있기 때문입니다. 개인 순위가 목적이면 구간 하한 자료가 있는지 국세청 제공기관에 문의해야 하며 이 계산기로 빈 정보를 채우지 않습니다.