SNS에서 이런 취지의 게시물이 크게 퍼졌다.
“일본인은 연소득 250만 엔 이하가 절반 이상이다.”
함께 올라온 표에는 “50만 엔 미만 30.4%”, “200만~250만 엔 4.7%” 같은 숫자가 있고, 250만 엔 부근까지 누적하면 51.3%가 된다. 숫자만 보면 꽤 강렬하다.
문제는 숫자 자체가 거의 진짜라는 점이다.
조작된 그래프가 아니다. 일본 후생노동성의 「2023년 소득재분배조사 보고서」와 수치가 일치한다.[1]
문제는 숫자가 아니라 라벨이 다른 곳으로 여행을 갔다는 것이다.
“가구”가 “일본인”이 되고, “초기소득”이 “연소득”이 되고, 공적연금은 조용히 화면 밖으로 사라진다.
이건 통계를 새로 만드는 것보다 정보를 제품 사진처럼 찍는 작업에 가깝다.
진짜 상품을 책상 위에 둔다.
불편한 물건은 오른쪽으로 치운다.
조명을 켠다.
잘 나오는 각도를 고른다.
마지막에 “비보” 팻말을 둔다.
찰칵.
상품은 진짜다. 사진도 합성이 아니다.
다만 방 전체가 나오지 않을 뿐이다.
0. 5초 결론
이 표만으로 “일하는 일본인의 절반 이상이 연봉 250만 엔 이하”라고 말할 수 없다.
이유는 다섯 가지다.
- 대상은 개인이 아니라 가구다.
- 지표는 일반적인 급여 연봉이 아니라 재분배 전의 초기소득이다.
- 공적연금·은급은 초기소득에 들어가지 않고 사회보장급여로 별도 처리된다.
- 조사 가구는 고령화의 영향이 크며, **가구주가 65세 이상인 가구가 56.7%**다.
- 250만 엔 부근까지의 누적은 초기소득 기준 51.3%지만, **재분배소득 기준으로는 29.5%**다.[1]
또 재분배소득에는 의료·개호 같은 현물급여도 포함되므로, 29.5%를 “실수령 연봉”으로 읽는 것도 틀리다.
이건 일본 근로자의 급여 순위가 아니다.
세금과 사회보장에 의한 재분배 전후에 가구 소득분포가 어떻게 바뀌는지 보기 위한 통계다.
1. 먼저 51.3%라는 숫자는 진짜다
이 부분까지 “가짜”라고 해버리면 팩트체크도 거칠어진다.
후생노동성 제1표의 초기소득 가구분포는 다음과 같다.[1]
- 50만 엔 미만: 30.4%
- 50만~100만 엔: 5.8%
- 100만~150만 엔: 5.6%
- 150만~200만 엔: 4.8%
- 200만~250만 엔: 4.7%
누적 51.3%.
그러니까 문제는 “51.3%가 조작됐다”가 아니다.
51.3%는 진짜다. 자막이 다른 프로그램에서 왔다.
2. 가장 큰 변환은 “가구” → “일본인”
원래 표는 가구분포다.
3,003가구를 집계해 각 가구가 어느 소득구간에 들어가는지 본다.[1]
그런데 SNS에서는 이것이 자주,
“일본인의 절반”
으로 바뀐다.
단위가 다르다.
부부 2명의 한 가구도, 혼자 사는 고령자도, 부모와 자녀 4명이 사는 가구도 각각 “1가구”다. 사람 수 비율이 아니다.
또 “연소득”이라는 말을 보면 대부분 직장인의 연봉을 떠올린다.
하지만 이 표의 정식 지표는 초기소득이다.
후생노동성은 초기소득을 근로소득, 사업소득, 농축산소득, 재산소득, 가내근로소득, 잡수입, 송금·기업연금·생명보험금 같은 사적급여의 합계로 정의한다.[1]
즉 급여만 보는 통계도 아니다.
그리고 더 중요한 항목 하나가 밖에 있다.
3. 공적연금은 ‘초기소득’ 밖에 있다
후생노동성은 사회보장급여를 연금, 의료, 개호, 기타로 별도 취급한다.[1]
초기소득에 사회보장의 현금급여를 더하면 총소득, 거기서 세금과 사회보험료를 빼면 가처분소득, 의료·개호 등의 현물급여까지 더하면 재분배소득이 된다.[1]
은퇴 가구를 예로 들면 바로 이해된다.
- 급여: 0엔
- 사업소득: 0엔
- 공적연금: 연 200만 엔
다른 초기소득이 없다면, 공적연금 200만 엔을 받더라도 초기소득은 거의 0엔 쪽에 놓일 수 있다.
“연 200만 엔으로 사는 가구”가 초기소득 표에서는 “50만 엔 미만”에 들어갈 수 있다는 뜻이다.
이건 이 조사에서 버그가 아니다.
사회보장 때문에 분포가 얼마나 움직이는지 보기 위한 설계다.
다만 기업연금 같은 사적급여는 초기소득에 포함될 수 있다. “연금은 전부 제외”라고 말해도 또 다른 오해가 생긴다.
4. 게다가 조사 가구는 고령화의 영향이 매우 크다
후생노동성은 이번 조사에서 **가구주 65세 이상 비율이 56.7%**였고, 이전 조사 55.2%보다 높아졌으며, 고령화가 초기소득 지니계수 상승에도 영향을 미쳤다고 적었다.[1]
또 “고령자 가구”는 3,003가구 중 1,232가구, 약 41%였다.[1]
이들의 평균을 보면 구조가 더 선명하다.
- 평균 초기소득: 107.8만 엔
- 연금·은급: 193.8만 엔
- 평균 가처분소득: 263.7만 엔
- 평균 재분배소득: 338.4만 엔[1]
“초기소득 107.8만 엔”만 잘라내면 아주 처참해 보인다.
하지만 같은 표 옆에는 평균 193.8만 엔의 연금·은급이 있다.
연금: “저 여기 있는데요.”
크롭: “오늘은 화면에 나오지 마세요.”
물론 이것이 고령자의 생활이 편하다는 뜻은 아니다. 자산, 주거비, 의료비, 가구원 수에 따라 실제 생활은 크게 달라진다.
말하고 싶은 건 하나다.
이 표는 현역 근로자의 급여분포 대용으로 쓸 수 없다.
5. 30.4%는 재분배 뒤 1.2%가 된다
이 조사의 목적 자체가 재분배 전후를 비교하는 것이다.
그래서 후생노동성은 같은 제1표에서 초기소득과 재분배소득을 나란히 보여준다.[1]
50만 엔 미만 가구는,
초기소득: 30.4%
→ 재분배소득: 1.2%
250만 엔 부근까지의 누적은,
초기소득: 51.3%
→ 재분배소득: 29.5%[1]
30.4%가 1.2%가 된다.
첫 숫자만 가져가는 건 영화 시작 10분의 절망 장면만 잘라서,
“주인공 완전 패배”
라고 리뷰를 끝내는 것과 비슷하다.
아직 사회보장 파트가 시작도 안 했다.
단, 재분배소득에는 의료·개호·보육 등의 현물급여도 포함된다. 338.4만 엔의 재분배소득이 그대로 통장에 입금된다는 뜻은 아니다.
핵심은 어느 쪽이 “진짜 연봉”인지 고르는 게 아니다.
숫자와 라벨을 같이 읽는 것이다.
6. “학생이 들어가서 그런가?” 일부는 가능하지만 핵심은 아니다
학생이 완전히 빠지는 것은 아니다.
조사는 일반 가구를 대상으로 하므로 독립해 사는 학생 가구가 포함될 가능성은 있다. 반면 후생노동성 정의에서는 취학을 위해 집을 떠난 사람은 원래 가구의 가구원에서 제외하며, 식사가 제공되는 기숙사·하숙 등에 사는 일부 1인가구는 조사대상에서 제외된다.[1]
따라서,
“저소득 쪽은 전부 학생”
도 틀리다.
공식자료가 직접 보여주는 큰 구조요인은 고령화와 사회보장급여의 처리방식이다.
특히 가구주 65세 이상 56.7%, 공적연금이 초기소득 밖이라는 두 점은 무시하기 어렵다.[1]
학생은 조연으로 있을 수 있다.
하지만 무대 중앙에는 꽤 큰 연금수급 가구 집단이 서 있다.
7. 더 재미있는 점: 원문 기사에는 표 바로 앞에 연금 설명이 있었다
이 표를 실은 다이아몬드 온라인 기사는 2026년 1월 8일 공개됐다.[3]
표 바로 앞에서 기사 자체가 초기소득 하락 배경으로 고령화를 들고, 이 조사에서 공적연금은 해당 소득에 포함되지 않기 때문에 공적연금에만 의존하는 가구는 재분배 전 소득이 0이 될 수 있다는 취지로 설명한다.[3]
그다음 51.3% 표가 나온다.
이 순서가 중요하다.
원문 기사도 “절반의 가구가 250만 엔 이하”라는 강한 표현을 쓴다. 하지만 그것을 “일하는 일본인의 절반이 연봉 250만 엔 이하”라는 의미로 제시한 것은 아니다.
맥락은 고령화로 노동시장에서 이탈한 가구가 늘고, 재분배 전 소득분포가 어떻게 보이는가다.[3]
SNS 캡션에서 이 표가 “일본인의 연소득”으로 바뀌면, 원문에 있던 가장 중요한 사용설명서가 사라진다.
상자는 진짜.
내용물도 진짜.
설명서만 버리고 리뷰한다.
8. 이것이 ‘정보 상품 촬영’이다
게시자가 실제로 원문 기사를 읽었는지, 다른 곳에서 이미지만 주웠는지는 외부에서 확인할 수 없다.
그래서,
“연금 제외 사실을 알고 일부러 숨겼다”
고 단정할 수는 없다.
다만 최종 결과만 제품 촬영에 비유하면 이렇게 된다.
- 진짜 정부 통계표를 중앙에 둔다.
- “가구”라는 단위를 캡션에서 “일본인”으로 바꾼다.
- “초기소득”이라는 전문용어를 “연소득”으로 바꾼다.
- 공적연금이 별도라는 설명을 화면 밖으로 뺀다.
- 소득 기준기간이 2022년이라는 정보도 뒤로 밀어놓는다.
- “비보”를 붙인다.
- 촬영.
완성.
“일본인의 절반이 연소득 250만 엔 이하.”
숫자를 하나도 조작하지 않아도 독자에게 전달되는 의미는 크게 달라진다.
통계 미스리드는 가짜 숫자가 없어도 만들 수 있다.
주어, 단위, 정의, 기간, 전후맥락을 하나씩 화면 밖으로 보내면 된다.
9. AI 할루시네이션보다 더 나쁜가
OpenAI는 AI의 할루시네이션을 언어모델이 만들어내는 그럴듯하지만 사실이 아닌 진술로 설명한다.[4]
사람의 정보발신에는 한 가지 문제가 더 생긴다. 의도다.
UNESCO 등에서는 보통,
- 속일 의도 없이 잘못된 정보를 공유: misinformation
- 속일 의도를 가지고 거짓 또는 오해를 부르는 정보를 확산: disinformation[5]
으로 구분한다.
이번 일이 어느 쪽인지는 알 수 없다.
적어도 두 가지 경우가 있다.
A. 원문을 제대로 읽지 않았다
무슨 통계인지 이해하지 않은 채 큰 규모로 퍼뜨린 셈이다.
B. 원문을 읽었다
그렇다면 표 바로 앞의 연금 설명을 보았을 가능성이 생긴다.
하지만 B라고 해서 고의 은폐가 증명되는 것은 아니다. 이해하지 못했거나, 잊었거나, 이미지만 저장했을 수도 있다.
밖에서 확정할 수 있는 것은 “SNS 캡션과 원통계의 의미가 맞지 않는다”는 정도다.
윤리적 비난은 의도 증거 없이 과장할 필요가 없다.
반면 정보 품질 평가는 간단하다.
확인하지 않았다면 부주의하다.
확인하고 의미를 알면서 바꿨다면 더 심각하다.
AI에게는 모르면 “모른다”고 하라고 요구한다.
사람에게도 같은 가드레일이 있으면 좋다.
10. 바이럴 통계를 보는 5초 체크
고급 통계학은 필요 없다.
다음 여섯 가지만 본다.
1. 주어는 누구인가
개인, 가구, 기업, 응답자?
2. 단위는 무엇인가
사람 수, 가구 수, 비율, 평균, 중앙값?
3. 용어의 정식 정의는 무엇인가
소득, 연봉, 가처분소득, 초기소득은 같은 말이 아니다.
4. 무엇이 포함되고 무엇이 빠졌는가
이번에는 공적연금이 결정적이었다.
5. 언제의 데이터인가
이름은 2023년 조사지만 소득 기준기간은 2022년 1월 1일~12월 31일이다.[1]
6. 표의 앞뒤에 무엇이 적혀 있는가
이번에는 가장 큰 주의사항 중 하나가 표 바로 앞에 있었다.[3]
숫자 자체를 의심하기 전에,
숫자의 명찰부터 확인한다.
11. 정말 흥미로운 ‘일본의 현실’은 다른 곳에 있다
이 통계 자체는 매우 흥미롭다.
가구주 65세 이상이 56.7%. 고령자 가구의 평균 초기소득은 107.8만 엔. 그러나 연금·은급, 의료, 개호 등 사회보장을 넣으면 분포가 크게 움직인다.[1]
이건,
“일본인의 절반이 저임금 노동자가 됐다”
는 이야기가 아니다.
오히려,
“고령화 사회에서는 시장에서 얻는 재분배 전 소득만 먼저 보면 분포가 극단적으로 보이고, 사회보장을 넣으면 그림이 크게 달라진다”
는 이야기다.
이쪽이 일본의 인구구조와 제도를 이해하는 데 훨씬 밀도가 높다.
하지만 SNS로 가져가면,
연금은 오른쪽으로.
가구는 왼쪽으로.
2022년은 뒤로.
“초기소득”은 선반 아래로.
좋아.
51.3%만 중앙.
찰칵.
“비보, 일본인――”
정보는 숫자 하나를 거짓말하지 않아도 사람을 오해하게 만들 수 있다.
숫자가 진짜인지 확인하는 것만으로는 부족하다. 누구를 세었는지, 어떤 단위인지, 무엇을 제외했는지, 언제의 값인지까지가 모두 데이터다.
