TL;DR
- 트롤리 문제는 윤리 퀴즈가 아니라 1967년 낙태 논쟁을 풀려고 만든 도구였다.
- 다섯 변형은 '몇 명이 죽나'가 아니라 '그 힘이 내 근육에서 나왔나'를 분리해낸 장치다.
- 손으로 밀든 장대로 밀든 판단은 같았다. 접촉은 변수가 아니었다(p=0.23).
- 2001년 그린의 fMRI가 이중과정 이론을 세웠지만, 참가자는 9명이었고 반응시간 근거는 2009년 재분석에서 무너졌다.
- 2018년 실제 실험에선 글로 읽은 그룹 66%, 실제 상황 84%로 격차가 났다.
- 내 판단이 어느 트랙에서 나왔는지 가려내는 4주 훈련법을 뒤에 붙였다.
레버는 당긴다. 육교 위의 사람은 못 민다. 죽는 사람은 똑같이 한 명인데 답이 뒤집힌다. 이 어긋남이 60년째 심리학과 철학을 붙들고 있다.
실험 10가지의 전체 지도는 20세기 심리 실험 10가지에서 다뤘다. 여기서는 트롤리 하나만 끝까지 판다.
1967년 옥스퍼드, 트롤리는 낙태 논쟁에서 태어났다
이 사고실험은 퀴즈로 만들어지지 않았다. 1967년, 옥스퍼드의 도덕철학자 필리파 풋은 「낙태 문제와 이중효과 원리」를 썼다. 당시 가톨릭 윤리는 산모를 살리려 자궁을 들어내 태아가 죽는 것은 허용하고, 태아를 직접 죽이는 것은 금했다.
같은 죽음인데 '의도한 것'과 '예견한 것'을 가르는 이 구분이 정말 버티는가. 풋은 그걸 시험할 중립적 장치로 폭주하는 전차를 꺼냈다. 원안에서 선택하는 사람은 전차 운전기사였다. 우리가 아는 '레버 앞의 행인'은 9년 뒤 톰슨이 풋을 반박하려고 바꿔 끼운 것이다.
다섯 변형 — 변수를 하나씩 떼어낸 설계
MIT 철학자 주디스 자비스 톰슨은 1976년과 1985년 논문에서 변형을 쌓았다. 조건을 하나씩만 바꿔 어떤 변수가 판단을 뒤집는지 보려는 설계였다.
| 변형 | 상황 | 허용 응답 경향 |
|---|---|---|
| 스위치 (톰슨 1976) | 방관자가 레버로 선로 변경, 옆 선로 1명 사망 | 대체로 다수가 허용 |
| 육교 (톰슨 1985) | 덩치 큰 사람을 손으로 밀어 떨어뜨림 | 소수만 허용 |
| 루프 (톰슨 1985) | 옆 선로가 되돌아옴, 1명의 몸이 브레이크 역할 | 중간 |
| 육교 스위치 (그린 2009) | 원격 스위치로 발판을 열어 떨어뜨림 | 손으로 밀 때보다 상승 |
| 육교 장대 (그린 2009) | 장대로 밀어 떨어뜨림 | 손으로 밀 때와 차이 없음 |
루프가 핵심이다. 여기선 그 한 명의 몸이 전차를 멈추는 수단이다. 이중효과 원리대로면 금지여야 하는데, 사람들은 여전히 레버를 당긴다. 의도/예견 구분만으로는 설명이 안 된다는 뜻이다.
이 60년의 논쟁사는 『저 뚱뚱한 남자를 죽이겠습니까?』(데이비드 에드먼즈)에 정리돼 있다.
2001년 프린스턴, 스캐너 안에서 갈린 회로
조슈아 그린은 철학 전공으로 출발해 뇌영상으로 넘어간 연구자였다. 2001년 프린스턴대에서 그는 참가자를 MRI 스캐너에 눕히고 60개 시나리오를 읽혔다. 20개는 '개인적' 딜레마(직접 손을 쓰는 것), 20개는 '비개인적' 딜레마, 20개는 도덕과 무관한 문제였다.
결과: 손으로 미는 시나리오에서 내측 전두회·후대상피질·양측 각회 같은 정서 관련 영역의 활동이 올라갔다.
이중과정 이론(dual-process theory)이란 도덕 판단이 한 종류가 아니라는 가설이다. 빠르게 튀어나오는 정서 반응과, 느리게 셈하는 계산이 따로 돌아간다고 본다. 두 트랙이 다른 답을 낼 때 우리는 갈등한다. 육교 앞에서 벌어지는 일이 정확히 그것이다.
『사이언스』에 실린 이 논문은 2,000회 넘게 인용됐다. 그린이 이 프레임을 대중서로 정리한 것이 『옳고 그름』(조슈아 그린)이다.
참가자 9명짜리 실험이 어떻게 25년을 버텼나
이 논문의 스캔 참가자는 9명이었다. 2001년 fMRI 비용을 생각하면 당시 관례상 이상한 규모는 아니지만, 25년간 실려 온 해석의 무게에 비하면 위태롭다.
더 큰 타격은 2009년이었다. 매과이어 팀이 원 데이터의 반응시간을 재분석하자, "개인적 딜레마를 허용한 응답이 더 오래 걸린다"는 패턴이 소수의 특이 시나리오에 의해 만들어진 것으로 드러났다. 그린은 이를 인정했다.
그린은 왜 자기 이론의 축을 갈아끼웠나
2009년 『코그니션』 논문에서 그는 신체적 힘(personal force)과 의도를 2×2로 교차시켰다.
- 신체적 힘: 상대를 때린 그 힘이 내 근육에서 나왔는가. 장대로 밀면 손은 안 닿지만 힘은 내 근육에서 나온다. 스위치를 누르면 힘은 기계가 만든다.
- 의도: 그 사람의 죽음이 목적을 이루는 수단인가, 부수 피해인가
역설적으로, 접촉 자체는 무의미했다. 손으로 밀 때와 장대로 밀 때의 차이는 통계적으로 잡히지 않았다(p=0.23). 반면 장대와 원격 스위치의 차이는 유의했다(p=0.006). 그린은 선행 연구가 '접촉 효과'로 보고했던 것이 사실은 신체적 힘의 효과였다고 결론지었다.
종이 위의 답은 실제 행동을 맞히나
2018년, 벨기에 겐트대의 드리스 보스틴 팀이 더 불편한 질문을 던졌다. 종이 위의 답이 실제 행동을 예측하는가.
온라인 설문에 답한 208명 중 192명이 1-2주 뒤 실험실에 왔다. 그들 앞에는 전기충격기와 두 개의 철창이 있었다. 한쪽엔 생쥐 다섯 마리, 다른 쪽엔 한 마리. 노트북에 20초 카운트다운이 돌아갔다.
실제 상황에서 버튼을 누른 쪽은 84%. 같은 딜레마를 글로만 읽은 별도 그룹 83명에서는 66%에 그쳤다. 상상에서 더 많이 망설인 셈이다. 전기는 실제로 흐르지 않았고 참가자들은 즉시 디브리핑을 받았다.
다만 완전한 무용은 아니었다. 가상 응답은 '무엇을 했는가'는 못 맞췄지만 '결정하면서 얼마나 괴로웠는가'는 맞췄다. 종이 위의 답은 행동이 아니라 마음의 온도를 잰다.
4천만 건이 그린 문화 지도
2018년 MIT 미디어랩의 '모럴 머신'은 자율주행차 버전 트롤리를 웹에 올려 233개 국가·지역에서 약 4천만 건의 선택을 모았다.
공통점은 있었다. 사람들은 대체로 젊은 쪽, 많은 쪽, 사람 쪽을 살렸다. 하지만 클러스터는 서구·동양·남부 셋으로 갈렸다. 동양 클러스터(유교·이슬람권)에서는 젊은 쪽을 살리려는 경향이 다른 지역보다 눈에 띄게 약했다. 뒤집힌 게 아니라 옅어진 것이다. 서구권은 개입보다 현상 유지를 택하는 비율이 높았다.
'보편 도덕 회로'라는 그림에 문화라는 기울기가 얹힌 셈이다. 다만 참여자가 스스로 찾아온 표본이라는 한계는 연구진도 명시했다.
내 판단은 어느 트랙에서 나왔나 — 3단 검사
트롤리 문제의 실전 가치는 답을 고르는 데 있지 않다. 조직 구조조정, 의료 자원 배분, 예산 삭감처럼 '적은 손해로 큰 손해를 막는' 결정 앞에서 내 직관이 어디서 왔는지 점검하는 데 있다.
- 근육 검사 — 그 손해를 만든 힘이 내게서 나왔나, 시스템이 만들었나. 같은 결과라도 앞쪽에서 거부감이 커진다.
- 수단 검사 — 상대의 손해가 목적을 이루는 수단인가, 부수 피해인가. 수단이면 정당화 문턱을 높인다.
- 교체 검사 — 대상만 바꿔 다시 물어본다. 모르는 사람 대신 내 동료를 넣어도 같은 답인가.
세 답이 갈리면 계산이 아니라 정서 반응이 먼저 나왔다는 신호다.
4주 훈련 프로토콜과 개인차
| 주차 | 할 일 | 기록 |
|---|---|---|
| 1주 | 결정 직후 '즉답'인지 '계산'인지만 표시 | 하루 3건 |
| 2주 | 교체 검사 적용, 답이 바뀌는 항목 표시 | 주 5건 |
| 3주 | 즉답과 24시간 뒤 답을 나란히 비교 | 주 3건 |
| 4주 | 반대 입장의 가장 강한 논거 1개씩 작성 | 주 3건 |
개인차 조정: 공감 성향이 높은 사람은 1단계에서 과하게 멈춘다. 2단계를 먼저 돌려 수단/부수 피해를 가른 뒤 근육 검사로 간다. 반대로 결정이 빠른 편이면 3주차 시간차 비교를 두 배로 늘린다. 연구에서 희생 선택 성향은 냉정함만이 아니라 반사회성 지표와도 상관이 잡히므로, 빠른 계산을 곧 합리성으로 읽지 않는 편이 안전하다.
남는 것
트롤리 문제가 알려준 건 정답이 아니라 내 도덕 감각이 상황 설계에 따라 흔들린다는 사실이다. 마지막으로 하나. 어제 내린 결정 중, 레버였다고 믿었지만 사실은 미는 쪽이었던 건 없었나.
📌 참고 자료
- Greene et al. (2001), An fMRI Investigation of Emotional Engagement in Moral Judgment, Science — 프린스턴대. 참가자 9명, 60개 시나리오. 개인적 딜레마에서 정서 영역 활성 상승 보고.
- Greene et al. (2009), Pushing moral buttons: The interaction between personal force and intention, Cognition — 신체적 힘과 의도를 2×2로 교차. 두 변수의 상호작용 확인.
- Bostyn, Sevenhant & Roets (2018), Of Mice, Men, and Trolleys, Psychological Science — 겐트대. 실제 그룹 192명 vs 가상 그룹 83명. 실제 84% vs 가상 66%. 가상 응답은 행동을 예측 못 했으나 결정 중 불편감은 예측.
- Awad et al. (2018), The Moral Machine experiment, Nature — MIT 미디어랩. 233개국 약 4천만 건. 서구·동양·남부 3개 문화 클러스터.
이 포스트는 알라딘 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.
'🧠 심리·자기계발' 카테고리의 다른 글
| 습관 쌓기 하는 법: 진짜 변수는 순서다 — 치실 50명이 갈린 '닻 앞'과 '닻 뒤', 8개월의 차이 (0) | 2026.09.26 |
|---|---|
| 가용성 휴리스틱 해부: 1973년 알파벳 실험이 드러낸 것 — 왜 떠올리기 쉬운 일이 흔한 일로 느껴지는가 (0) | 2026.09.25 |
| 편도체 하이재킹의 진실: '6초 룰'은 가짜고, 빼앗기는 건 이성이 아니라 언어다 — 뇌과학이 밝힌 감정 조절법 (0) | 2026.09.23 |
| 섞어 풀기(인터리빙) 공부법 완전 해부: 문제 순서만 바꾼 실험이 만든 61% 대 38%의 격차 (0) | 2026.09.22 |
| 습관은 왜 작게 시작해야 하나: BJ 포그 B=MAP과 치실 한 개에서 나온 4주 프로토콜 (0) | 2026.09.21 |