모두의 계산기
← 블로그로 돌아가기

생활 속 심리

바넘 효과와 포러 효과: 누구에게나 맞는 말이 내 성격처럼 느껴지는 이유

포러의 성격 평가 실험과 바넘 효과를 바탕으로 모호한 설명이 개인적인 진단처럼 느껴지는 과정을 살펴봅니다. 재미로 보는 유형 검사와 검증된 측정을 구분하는 기준도 정리합니다.

‘사람들과 어울리는 것을 좋아하지만 가끔은 혼자만의 시간이 필요합니다.’ 이런 설명을 읽으면 자신의 모습을 잘 짚었다고 느끼기 쉽습니다. 실제로 나에게 맞는 말일 수 있습니다. 문제는 얼마나 많은 다른 사람에게도 맞는지입니다. 바넘 효과는 폭넓은 사람에게 적용될 만한 설명을 자신만의 성격을 정확히 묘사한 것으로 받아들이는 경향을 말합니다. 포러 효과라는 이름으로도 알려져 있습니다.

포러의 실험은 무엇을 보여 주었을까요

심리학자 버트럼 포러는 학생들에게 성격 검사를 실시한 뒤 각자의 검사 결과처럼 보이는 설명을 제공했습니다. 그러나 실제로는 모두에게 같은 설명을 주었습니다. 학생들이 그 설명을 자신에게 잘 맞는다고 평가한 과정은 1949년 논문으로 발표됐습니다. 이 연구가 던진 질문은 설명을 받은 사람이 수긍했다는 사실만으로 검사 방법의 타당성이 입증되는가 하는 것입니다.

포러의 시연은 사람이 자기 이야기를 받아들이는 방식의 취약점을 인상적으로 보여 줍니다. 다만 하나의 교실 시연을 근거로 모든 성격 검사가 거짓이라고 결론 내릴 수는 없습니다. 검증된 측정 도구와 모호한 운세 문장을 같은 것으로 취급하면 또 다른 오류가 됩니다. 연구의 의미는 ‘맞는 것 같다’는 느낌과 다른 사람을 구별하는 측정 능력이 다르다는 데 있습니다.

여기서는 원래 설명문을 그대로 옮기기보다 비슷한 구조의 예를 만들어 보겠습니다. ‘익숙한 일은 능숙하게 처리하지만 낯선 상황에서는 실수할까 걱정합니다.’ 이 문장은 상당수 사람에게 어느 정도 맞을 수 있습니다. 나에게 맞는 사례가 떠오른다는 이유만으로 나의 답변을 분석한 특별한 결과라고 볼 수는 없습니다. 문장이 사실일 가능성과 문장이 나만을 구별할 가능성은 별개입니다.

폭넓게 맞는 문장은 반박하기 어렵습니다

‘항상’, ‘모든 상황에서’처럼 강한 표현은 반례를 찾기 쉽습니다. 반면 ‘때때로’, ‘어느 정도’, ‘상황에 따라’라는 말은 적용 범위를 넓힙니다. 사람의 행동은 실제로 상황에 따라 변하므로 이런 표현이 반드시 잘못된 것은 아닙니다. 다만 조건이 너무 넓으면 맞았는지 틀렸는지 평가하기가 어려워집니다. 무엇이 나타나면 설명이 틀렸다고 볼 것인지 생각해 보는 것이 도움이 됩니다.

서로 반대되는 성향을 한 문장에 넣는 방법도 있습니다. ‘계획을 좋아하지만 가끔은 즉흥적인 선택도 즐깁니다’라고 하면 계획한 경험과 즉흥적으로 움직인 경험 중 어느 쪽도 설명에 들어갑니다. 사람이 복합적이라는 사실을 잘 표현한 문장일 수는 있지만 개인차를 정밀하게 측정했다는 증거는 아닙니다. 유용한 묘사와 진단적인 정보는 구분할 수 있습니다.

긍정적이고 수용하기 쉬운 표현도 평가에 영향을 줄 수 있습니다. ‘잠재력이 있지만 아직 충분히 발휘하지 못했습니다’라는 말은 현재의 아쉬움과 미래의 기대를 동시에 건드립니다. 이 문장을 좋아한다는 사실은 자연스럽지만 잠재력을 실제로 측정한 결과가 되지는 않습니다. 듣기 좋은 설명일수록 그 설명을 만든 근거와 비교 기준을 따로 확인하는 습관이 필요합니다.

내 기억에서 맞는 장면을 찾는 과정

성격 설명을 읽으면 우리는 과거 경험을 떠올립니다. ‘중요한 선택에서 오래 고민한다’는 말을 보면 집을 고르거나 진로를 정할 때 고민한 일이 생각납니다. 반대로 고민 없이 결정했던 작은 일은 중요하지 않다고 넘길 수 있습니다. 설명과 맞는 사례를 찾는 과정이 자연스럽게 일어나면서 문장이 더 정확하게 느껴질 수 있습니다. 한두 개의 맞는 사례만으로 설명 전체를 검증했다고 보기는 어렵습니다.

확인 방법을 바꾸면 인상이 달라질 수 있습니다. 맞는 경험뿐 아니라 맞지 않는 경험도 같은 기간에서 찾아보는 것입니다. 최근 한 달 동안 중요한 결정을 열 번 했다면 몇 번 오래 고민했는지 기록할 수 있습니다. 다만 중요하다는 기준과 오래라는 기준도 먼저 정해야 합니다. 결과를 본 뒤 기준을 바꾸면 어떤 행동도 설명에 맞출 수 있습니다.

이 과정은 자신을 의심하라는 뜻이 아닙니다. 어떤 설명이 자기 이해에 도움을 주는 것과 그 설명을 만든 검사 체계가 정확한 것은 다른 질문입니다. 문장을 읽고 생각을 정리할 수는 있습니다. 그러나 그 경험을 근거로 검사 제공자가 미래나 숨은 성격을 특별히 알아냈다고 결론 내리려면 추가 검증이 필요합니다.

개인화된 포장이 정보의 정확성을 보장하지 않습니다

이름과 생년월일을 입력하고 긴 설문에 답한 뒤 받은 결과는 특별히 나를 분석한 것처럼 느껴집니다. 하지만 입력을 많이 받았다는 사실만으로 결과가 그 입력에 유의미하게 연결됐다고 볼 수는 없습니다. 실제 점수 산출 과정이 있는지, 응답을 바꾸면 결과가 어떻게 달라지는지, 서로 다른 사람을 얼마나 잘 구분하는지 확인해야 합니다. 정교한 화면과 전문적인 용어는 그 자체로 검증 자료가 아닙니다.

인공지능이 작성한 설명도 마찬가지입니다. 대화에서 사용자가 한 말을 자연스럽게 되돌려 주면 친밀하고 정확하게 느껴질 수 있습니다. 그것이 자기 성찰에 유용할 수는 있지만 임상적 진단 능력을 입증하지는 않습니다. 입력에 포함된 정보를 요약한 것인지, 새로운 특성을 신뢰할 만하게 예측한 것인지 구분해야 합니다. 유창한 문장과 측정의 타당성은 별개의 성질입니다.

적중률을 보려면 분모와 비교 대상이 필요합니다

가상의 서비스가 이용자 열 명 중 여덟 명에게 ‘요즘 피곤할 때가 있다’고 말했고 여덟 명 모두 맞다고 답했다고 해 보겠습니다. 이 정보만으로 특별한 예측력을 인정할 수는 없습니다. 애초에 거의 모든 사람이 그 문장에 동의할 수 있기 때문입니다. 아무에게나 같은 말을 했을 때의 성공률과 비교해야 추가 정보가 있는지 알 수 있습니다.

또 맞은 예측만 모아 광고하면 실패한 예측이 분모에서 빠집니다. 열 가지 중 두 가지가 맞았는데 그 두 가지만 기억하면 인상이 크게 달라집니다. 평가하려면 미리 정한 예측을 모두 기록하고 결과가 나온 뒤 기준대로 판정해야 합니다. 애매한 예측을 사후에 다시 해석하는 방식은 정확도를 부풀릴 수 있습니다. 구체적인 시점과 관찰 가능한 결과가 있는 예측이 검증하기 쉽습니다.

성격 설명에서도 자기 결과와 다른 사람의 결과를 구별할 수 있는지 살펴볼 수 있습니다. 이름을 가린 여러 설명 중 자신의 결과를 우연보다 잘 고를 수 있는지 같은 질문입니다. 다만 비슷한 성향의 사람에게는 비슷한 결과가 나오는 것이 정상일 수 있어 이것만으로 검사 전체를 평가할 수는 없습니다. 하나의 재미있는 시험을 최종 판정으로 삼기보다 여러 검증 자료를 함께 봐야 합니다.

신뢰도와 타당도는 느낌과 다릅니다

신뢰도는 측정이 얼마나 일관되게 이루어지는지와 관련됩니다. 비슷한 조건에서 반복했을 때 결과가 크게 흔들리는지, 같은 특성을 재는 문항들이 일관된 정보를 주는지 등을 살펴봅니다. 그러나 일관되게 같은 결과를 내는 검사도 엉뚱한 특성을 잴 수 있습니다. 누구에게나 같은 설명을 주는 도구는 결과가 안정적이어도 개인차를 측정하는 데 쓸모가 없을 수 있습니다.

타당도는 점수에서 어떤 해석을 하고 어떤 목적으로 사용할 근거가 있는지에 관한 문제입니다. 일상적 성향을 돌아보는 설문을 채용 탈락이나 정신건강 진단에 사용하는 것은 용도가 달라진 것입니다. 특정 목적에서 검증됐다고 모든 결정에 쓸 수 있는 것은 아닙니다. 검사 이름이 유명하거나 결과에 공감하는 사람이 많다는 사실만으로 사용 범위가 무한히 넓어지지는 않습니다.

타당한 검사를 고르는 문제에서도 완벽한 도구와 완전히 무의미한 도구라는 양자택일은 피하는 편이 좋습니다. 어떤 성향을 얼마나 불확실하게 추정하는지, 누구를 대상으로 연구했는지, 결과를 어떤 다른 정보와 함께 해석해야 하는지가 중요합니다. 숫자가 소수점까지 나와도 오차가 없다는 뜻은 아닙니다. 측정의 한계를 설명하는 자료가 있는지 확인할 수 있습니다.

유형을 자기소개에 쓰는 것과 자신을 제한하는 것

성격 유형을 가벼운 대화의 출발점으로 삼을 수는 있습니다. ‘나는 이런 상황에서 피곤해지는 편’이라고 말하며 서로의 경험을 묻는 데 도움이 될 수 있습니다. 그러나 유형을 이유로 특정 일을 못 한다고 단정하거나 상대가 반드시 어떤 행동을 할 것이라고 판단하면 관찰을 대신하는 꼬리표가 됩니다. 실제 경험이 유형 설명과 다르면 사람을 틀렸다고 보기보다 설명의 한계를 검토해야 합니다.

‘나는 원래 이런 사람’이라는 문장이 편안함을 줄 때도 있지만 변화 가능성을 가릴 수 있습니다. 현재의 선호와 학습한 기술, 특정 환경에서의 반응은 나누어 볼 수 있습니다. 낯선 자리에서 긴장한다고 모든 사회적 활동을 못 하는 것은 아닙니다. 유형이 행동을 결정하는 원인처럼 보이기 시작하면 실제로 도움이 되는 연습과 환경 조정을 놓칠 수 있습니다.

설명을 읽은 뒤 던져 볼 질문

이 문장이 나와 다른 사람에게도 비슷하게 맞는지 생각해 보세요. 어떤 행동이 나오면 틀렸다고 판정할 수 있는지도 물어볼 수 있습니다. 결과가 내 응답과 어떻게 연결되는지, 용도에 맞는 검증 자료가 있는지 확인하면 느낌만으로 판단하는 일을 줄일 수 있습니다. 재미를 느끼는 것과 중요한 결정을 맡기는 것은 다른 수준의 근거를 요구합니다.

바넘 효과를 안다고 해서 설명에 공감한 자신이나 다른 사람을 어리석다고 볼 필요는 없습니다. 폭넓게 맞는 문장을 개인적인 경험과 연결하는 것은 누구에게나 일어날 수 있습니다. 더 유용한 태도는 공감을 멈추는 것이 아니라 공감과 검증을 나누는 것입니다. ‘나에게 와닿는다’는 반응은 자기 이해의 출발점일 수 있지만 검사의 정확성을 증명하는 마지막 단계는 아닙니다.

참고자료