Project NEUROVERSE
목차

AI 바로 알기 편 · 2부 의지하지 말고 도구로 쓰기 — 2.5

AI는 왜 내 말에 맞장구칠까

AI는 사용자의 생각에 동의하는 쪽으로 기우는 경향이 있습니다. 맞장구가 쌓이면, 틀린 생각도 맞다고 확신하게 될 수 있습니다.

AI와 이야기하다 보면 기분이 좋아질 때가 많습니다. 내 생각을 칭찬해주고, 내 아이디어가 좋다고 해주거든요. 그런데 이 친절함에는 함정이 있습니다.

사람은 원래 없는 패턴도 봅니다

사람의 뇌는 패턴을 찾는 데 아주 뛰어납니다. 너무 뛰어나서, 우연히 겹친 일에서도 의미를 찾아냅니다. 구름에서 얼굴을 보거나, “이 옷을 입은 날마다 일이 잘 풀린다”고 느끼는 것처럼요. 이렇게 관계없는 것들 사이에서 의미 있는 연결을 보는 경향을 아포페니아라고 합니다.

여기에 확증 편향이 더해집니다. 한번 그렇다고 믿으면, 그 믿음에 맞는 기억은 잘 떠오르고 맞지 않는 기억은 잊힙니다. 파란 옷을 입고 시험을 망친 날은 기억에 잘 안 남는 거죠.

혼자서라면 이런 생각은 금방 흐려지기도 합니다. 그런데 옆에서 누군가 계속 “맞아, 그런 것 같아”라고 해준다면 어떨까요?

같은 사람이 같은 이야기를 두 종류의 AI에게 해요. "다음"을 누르며 대화를 진행하고, AI를 바꿔가며 보세요.

    "내 생각이 맞다"는 확신

    대화와 확신 게이지는 설명을 위해 만든 예시예요.

    해보면 보이는 것

    맞장구치는 AI와 이야기하면, 처음에 반신반의하던 생각이 대화를 거듭할수록 확신으로 바뀝니다. AI가 새 증거를 준 게 아닙니다. 내 생각을 매번 다시 확인해줬을 뿐입니다. 마지막에는 공부보다 옷 색깔을 챙기겠다는 결정까지 갑니다.

    균형 잡힌 AI는 생각을 무시하지 않으면서, 반대 경우를 떠올려보게 하고 직접 확인하는 방법을 알려줍니다. 확신이 오히려 줄어듭니다.

    중요한 건, 맞장구치는 AI의 대답이 틀린 정보를 말하지 않았다는 것입니다. “색깔이 기분에 영향을 준다는 이야기도 있다”는 말 자체는 거짓이 아닐 수 있습니다. 문제는 사실이 아니라 방향입니다. 내 생각을 검증하는 대신 계속 밀어줬습니다.

    AI는 왜 맞장구칠까

    기초 이론 편 3.6에서 채팅봇은 사람이 더 좋다고 고른 답을 따라 하도록 다듬어진다고 했습니다. 그런데 사람은 대체로 자기 생각에 동의해주는 답을 더 좋아합니다. 그러다 보니 모델이 “듣기 좋은 답” 쪽으로 기우는 경향이 생깁니다. 이걸 아첨(sycophancy) 이라고 부릅니다.

    Anthropic 연구진은 2023년 논문에서, 당시 여러 AI 어시스턴트가 여러 종류의 과제에서 일관되게 이런 경향을 보였다고 보고했습니다. 또 사람과, 사람의 선호를 학습한 모델 모두 그럴듯하게 쓴 아첨하는 답을 맞는 답보다 더 좋다고 고르는 경우가 무시할 수 없을 만큼 있었다고 밝혔습니다.

    어떻게 대할까

    • 동의받으면 한 번 더 의심하기. AI가 내 생각에 맞장구치면, 그게 증거가 아니라는 걸 기억하세요.
    • 반대로 물어보기. “내 생각이 틀렸다면 어떤 이유 때문일까?”, “반대 입장에서 가장 강한 근거를 말해줘.”
    • 내 의견을 먼저 말하지 않기. “이거 맞지?”보다 “이 둘 중 어느 쪽 근거가 더 강해?”처럼 물으면 덜 끌려갑니다.
    • 직접 세어보기. 위젯의 균형 잡힌 AI가 말한 것처럼, 우연인지 아닌지는 기억이 아니라 기록으로 확인하세요.
    • 중요한 믿음일수록 사람과도 이야기하기. 건강, 돈, 인간관계에 관한 확신이 AI와의 대화로만 커지고 있다면 특히요.
    더 깊게 · 합리적인 사람도 빠질 수 있을까

    “나는 그렇게 쉽게 넘어가지 않아”라고 생각할 수 있습니다. 그런데 2026년 MIT 연구진의 모델 연구는, 증거를 합리적으로 따지는 이상적인 사람을 가정해도 늘 맞장구치는 상대와 대화를 반복하면 틀린 믿음에 대한 확신이 커질 수 있다는 결과를 내놓았습니다. 상대가 내 생각에 맞는 쪽으로만 반응하면, 그 반응 자체가 치우친 증거가 되기 때문입니다. 똑똑하냐 아니냐의 문제가 아니라, 대화 구조의 문제라는 것입니다.

    정리

    • 사람은 우연에서도 패턴을 보고(아포페니아), 믿는 쪽 증거만 기억해요(확증 편향).
    • AI는 사용자에게 동의하는 쪽으로 기우는 경향(아첨) 이 있어서, 이런 생각을 확신으로 키울 수 있습니다.
    • AI의 동의는 증거가 아닙니다. 반대로 묻고, 직접 확인하고, 중요한 건 사람과도 이야기하세요.

    이 장을 복사합니다. ChatGPT나 Claude 같은 AI에 붙여넣고 그대로 보내면 AI가 다 읽었다고 답합니다. 그다음 궁금한 걸 물어보세요.