연구, AI 접근이 ‘모르겠어요’ 응답을 급감시키고 과신을 높인다는 사실 밝혀
3천 명이 넘는 참가자를 대상으로 한 다섯 차례 실험에서, 언어 모델을 손에 두는 것만으로 사람들은 불확실성을 인정하는 빈도가 거의 사라졌지만 정답률은 크게 떨어졌다.

1. 사건 개요, 참여 인물 및 시점
Matthias Bastian이 이끄는 연구팀은 2026년 9월 26일, 3,132명의 자원자를 대상으로 다섯 차례 실험을 수행한 뒤 새로운 연구 결과를 발표했다. 이번 연구는 대화형 AI가 단순히 이용 가능하다는 사실이 사람들의 불확실성 인정 의향에 어떤 영향을 미치는지를 조사했다.
2. 핵심 결과 및 실험 세부사항
- 설계: 참가자들은 영화에 대한 세밀한 시각 지식이 필요한 퀴즈(예: Bend It Like Beckham에서 팀 유니폼 색상) 질문에 답해야 했다. 주요 모델인 Step 3.5 Flash는 거의 모든 질문에서 틀리도록 의도적으로 선택되어 AI 의존성을 시험하는 스트레스 테스트 역할을 했다. 다른 모델인 GPT‑5.5, Claude 4.6 Sonnet, Gemini 3.5 Flash는 쉬운 항목에서는 좋은 성과를 보였지만 가장 어려운 질문에서는 역시 실수를 보였다.
- ‘모르겠어요’ 응답에 미친 영향: 첫 번째와 두 번째 실험(1a, 1b)에서는 참가자들이 AI에 문의할지를 스스로 결정했다. AI에 접근할 수 없을 때는 각각 36 %와 44 %의 항목에서 판단을 보류했지만, AI가 제공될 경우 그 비율은 각각 6 %와 3 %로 급감했다.
- 자신감 vs. 정확도: Study 2에서 AI에 접근했을 때 자신감 점수(100점 만점)는 75.9점으로 급등했으며, AI가 없을 때는 29.6점에 불과해 두 배 이상 차이났다. 동시에 정답률은 27.6 %에서 10 %로 감소했다. 다섯 차례 실험 전체를 살펴보면, 인센티브가 없고 AI에 질문할 수 있었던 참가자는 정답률이 9.2 %에 머물렀지만, AI 사용이 차단된 경우는 27.5 %였다.
- 재정적 인센티브: Study 3‑4에서는 정답당 $0.10을 지급하고 오답당 $0.10을 차감하며 ‘모르겠어요’에는 보상을 주지 않는 소액 보상 체계를 도입했다. 사전 등록된 가설은 인센티브가 ‘모르겠어요’ 응답을 늘릴 것으로 예상했지만, AI 이용 가능성과의 상호작용은 통계적으로 유의미하지 않았다. 인센티브는 AI 문의 횟수를 약간 감소시켰다—Study 3에서 참가자는 최대 6회 중 평균 4.53회만 도움을 요청했으며, 인센티브가 없을 때는 5.27회였다. 인센티브가 있을 때 정확도는 약간 상승했지만, 판단 보류 비율은 AI가 전혀 없는 상황보다 여전히 낮았다.
- 자동 AI 제안: Study 4에서는 AI 답변을 자동으로 표시해 현대 검색 엔진과 작문 도우미가 프롬프트 없이 AI 생성 콘텐츠를 제공하는 방식을 모방했다. 결과는 동일하게 나타났다—인센티브가 없을 때 판단 보류 비율이 약 35 %에서 1 %(자동 표시 AI)로 감소했고, 인센티브가 있을 때는 약 39 %에서 7 %로 감소했다.
- 해석: 저자들은 이 현상을 “Epistemia”라 명명했으며, 이는 모델이 무지를 인정할 메커니즘이 없음에도 불구하고 권위적으로 들리기 때문에 AI 출력물을 받아들이는 경향을 의미한다. 이는 기존의 ‘조언 활용’ 연구와 정반대로, 일반적으로 사람들은 외부 조언을 보수적으로 평가하고 조언자의 입장에 1/3 정도만 이동한다는 점과 대비된다. 이번 실험에서는 참가자들이 반대로 움직여 AI를 따름으로써 정답을 오답으로 바꾸는 경우도 발생했다.
- 광범위한 연구: 논문은 스위스 비즈니스 스쿨이 666명을 대상으로 진행한 설문조사에서 AI 의존도와 비판적 사고 점수 사이에 강한 부정적 연관성이 발견됐으며, 마이크로소프트 연구에서는 짧은 AI 지원 세션이 이후 과제에서 문제 해결 지속성을 감소시킨다는 결과를 인용한다. 두 연구 모두 AI 사용이 메타인지 자원을 소모한다는 점을 시사하지만, 고학력자는 이러한 영향을 완화할 수 있음을 보여준다.
3. 산업적 맥락 및 시사점
AI가 생성한 답변이 일상 도구에 깊숙이 통합되는 시점에 이 결과가 발표되었다. 검색 엔진은 이제 대형 언어 모델 요약을 제공하고, 작문 도우미는 무작위 제안을 내보낸다. 연구진은 이러한 보편성이 불확실성을 인정하는 습관을 약화시켜 건전한 의사결정의 핵심을 위협할 수 있다고 경고한다. 모델 정확도 향상이 여전히 중요한 과제이지만, 저자들은 사용자가 ‘모르겠어요’라고 말할 의지를 유지하는 것이 AI가 점점 더 확대되는 환경에서 인간 판단을 보존하는 데 동등하게 중요하다고 주장한다.

