셈하는 말 '영리한 한스' — 채점하는 법을 바꾸자 드러난 것
20세기 초 독일 베를린에 영리한 한스(Clever Hans)라는 말이 있었습니다. 주인 빌헬름 폰 오스텐이 덧셈 같은 문제를 내면 한스는 발굽을 두드린 횟수로 답했고, 맞히는 일이 많아 큰 화제가 되었어요. 1904년에는 심리학자 카를 슈툼프가 참여한 조사단이 살펴보았지만 속임수를 찾지 못했습니다.
1907년, 슈툼프의 조수 오스카 풍스트는 채점하는 법을 바꿨습니다. 묻는 사람이 답을 모르게 하거나, 한스가 묻는 사람을 볼 수 없게 한 것이지요. 그러자 정답률이 크게 떨어졌습니다. 한스는 셈을 한 것이 아니라, 두드린 수가 정답에 이르면 사람들이 저도 모르게 긴장을 푸는 작은 몸짓을 읽고 멈췄던 것입니다.
오늘 수업과 뼈대가 같습니다. 답을 아는 사람 앞에서 잰 점수는 훈련 데이터로 잰 정확도처럼 부풀려져 있었고, 답이 새어 나갈 길을 막고 다시 재자 진짜 실력이 드러났어요. 그래서 기계학습에서는 모델이 과제 대신 엉뚱한 단서로 맞히는 일을 영리한 한스 효과라고 부릅니다. 말 사진을 말의 생김새가 아니라 사진 귀퉁이의 출처 표시로 알아보던 분류기가 실제로 보고되기도 했습니다.
사진: '한스가 덧셈을 배운다'라는 제목의 옛 사진 · 출처: Karl Krall, Wikimedia Commons (Public domain)