브라운대 교수, AI 체트 폭로도… 중간시험 96 대면 48 급추락
최근 인공지능 기술의 발전이 교육계, 특히 고등교육 현장에서 얼마나 큰 충격을 주고 있는지에 대해선 많은 이야기가 오고가고 있습니다. 최근 TechSpot 에서 보도된 한 기사는 브라운 대학교의 교수님께서 공표한 차트와 사례를 통해 AI 기만 행위의 규모를 직관적으로 보여주었습니다. 이는 단순히 성적 조작을 넘어서, 교육 시스템의 근본적인 윤리적 문제와 기술의 양면성을 동시에 드러내는 중요 사례로 분석됩니다.
브라운 대학교의 경제학 교수 로버트 세라노 교수님은 자신의 경제학 수강생들에게 take-home 시험을 치르도록 하는 방식을 선택했습니다. 그 이유는 학교 내부에서 발생한 총기 사건으로 인해 학생들이 강의실 시험을 두려워하는 상황을 고려한 것이었기 때문입니다. 이러한 상황에서 시험을 허용하려는 의도는 학생들의 안전을 우선시하려는 학교의 입장을 반영한 것으로, 당시 많은 학생들이 대면 시험을 피하고 원격 또는 자기 주도적인 학습을 선호하는 트렌드와 맞물려 있었습니다.
하지만 세라노 교수님은 학생들의 성적 흐름이 이상하게 변하는 것을 직감적으로 포착했습니다. 평소 30 명 내외였던 수강생들이 이번 학기에는 무려 86 명에 달했고, 대부분은 take-home 시험이 가능하다는 조건 때문에 수강신청을 한 것으로 판단했습니다. 이 시험의 평균 성적은 96% 로 기록되어, 평소에 65% 내외였던 성적대와 비교하면 매우 이상했습니다. 또한 교수의 시험 난이도 조정에 불구하고 점수가 이렇게 높게 나왔다는 것은 학생들의 실제 이해 수준과 거리가 멀다는 것을 시사했습니다.
교수님은 이 문제를 발견하자마자 학생들의 제출한 과제물을 AI 생성 도구인 챗GPT 와 비교 분석하는 실험을 진행했습니다. 예상대로 챗봇이 생성한 답변들이 학생들의 제출본과 매우 유사한 어휘 사용과 논리적 전개 방식을 보여주었습니다. 이는 학생들이 직접적으로 AI 도구를 활용해 답안을 작성했음을 의미하며, 교수님의 초기 우려가 사실보다 더 심각했던 것으로 드러났습니다. 결국 대학 내에서 AI 를 사용하여 학생의 성적을 조작하는 행위가 얼마나 광범위하게 행해지고 있는지 폭로하게 되었습니다.
이후 교수님은 시험 방식을 강제로 대면 형식으로 전환했습니다. 결과는 예상대로 학생들 사이에서 큰 혼란과 이탈로 이어졌습니다. 무려 18 명의 학생이 수업을 포기했고, 나머지 학생들 중에서도 9 명은 최종 시험을 위해 출석하지 않았습니다. 최종적으로 남은 학생들의 평균 성적이 48.6% 로 급락했습니다. 이는 중간고사 점수 평균 65% 를 밑도는 수치로, 학생들의 AI 의존도가 실제 학업능력을 대체했음을 여실히 보여줍니다.
교수가 작성한 차트 분석은 학생들 중 실제로 AI 없이 시험을 치른 학생은 극소수였음을 나타냈습니다. 한 학생은 중간평가에서 95.5%, 최종평가에서 95% 로 일관된 높은 성적을 유지했고, 다른 한名学生 은 중간평가 55% 에서 최종평가 59% 로 성적이 오르는 기록을 보였습니다. 이는 AI 를 사용하지 않은 유일한 사례로 분석되었습니다. 대부분의 학생들은 중간평가 평균 96% 대비 최종평가 평균 40% 점 이상 하락하며, AI 도구의 의존도를 드러냈습니다.
세라노 교수는 브라운 대학교 학제위원회에서 제출한 데이터를 보고, 학교 측의 대응이 미미하다는 점에 우려를 표했습니다. 위원회가 개입을 요청했으나, 해당 데이터를 다시 AI 감지 시스템을 통해 검증하려는 의도만 있었을 것으로 판단했습니다. 실제로 학교는 개인적인 신고를 받도록 요청했으나, 교수님은 학교가 단순히 AI 증명을 적용할 것이라 생각하여 대응을 지연시켰습니다. 전문가들은 학업 성실성을 보장하는 책임자가 없는 한 이 문제는 지속될 수밖에 없다고 지적합니다.
결국 기술 발전 속도에 발맞추어 교육 시스템을 어떻게 혁신하느냐에 대한 논의가 시급해졌다는 것입니다. 디지털 기술의 발전이 가져온 편리함은 있으나, 그 이면에서 발생하는 교육 부조리나 공정성 문제를 어떻게 해결할지 고려해야 합니다. 아날로그 방식으로 작성한 필기시험이나 대면 평가는 여전히 학업 능력의 기준이 될 수 있습니다. 하지만 기술이 발전함에 따라 새로운 형태의 검증 방식이 개발될 필요도 있다는 점도 간과할 수 없습니다.
이번 에피소드는 단순히 대학의 시험 문제라기보다는, 사회 전반적으로 AI 사용에 대한 통제가 느슨해지고 있다는 것을 반영합니다. 기업에서도 AI 를 활용하여 효율성을 높이는 추세이면서, 학계에서의 AI 사용은 학생들을 위한 교육의 도구인지, 혹은 간극을 메우기 위한 수단이 아닌지에 대한 근본적인 질문을 던집니다. 결국 교육의 목적은 점수를 잘 맞히는 것보다는 비판적 사고와 창의성 능력을 기르는 것임을 다시 한번 상기시켜 줍니다.
브라운 대학교의 이번 사례는 TechSpot 등 국제적인 기술 매체에서도 이슈가 되고 있으며, 향후 각 대학들이 시험 방식을 어떻게 규정할지에 큰 영향을 미칠 것으로 예상됩니다. AI 도구를 활용한 학습이나 답변 작성은 점차 보편화될 것이지만, 이를 어떻게 평가하고 관리할지는 각 교육 기관의 책임에 달려 있습니다. 학생들의 안전을 고려한 시험 제도가 오히려 AI 의 악용을 부추겨버린 점은 매우 아이러니했습니다. 이 상황을 바라보는 전문가들과 교육 관계자들의 고민이 깊어질 것으로 보입니다.
이 글은 TechSpot의 기사를 바탕으로 작성되었습니다.
