브라운 대학 교수, AI 학업 기만 사건, 필기 전환과 성적 실체 충격
미국 로드아일랜드주 브라운대학교의 로베르토 세라노 교수님이 최근 미국 교육계와 IT 커뮤니티를 진동시킨 파란만장의 일화를 공개했습니다. 그는 평소에는 교실 내 시험이 일반적이었음에도 불구하고, 특정 사회적 상황 때문에 학생들에게 ‘숙제 형태’의 중간고사를 내보면서 큰 혼란으로 이어졌습니다. 배경에는 지난해 12 월 캠퍼스 인근에서 발생한 총기 사건을 겪은 학생들의 심리적 불안정이 있습니다. 이로 인해 교내 출석을 두려워한 수많은 학생들이 집에서 시험을 보게 하는 ‘숙제식 중간고사’ 제도를 요구하게 되자, 원래 30 명 내외였던 강의 인원 수는 86 명으로 급증했습니다.
하지만 문제는 첫 번째 중간고사 성적에서 드러났습니다. 이번고사는 평소보다 어려웠음에도 불구하고 평균 성적은 무려 96 퍼센트나 나왔습니다. 이는 보통 65 내지 80 퍼센트 범위를 유지하던 해당 과목의 전통을 완전히 깨버린 사건으로, 모든 것이 이상해보였습니다. 세라노 교수는 이번 시험은 ‘과거에 작성한 시험보다 어려웠기 때문에’ 고의적으로 난이도를 높였으나, 결과는 예상과 정반대였다고 말합니다. 가장 큰 의심 포인트는 학생들이 제출한 답안들이 ‘정답은 맞지만 표현 방식이 매우 복잡하고 어색하다는’ 점인데, 이게 바로 AI 생성 도구의 전형적인 양상이었습니다. 실제로 교수가 학생들의 답안 내용을 ChatGPT 로 입력해본 결과, 놀랍도록 유사한 결과가 도출되어 AI 기출 가능성이 대두될 수밖에 없었습니다.
이 사실을 알게 된 세라노 교수는 즉각 학생들에게 이메일로 의심을 표명하며 기말고사를 교실 내에서 재시험을 치르라고 밝혔습니다. ‘숙제식 시험과 결과물이 이전과 유사하다면 최종 성적에 반영하겠다’는 조건을 걸었으나, 결과는 충격적이었습니다. 기말고사 59 명 중 18 명이 과목을 포기했고, 9 명은 기말고사도 아예 skipped 했습니다. 그중 59 명 남는 학생 세 명은 0 점이고, 나머지 학생 두 명만이 중간고사 성적을 +/- 10 퍼센트 범위 내로 맞출 수 있었으며 그중 한 명만이 기말고사 성적도 더 좋았습니다. 사실상 대부분의 학생들은 AI 를 사용해 제출한 결과로, 교실 밖에서의 성적 평가 방식의 허점을 노출한 셈입니다.
교수님은 이 문제점을 학술위원회에 상고했으나, 이야기가 대외적으로 알려지기 전에는 아무런 조치가 취해지지 않았습니다. 브라운대학교는 이제 각 사례를 개별적으로 다시 검토하기로 했습니다. 세라노 교수는 이에 대해 깊은 우려를 표명했습니다. “우리는 우리 사회의 가장優秀한 젊은 지성들이 사기를 당하는 것을 받아들일 수 없습니다. 그 결과 사회가 기울고, 실패하는 사회가 될 수 없습니다. 우리도 바보가 되는 것을 선택해서는 안 됩니다.”라는 충격적인 발언을 보냈습니다. 이 말은 단순한 성적 조작 문제가 아니라, AI 기술에 의존하여 우리 사회의 핵심적인 사고능력이 퇴화하고 있다는 근본적인危機를 의미합니다.
이 뉴스가 나간 후 온라인에서 많은 의견이 나옵니다. 먼저, ‘대학교가 실외 시험을 grading 하는 것 자체를 폐지해야 한다’는 의견이 제기되는데, 학습 자체는 중요하지만 평가 방식은 교실 내에서 이루어져야 한다는 주장도 있습니다. 또 다른 의견으로는, 만약 기업이 유사한 채용 프로세스를 도입한다면 아마도 지원자 1 퍼센트도 뽑기 힘들다고 걱정합니다. 즉, 회사에서 AI 를 믿고 사람을 믿지 않는 현상은 이번 교육계 사례처럼 이미 시작되었다는 의미죠. 심지어, 졸업식 행사에서도 AI 를 언급하면 야유를 하지만, 일상에서는 무분별하게 AI 를 사용한다는 아이러니가 발견됩니다. 이는 기술의 본질을 잊고 편리함만을 추구하는 현상과 연결되는데, 우리는 기술의 도구로 남음이 아니라, 기술을 어떻게 활용하느냐에 따라 인간성이 어떻게 변하는지 고민해야 합니다.
정보기술 전문가로서 이런 상황을 바라보면서 우리는 무엇을 고민해야 할까요? IT 업계에 종사하는 사람으로서, 우리는 고객에게 AI 솔루션을 제안하면서도 스스로의 비판적 능력이 유지되는지 확인해야 합니다. 이번 사례처럼 AI 가 모든 것을 해결해주려 하지 않는 게 중요합니다. 우리는 AI 를 활용하되, 최종 판단력이나 핵심적인 사고 과정은 인간이 책임져야 합니다. 기업 채용에서도 ‘스마트 기기’가 아닌 ‘직접적인 면접’과 ‘필기’가 여전히 의미가 있다는 점을 다시금 되새기는 계기가 되고 있습니다.
결론적으로, 숙제식 시험이나 AI 를 활용한 평가는 당장의 편리함을 위해 장기적인 사고력 저하를 감수하는 것은 매우 위험합니다. 교육기관뿐만 아니라 우리 모두 AI 에 대한 오용이 불러오는 결과를 경계해야 합니다. 세라노 교수의 경고는 단순히 성적 조작을 막자는 것이 아니라, 우리 사회가 AI 의 종속성을 인정할 때 결국 퇴조할 수 있다는 경각심입니다. 이러한 상황에서 IT 전문가로서 우리는 기술의 발전보다는 인간의 가치와 사고의 깊이를 어떻게 보존할 것인가에 대한 대안을 마련해 나가는 노력이 필요해 보입니다. 단순히 AI 도구만 활용하는 것을 넘어, AI 가 만들어낸 결과에 대한 비판적 검증 능력을 키우는 것이 이 시대의 생존 전략이 될지도 모릅니다.
이 글은 Latest from Tom’s Hardware의 기사를 바탕으로 작성되었습니다.
