600명이 함께 친 시험

2025년 11월 연세대 600명 대형 강의에서 AI 부정행위가 다수 적발됐고, 고려대는 1,400명이 듣는 교양과목 중간고사를 전면 무효 처리했으며, 동국대는 AI 사용 시 F학점을 공지했다.
비슷한 시기, 세 대학에서 터진 사고

연세대학교에 '자연어 처리와 챗GPT'라는 과목이 있다. 수강생만 600명에 이르는 대형 강의다. 2025년 11월, 이 수업의 비대면 중간고사에서 사고가 터졌다. 시험을 보는 도중에 챗GPT를 쓴 학생이 다수 드러난 것이다. 담당 교수 스스로 "부정행위가 매우 다수 발견됐다"고 할 정도였다. 교수가 손을 놓고 있던 것도 아니다. 컴퓨터 화면과 손, 얼굴이 나오도록 영상을 찍어 제출하게 하는 감시 장치를 미리 걸어뒀지만, 그것으로도 막지 못했다.

학생들이 얼마나 썼는지는 학내 커뮤니티 '에브리타임'의 한 투표에 고스란히 드러난다. 비수강생을 뺀 응답자 353명 가운데 190명이 "커닝했다"고 답했다. 절반이 넘는 숫자다.

연세대 에브리타임 익명 투표에서 응답자 353명 중 190명, 즉 53.8%가 시험 중 챗GPT로 커닝했다고 스스로 인정해 부정행위가 응답자 절반을 넘었다.
응답자 절반이 넘긴 자백

비슷한 시기, 고려대에서도 판박이 같은 일이 벌어졌다. 약 1,400명이 듣는 온라인 교양과목 '고령사회에 대한 다학제적 이해'의 중간고사였다. 학생들은 카카오톡 오픈채팅방에 모여 문제와 답을 주고받았고, 그중 일부는 "AI 도구를 활용했다"고 스스로 인정했다. 결국 담당 교수는 그 중간고사를 통째로 무효 처리했다. 동국대의 한 프로그래밍 수업에서도 AI를 쓴 정황이 잡히자, 교수가 "AI를 쓰면 F학점"이라고 못 박아 공지했다.

정작 눈길이 가는 건 학생들의 감각이다. 한 학생은 이렇게 말했다. "온라인은 물리적으로 잡아낼 방법이 없고, 다들 쓰는데 나만 안 쓰면 손해라는 생각이 든다." 이건 개인 하나의 일탈이 아니다. 부정행위가 집단 전체의 균형점으로 굳어져 버린 상황이다. 한 신입생의 말이 이를 뒷받침한다. "온라인 시험은 평균 점수가 높으니, 학생들이 AI를 더 쓰려는 경향이 있다."

처벌도 탐지도, 왜 번번이 뚫리나

처벌 강화와 AI 탐지 도구라는 두 대응책 모두 이미 뚫리고 있다. 감독 불가능한 환경을 둔 채 사후 적발에만 기대는 구조와, '판독기에 안 걸리게' 재작성하면 그만인 탐지 회피가 그 한계다.
두 대응책, 둘 다 뚫린다

지금까지 대학이 AI 부정행위에 맞서 온 방식은 크게 두 갈래였다. 하나는 처벌 강화다. 자수하면 0점, 끝까지 숨기면 유기정학. 다른 하나는 탐지 도구 도입이다. GPT킬러나 GPT제로 같은 판독기로 AI가 쓴 글을 가려내는 방식이다 — 실제로 고려대는 기말 과제에 'GPT킬러 표절률 5% 미만'이라는 조건까지 붙였다. 둘 다 그럴듯해 보인다. 그런데 둘 다 이미 뚫리고 있다.

먼저 탐지 도구를 보자. 한 학생의 증언이 이 방식의 한계를 그대로 보여준다. "리포트를 내 말투로 자연스럽게 만들어 달라고 한 다음, 다시 'GPT 판독기에 안 걸리게 만들어줘'라고 명령한다. 한 번도 걸려본 적 없다." 결국 탐지와 회피는 창과 방패의 군비경쟁이다. 그리고 지금은 글을 만들어내는 쪽이 한발 앞서 있다. 게다가 판독기는 멀쩡한 글을 AI로 오해하는 오탐(false positive) 위험이 있어서, 그 결과 하나만으로 학생을 징계하기도 어렵다.

처벌을 세게 매기는 방식도 뿌리를 건드리지는 못한다. 연세대 사건을 두고 정작 교수들 사이에서 나온 말은 오히려 자성에 가까웠다. "600명이 듣는 온라인 강의에서 이런 문제는 당연히 터질 일"이라는 것이다. 감독이 불가능한 환경을 그대로 둔 채, 사후에 적발하고 벌주는 데만 기대는 구조 자체가 애초의 원인이라는 지적이다.

숫자를 보면 이 판이 왜 이미 기울었는지 분명해진다. 에브리타임 운영사 비누랩스가 2025년 초 대학생 1,000명에게 물었더니, 71.2%가 지금 AI 서비스를 쓰고 있다고 답했다. 한 학생은 "AI 없이 학교 다니는 건 상상이 안 된다"고 했다. 이미 공부의 기본값이 된 도구를, 시험장에서만 금지한다. 그런 규칙은 관성적으로 무력해질 수밖에 없다.

비누랩스가 대학생 1,000명에게 물은 결과 71.2%, 즉 10명 중 7명이 이미 AI 서비스를 쓰고 있어, AI가 공부의 기본값이 된 상황에서 시험장에서만 금지하는 규칙은 무력해진다.
공부의 기본값이 된 AI

진짜 빈틈은 '규칙이 없다'는 것

전국 131개 대학 중 101곳(77.1%)이 생성형 AI 공식 정책이 없고, 국공립대·국립대병원 55곳 중 AI 논문 작성 가이드라인을 갖춘 곳은 한밭대·충남대·한국체육대 단 3곳뿐이다.
애초에 기준선이 없다

더 깊은 문제는 따로 있다. 애초에 기준선이 없다는 점이다. 한국대학교육협의회 집계로는 전국 131개 대학 가운데 101곳, 그러니까 77.1%가 생성형 AI에 대한 공식 정책을 아직 세우지 않았다. 김준혁 의원실이 받은 자료를 봐도, 국공립대와 국립대병원 55곳 중에서 AI를 이용한 논문 작성 가이드라인을 갖춘 곳은 국립한밭대·충남대·한국체육대 단 세 곳뿐이었다. 서울대마저도 AI 윤리 가이드라인 TF를 돌리는 단계일 뿐, 확정된 기준은 아직 없다.

가이드라인이 없다는 건 단순히 '써도 되는지 안 되는지'가 안 정해졌다는 뜻이 아니다. 어디까지가 도구 활용이고 어디부터가 부정행위인지, 그 경계 자체를 학생마다 다르게 상상하고 있다는 뜻이다. 한 학생은 이 혼란을 정확히 짚었다. "과제에서 AI를 쓰는 건 관행이지만, 시험에서 쓰는 건 명백한 부정이다." 학생들은 스스로 선을 긋고 있다. 그런데 학교는 그 선을 문서로 확정해 주지 못하고 있는 셈이다.

대학들이 판을 다시 짜는 세 갈래

대학들은 적발·처벌의 쳇바퀴에서 벗어나 평가 방식을 구술·경험 기반으로 다시 설계하고, 금지 대신 AI를 개방하며 사용법을 교육하고, 명문화된 가이드라인 기준선을 만드는 세 방향으로 움직인다.
판을 다시 짜는 세 갈래

적발과 처벌의 쳇바퀴에서 벗어나려는 대학들의 움직임은, 크게 세 방향으로 모인다.

첫째, 평가 방식 자체를 바꾼다. AI가 대신 써줄 수 없는 형태로 시험을 다시 설계하는 것이다. 일부 교수는 대면·화상 구술시험이나 개인의 경험에 기댄 과제를 대안으로 제시한다. 정해진 정답을 묻는 필기시험은 AI에 쉽게 뚫린다. 반면 학생 본인의 목소리와 맥락, 즉석에서 생각하는 힘을 요구하는 평가는 상대적으로 단단하다. 실제로 손으로 코드를 쓰게 했더니 학생 개인의 수준이 명확히 드러났다는 이공계 조교의 증언도 있다. '무엇을 아는가'가 아니라 '어떻게 생각하는가'를 묻는 쪽으로 옮겨가는 것이다.

둘째, 금지 대신 개방과 교육으로 방향을 튼다. 일부 수업은 시험에서 인터넷과 AI 도구를 아예 열어준다. 대신 문제의 난도와 성격을 끌어올린다. AI를 써도 결국 스스로 사고해야 풀리는 수준으로 말이다. 여기에 "AI 사용법을 정규 커리큘럼으로 가르쳐야 한다"는 요구도 붙는다. 윤리적으로 쓰는 법, 출처를 밝히는 법, 어디까지 활용할지의 범위를 정식으로 교육하자는 것이다.

셋째, 명문화된 기준선을 만든다. TF를 꾸리고 가이드라인을 문서로 확정하는 흐름이다. 송기창 숙명여대 명예교수는 그 방향을 이렇게 정리했다.

"변화된 사회에서 AI 사용은 피할 수 없지만, AI만 쓰다 보면 사고력이 떨어지는 면이 분명히 있다. 창의적인 영역에서는 학생 고유의 능력이 발휘돼야 하고, 출처를 어디까지 표기하고 어디까지 활용할지에 대한 사회적 합의가 필요하다."

— 송기창 숙명여대 명예교수

결국 다시 쓰이는 것은 '평가의 정의'

핵심은 AI를 어떻게 막느냐가 아니다. 시험은 '무엇을 아는가'에서 '어떻게 생각하는가'로 옮겨가고 있으며, 막는 데 매달릴수록 지는 만큼 바꿔야 할 것은 시험이 무엇을 측정해야 하는가라는 질문이다.
바뀌는 것은 평가의 정의

이번 사태가 진짜 드러낸 건 결국 시험의 정의다. 막는 게임은 이미 방어하는 쪽이 지고 있다. 지금 대학들이 다시 짜고 있는 것은 시험이 대체 무엇을 측정해야 하는가, 그 정의 자체다.

AI가 답을 대신 내주는 시대다. 그렇다면 시험은 이제 어떤 능력을 재야 하는가. 이 질문에 답하지 못하는 한, 아무리 새로운 탐지 도구를 갖다 붙여도 다음 학기에 똑같은 일이 반복될 것이다.

감독 카메라를 늘리는 학교가 있고, 시험 문제를 새로 쓰는 학교가 있다. 앞으로 몇 년, 이 두 갈래가 벌려 놓을 격차가 대학 교육의 신뢰도를 가를 가능성이 크다.

출처 · 참고

참고 문헌

이미지 출처