AI 채점 정확도 35~65%, 케임브리지 연구팀이 학부생 에세이 761편으로 검증한 자동 채점의 한계
케임브리지 연구팀이 영국 대학 세 곳의 학부생 에세이 761편으로 AI 채점을 검증했다. 사람 채점자와 학점 구간이 일치한 비율은 35~65%에 그쳤고, 점수를 분포 가운데로 몰아넣고 글의 겉모습에 반응하는 편향이 함께 확인됐다.
핵심 내용 읽기 →AI TOPIC
AI채점 관련 핵심 뉴스와 활용 인사이트 3편을 최신순으로 모았습니다.

케임브리지 연구팀이 영국 대학 세 곳의 학부생 에세이 761편으로 AI 채점을 검증했다. 사람 채점자와 학점 구간이 일치한 비율은 35~65%에 그쳤고, 점수를 분포 가운데로 몰아넣고 글의 겉모습에 반응하는 편향이 함께 확인됐다.
핵심 내용 읽기 →
바이츠만 연구소와 ETS 연구진이 고교 생물 서술형 답안으로 AI 채점을 검증했다. 만점·빵점 답안은 사람만큼 정확했지만 4~7점 구간에서는 48개 결과 중 47개가 기준에서 두 범주 넘게 어긋났다.
핵심 내용 읽기 →
미시건주립대 연구진이 LLM 자동 채점 시스템을 상대로 프롬프트 인젝션을 실험했습니다. 실제 학생 답안 3천 건과 모델 5종에서 평균 56.9%가 뚫렸고, 방어 지시문은 위험을 줄일 뿐 없애지 못했습니다.
핵심 내용 읽기 →