AI 자동 채점의 함정 — 부분 정답 구간에서 48개 결과 중 47개가 기준을 벗어난 이유
바이츠만 연구소와 ETS 연구진이 고교 생물 서술형 답안으로 AI 채점을 검증했다. 만점·빵점 답안은 사람만큼 정확했지만 4~7점 구간에서는 48개 결과 중 47개가 기준에서 두 범주 넘게 어긋났다.
핵심 내용 읽기 →AI TOPIC
교육AI 관련 핵심 뉴스와 활용 인사이트 2편을 최신순으로 모았습니다.

바이츠만 연구소와 ETS 연구진이 고교 생물 서술형 답안으로 AI 채점을 검증했다. 만점·빵점 답안은 사람만큼 정확했지만 4~7점 구간에서는 48개 결과 중 47개가 기준에서 두 범주 넘게 어긋났다.
핵심 내용 읽기 →
미시건주립대 연구진이 LLM 자동 채점 시스템을 상대로 프롬프트 인젝션을 실험했습니다. 실제 학생 답안 3천 건과 모델 5종에서 평균 56.9%가 뚫렸고, 방어 지시문은 위험을 줄일 뿐 없애지 못했습니다.
핵심 내용 읽기 →