AI 채점 정확도 35~65%, 케임브리지 연구팀이 학부생 에세이 761편으로 검증한 자동 채점의 한계
케임브리지 연구팀이 영국 대학 세 곳의 학부생 에세이 761편으로 AI 채점을 검증했다. 사람 채점자와 학점 구간이 일치한 비율은 35~65%에 그쳤고, 점수를 분포 가운데로 몰아넣고 글의 겉모습에 반응하는 편향이 함께 확인됐다.
핵심 내용 읽기 →AI TOPIC
LLM 편향 관련 핵심 뉴스와 활용 인사이트 3편을 최신순으로 모았습니다.

케임브리지 연구팀이 영국 대학 세 곳의 학부생 에세이 761편으로 AI 채점을 검증했다. 사람 채점자와 학점 구간이 일치한 비율은 35~65%에 그쳤고, 점수를 분포 가운데로 몰아넣고 글의 겉모습에 반응하는 편향이 함께 확인됐다.
핵심 내용 읽기 →
국제 AI 안전·윤리 학회 IASEAI 2026 세션에서 연구자들은 대형언어모델이 제작자의 이념을 반영하고, 암기 탓에 자기 능력을 과대평가하며, 안전과 윤리 연구가 서로 단절돼 있다는 실증 결과를 내놨다.
핵심 내용 읽기 →
IASEAI 2026 학술대회의 인간 가치와 사회 규범 세션을 정리했다. 영상 진실성의 붕괴, 언어모델이 권위주의 인물을 롤모델로 제시하는 문제, 원칙에서 집행으로 넘어가는 AI 거버넌스와 보험 의무화 논의까지 다룬다.
핵심 내용 읽기 →