AI TOPIC

벤치마크 최신 뉴스와 핵심 해설

벤치마크 관련 핵심 뉴스와 활용 인사이트 80편을 최신순으로 모았습니다.

AI 에이전트는 간접 프롬프트 인젝션에 얼마나 취약한가 — 20만 건 공개 대회가 남긴 것 영상 썸네일
AI Safety Poland

간접 프롬프트 인젝션 대회 결과 정리: AI 에이전트 공격 성공률과 모델별 취약점 비교

20만 건이 넘는 공격 시도를 모은 간접 프롬프트 인젝션 공개 대회 결과를 정리했다. 도구 사용과 코딩, 컴퓨터 사용 환경별 공격 성공률과 에이전트의 은폐 행동, 견고한 모델을 뚫은 공격이 다른 모델로 전이되는 현상, 가드레일 분류기의 한계까지 짚는다.

핵심 내용 읽기 →
"AI 능력보다 확산이 문제다" — 지식노동 전환을 다시 계산한 프린스턴 교수의 진단 영상 썸네일
Stanford Digital Economy Lab

AI 지식노동 전환은 왜 느린가 — 아르빈드 나라야난 스탠퍼드 강연 정리, 벤치마크 대신 신뢰성과 확산 병목을 보라

프린스턴대 아르빈드 나라야난 교수가 스탠퍼드 디지털경제연구소 강연에서 AI의 지식노동 전환은 수십 년 단위로 진행된다고 말했다. 벤치마크 정확도 대신 에이전트의 신뢰성과 확산 병목을 측정해야 한다는 주장과 함께, 개방형 평가 실험 결과도 소개됐다.

핵심 내용 읽기 →