AI와 민주주의 해커톤 정리: 공개 의견 조작, 안전장치 제거, 슬리퍼 에이전트 실험
주말 해커톤에서 연구자들이 직접 AI로 민주주의를 공격해 봤다. 1달러도 안 드는 공개 의견 대량 위조, 오픈 모델의 안전장치 제거, 선거일에만 깨어나는 슬리퍼 에이전트까지 상위 프로젝트 발표 내용을 정리했다.
핵심 내용 읽기 →AI TOPIC
허위정보 관련 핵심 뉴스와 활용 인사이트 5편을 최신순으로 모았습니다.

주말 해커톤에서 연구자들이 직접 AI로 민주주의를 공격해 봤다. 1달러도 안 드는 공개 의견 대량 위조, 오픈 모델의 안전장치 제거, 선거일에만 깨어나는 슬리퍼 에이전트까지 상위 프로젝트 발표 내용을 정리했다.
핵심 내용 읽기 →
사이언스에 실린 22인 공동 연구를 쓴 두 연구자가 설명하는 AI 스웜. 자율 조정과 자가 최적화로 가짜 합의를 만들고 AI 학습 데이터까지 오염시키는 구조, 탐지가 어려운 이유와 현실적인 대응책을 정리했다.
핵심 내용 읽기 →
노벨 경제학상 수상자 조지프 스티글리츠와 공저자가 게임이론 모형으로 AI가 정보 생태계에 미치는 영향을 분석했다. 붕괴 균형과 이를 막을 정책 수단을 짚었다.
핵심 내용 읽기 →
MIT 미디어랩 연구진이 만든 AI 에이전트 '개드플라이'는 사용자를 편들지 않고 방금 한 말의 허점을 파고드는 질문을 던진다. 수업 시연에서 드러난 가능성과 한계, 그리고 토론의 질을 높이려는 실험의 취지를 정리했다.
핵심 내용 읽기 →
X의 커뮤니티 노트는 평소 의견이 다른 사람들이 함께 도움이 된다고 평가한 메모만 노출하는 '브리징' 알고리즘으로 작동한다. 코드와 데이터가 공개돼 있고, 최근에는 AI가 초안을 쓰고 사람이 다듬는 협업으로 속도를 높이고 있다.
핵심 내용 읽기 →