LLM이 아직 과학자가 아닌 이유: 자율 연구 에이전트에서 반복 관찰된 여섯 가지 실패 유형
아이디어 발상부터 논문 작성까지 맡긴 멀티 에이전트 실험에서 네 개 주제 중 하나만 완주했다. 연구진은 학습 데이터 편향과 구현 표류, 과장 습관 등 여섯 가지 실패 유형을 정리해 공개했다. 심사자 역할을 맡겼을 때도 같은 문제가 반복됐다.
핵심 내용 읽기 →AI TOPIC
연구 자동화 관련 핵심 뉴스와 활용 인사이트 9편을 최신순으로 모았습니다.

아이디어 발상부터 논문 작성까지 맡긴 멀티 에이전트 실험에서 네 개 주제 중 하나만 완주했다. 연구진은 학습 데이터 편향과 구현 표류, 과장 습관 등 여섯 가지 실패 유형을 정리해 공개했다. 심사자 역할을 맡겼을 때도 같은 문제가 반복됐다.
핵심 내용 읽기 →
미국 천문 연구기관 세미나에서 공개된 오픈소스 AI 연구 조수 Quasar를 정리했다. 자연어 질문의 의도와 복잡도를 판정해 아카이브·문헌·분석 에이전트에 나눠 맡기고, 사용한 질의문까지 그대로 보여주는 구조를 살펴본다.
핵심 내용 읽기 →
챗봇 복붙에서 벗어나 스스로 코드를 실행하고 오류를 고치는 AI 에이전트를 연구에 활용하는 법, 규칙 파일과 스킬·MCP의 역할, 그리고 실제로 겪은 실패 패턴과 인간 연구자가 맡아야 할 역할을 정리했다.
핵심 내용 읽기 →
AI가 예측 모델에 머물지 않고 논문을 읽고 코드를 실행하며 다음 실험까지 설계하는 실행 주체로 넘어갔다. 튜링 포스트가 정리한 과학 에이전트의 가속 폭과, 생물학이 여전히 사람의 시간에 묶여 있는 이유를 짚었다.
핵심 내용 읽기 →
토론토대 알란 아스푸루구지크 교수가 MIT 울프 강연에서 화학 연구실 전체를 AI 에이전트로 전환한 1년 반의 기록을 공개했다. 박사급 협업자 수준에 도달한 과학 에이전트의 설계 원리와 비용, 안전 문제를 정리했다.
핵심 내용 읽기 →
제시 후글란드가 새 AI 정렬 연구 조직 레졸루션의 출범을 알렸다. 여러 이론적 접근을 병렬로 굴리는 연합 구조와 연구 자동화에 1억 6천만 달러를 걸었고, 학습 이론과 확장 가능한 감독을 첫 갈래로 채용을 시작했다.
핵심 내용 읽기 →
서울대 DSBA 연구실 스터디가 연구 워크플로 자체를 자동화하는 '리서치 에이전트' 논문 두 편을 비교했다. 완전 자율을 노린 AI 사이언티스트와 사람이 개입하는 에이전트 래버러토리의 결과를 통해, 지금의 병목은 생성이 아니라 검증이라는 결론을 짚는다.
핵심 내용 읽기 →
가장 많이 쓰는 '요약해줘'가 왜 가장 위험한 지시일까. 논문 8,700편을 닷새 만에 훑은 이제현 박사가 환각을 줄이는 발췌 지시와 자료를 넣기 전 확인할 것들, 그리고 속도 대신 검증에 시간을 남기는 원칙을 이야기한다.
핵심 내용 읽기 →
PDF 내려받기와 폴더 정리, 여러 앱 전환에 시간을 쏟는 대신 문헌 검토·자료 분석·발표 자료 생성을 한곳에서 처리하는 AI 연구 플랫폼 사이스페이스를 실제 사용 화면으로 살펴봅니다.
핵심 내용 읽기 →