"Agentic Science"가 궁금하다.

취사 선택한 최신 빅테크 블로그, 관련 논문, Github 자료를 바탕으로 Agentic Science의 10가지 동향과Agentic Science를 둘러싼 논쟁들을 정리해 봤습니다.

Agentic Science의 10가지 동향.

(1) 단순한 연구 보조 기능에서 연구의 전 과정을 자율적으로 수행하는 end-to-end 자율 연구 파이프라인을 구축 [4, 7, 9, 13, 15].

  • 과거의 AI가 인간의 지시에 따라 코드를 작성하는 수준에 머물렀다면, 최근의 AI 에이전트는 가설 수립, 실험 설계, 데이터 분석, 논문 작성 및 투고 준비까지 스스로 해결하는 수준으로 진화하고 있습니다.

(2) AI 에이전트의 실제 과학적 역량을 검증하기 위한 '도메인 특화 고난도 벤치마크'의 급격한 성장 [2, 5].

  • 생물정보학의 BioMysteryBench [2]나 첨단 물리학의 PRL-Bench [5] 등은 기존의 단순 질의응답식 평가를 벗어나 실제 연구 환경의 복잡한 데이터와 장기 추론 능력을 요구합니다.

(3) 에이전트가 스스로의 오류를 분석하고 성능을 개선하는 '지속적인 자아 진화 및 자율 개선 루프' 아키텍처의 등장 [4, 9, 15].

  • EvoMaster [4]나 GEPA [9]와 같은 프레임워크는 에이전트가 다회차 실행을 통해 가설을 수정하고 지식을 축적하도록 지원합니다.

(4) 특정 과학 분야의 전문 소프트웨어 및 데이터베이스를 LLM 에이전트와 결합하는 도메인 특화 도구 키트의 활성화 [7, 8, 12].

  • 천체물리학의 ASTER [8]나 계량경제학의 StatsPAI [7]는 복잡한 API와 모델을 에이전트가 직접 제어할 수 있도록 돕습니다.

(5) 과학 도표, 기호, 그래프 등 시각적 데이터를 정확히 해석하기 위한 과학 특화 다중모듈 모델의 등장 [10].

  • Innovator-VL [10]과 같은 모델은 고도의 시각적 인지 능력을 바탕으로 과학적 추론의 정확도를 높이고 있습니다.

(6) 에이전트가 자율적으로 코드를 실행함에 따라 발생할 수 있는 보안 위협을 방지하기 위한 '체계적인 보안 감사 및 안전성 검증'이 필수적인 절차로 인식 [7].

  • 저장소 내 스킬들과 파일에 대해 철저한 시스템 보안 스캔을 실시하여 악성 프롬프트나 백도어가 없는 안전한 상태임을 입증하여, 자율형 에이전트 도입 시 발생할 수 있는 보안 우려를 선제적으로 해결합니다. [7].

(7) 장기 자율성을 달성하기 위해 단기 실행 이력과 장기 전략을 분리하여 관리하는 계층적 인지 캐싱(HCC)의 도입 [11].

  • 계층적 인지 캐싱(HCC)은 에이전틱 사이언스의 가장 큰 걸림돌인 '초장기 자율성' 문제를 해결하는 구체적인 방법론입니다. [11].

(8) 수만 개의 과학 소프트웨어를 에이전트가 즉시 실행할 수 있는 형태로 자동 배포하는 인프라의 구축 [12].

  • 오픈소스 과학 소프트웨어를 에이전트가 즉시 사용할 수 있는 형태로 자동 배포하는 'Deploy-Master' 워크플로우는 수많은 과학 도구를 에이전트가 호출 가능한 컨테이너 형태로 변환함으로써 자율 연구의 실행 기반을 제공합니다. [12].

(9) 단일 에이전트의 한계를 극복하기 위해 여러 전문 에이전트들이 역할을 분담하고 상호 검증하는 다중 에이전트 협업 구조의 보편화 [11, 12, 15].

(10) 가상 공간의 시뮬레이션을 넘어 실제 실험실의 로봇 하드웨어와 연동하여 '설계-제조-시험-분석'의 루프를 완성하는 dry-wet 융합 연구의 실현 [13, 15].

  • Agentic Science를 실제 연구 현장에 적용하고 확장하기 위한 구체적인 플랫폼 아키텍처와 생태계 모델로서, 문헌 조사(Reading), 수치 계산(Computing), 실제 실험(Experiment) 단계를 통합합니다. [13].

Agentic Science를 둘러싼 논쟁들.

(1) 낙관 vs. 경고

  • AI 에이전트가 연구 비용을 획기적으로 절감하고 연구 속도를 가속화할 것이라는 관점
  • 에이전트가 그럴듯한 출판 가능한 결과들만 양산하여 과학계의 신뢰성을 떨어뜨릴 수 있다는 관점.

(2) 인간의 개입을 최소화 vs. 협업 강조

  • 완전 자율형 AI 과학자를 지향하는 관점
  • 협업 도구로서의 역할을 강조하는 시각.

(3) 유연함 vs. 엄격함

  • 생물정보학 분야에서는 실제 데이터의 노이즈를 극복하고 유연한 방법론적 경로를 인정하는 결과 중심
  • 이론 물리학 분야에서는 엄격한 기호 유도와 공식의 정확성을 요구.

(4) 모델 능력에 집중 vs. 환경 구축에 집중

  • 모델 자체의 지능과 추론 능력 향상에 집중하는 관점
  • 신뢰할 수 있는 실행 인프라와 도구 환경의 구축에 집중하는 관점.

(5) 선형적 누적 vs. 계층적 축적

  • 과거의 모든 실행 이력을 선형적으로 누적하거나 요약하는 전통적 방식
  • 경험을 지식과 지혜로 진화시켜 계층적으로 축적하는 인지 축적 방식.

(6) 멀티 에이전트들의 협력 vs. 비판과 경쟁

  • 에이전트 간의 유기적인 협력을 강조하는 협력적 관점
  • 에이전트 간의 상호 비판과 토론을 통해 오류를 잡아내는 경쟁적/토론적 관점.

(7) 도약 vs. 환각

  • 에이전트가 제안한 가설은 진정한 학술적 도약이라는 관점
  • 기존 학습 데이터의 정교한 보간이나 환각에 불과하다는 관점.

(8) 윤리적 측면

  • 과학 에이전트의 도입이 인간 연구자의 비판적 사고력을 약화시킬 수 있다는 교육적 우려
  • 과학 에이전트가 자율적으로 유해 물질이나 병원균도 발견할 수 있는 위험성에 대한 통제가 필요공유 게시물

참고문헌