Cogentic: Multi-Agent Orchestration for Automated Proof Discovery

논문 번호
1157
분야
Research

이 논문은 여러 증명 에이전트와 검증 에이전트를 경쟁시키는 오케스트레이션으로, 아무도 풀지 못한 공개 연구 문제에서 새 수학 결과를 뽑아냈다.

이 논문은 한마디로 미해결 수학 문제를 여러 LLM 에이전트가 나눠서 공략하고 서로 검증하게 만든 멀티에이전트 하네스다. 오케스트레이터가 서로 다른 증명 방향에 증명자들을 배치하고, 적대적 검증자들이 초안을 뜯어본 뒤, 확인된 중간 결과는 '검증 원장'에 쌓아 다음 라운드의 발판으로 쓴다. Gemini를 기반으로 온라인 학습·경매 이론·메커니즘 설계의 열린 문제 5개에서 새로운 결과를 냈고, 전문가 검증도 통과했다. 문제당 대략 100~1000회 호출의 적은 추론 예산으로 이를 달성한 점이 인상적이다.

핵심 요약

  • 단발 생성으로는 안 풀리는 열린 문제를 증명-검증 반복 루프로 풀었다.
  • 확인된 중간 결과를 영구 원장에 축적해 장기 작업에서 진도를 잃지 않게 했다.
  • 온라인 학습, 경매 이론, 메커니즘 설계의 공개 문제 5개에서 새 결과를 냈고 도메인 전문가 독립 검증을 통과했다.
  • 검증자를 '틀렸다고 가정하고 시작하는' 적대적 구성으로 둬 초안의 허점을 잡아냈다.
  • 문제당 O(100)~O(1000) 호출 수준의 비교적 낮은 추론 예산으로 돌아간다.

논문 링크

외부 연구를 정리한 자료입니다. HDATF가 발표한 논문이나 제품 성능을 측정한 결과는 아닙니다.

원문 보기 (새 탭에서 열림)