The Memory Curse: How Expanded Recall Erodes Cooperative Intent in LLM Agents

발행일
출처
arXiv
논문 번호
187
분야
Agents / Memory / Multi-Agent
arXiv 번호
2605.08060

카네기멜런대학교와 FOCAL의 연구진은 사회적 딜레마 상황에서 대형 언어 모델 에이전트가 접근 가능한 메모리를 늘릴수록 협력 행동이 체계적으로 저하된다는 사실을 발견했으며, 이 현상을 '메모리의 저주'라 명명했다.

카네기멜런대학교와 FOCAL의 연구진은 사회적 딜레마 상황에서 대형 언어 모델 에이전트가 접근 가능한 메모리를 늘릴수록 협력 행동이 체계적으로 저하된다는 사실을 발견했으며, 이 현상을 '메모리의 저주'라 명명했다. 이 저하는 미래 지향적 의도의 약화에서 비롯되며, 장기적 사고를 우선하도록 모델을 미세조정함으로써 완화할 수 있다.

핵심 요약

  • 긴 기억이 협력을 촉진한다는 고전 게임 이론의 예측과, 과도한 인간의 기억이 협력을 저해할 수 있다는 행동심리학의 발견을 조화시키는 것이 문제다.
  • 상호작용 이력 길이의 변화가 LLM 멀티 에이전트 사회적 딜레마에서 협력에 어떤 영향을 미치는지에 대한 체계적이고 대규모적인 연구가 부재하다.
  • 기존 LLM 에이전트 연구는 종종 짧은 상호작용 지평을 사용하여, 이력 축적이 협력적 의도에 미치는 장기적 영향을 놓쳤을 가능성이 있다.
  • 7개의 LLM을 대상으로 4가지 반복 사회적 딜레마 게임에서 500라운드에 걸쳐 광범위한 실험을 수행하며, 접근 가능한 메모리 길이를 0라운드부터 80라운드까지 체계적으로 변화시켰다.
  • 378,000개가 넘는 사고 연쇄(Chain-of-Thought) 추론 추적을 어휘 분석으로 분석하여 미래 지향 대 피해망상이라는 전략적 의도를 정량화했다.
  • 표적화된 미세조정, 메모리 정화, 비대칭 메모리 실험을 수행하여 그 메커니즘을 인과적으로 규명하고 완화 전략을 개발했다.

논문 링크

외부 연구를 정리한 자료입니다. HDATF가 발표한 논문이나 제품 성능을 측정한 결과는 아닙니다.

원문 보기 (새 탭에서 열림)