RECONCILE 논문 설명: 여러 LLM이 토론하면 더 똑똑해질까?LLM을 더 잘 추론하게 만드는 방법은 크게 두 방향으로 발전해왔다. 하나는 모델이 스스로 생각을 정리하게 만드는 방식이다. 대표적으로 Chain-of-Thought, Self-Consistency, Self-Refine 같은 방법이 있다. 다른 하나는 여러 에이전트를 두고 서로 토론하게 만드는 Multi-Agent Debate 방식이다.그런데 기존 방식에는 한 가지 중요한 한계가 있다. 여러 에이전트를 쓴다고 해도, 실제로는 같은 모델을 여러 번 호출하는 경우가 많다는 점이다. 예를 들어 ChatGPT 인스턴스 3개가 서로 토론한다고 해도, 이들은 같은 학습 데이터와 같은 모델 구조에서 나온 응답을 생성한다. 겉으로는 토론처럼 보이지만..