Claude Code로 LLM Council 만들기, 파일 하나면 됩니다
여러 AI에게 같은 질문을 동시에 던져 답을 비교하고 싶은 분께 맞는 글입니다. 스킬 파일 하나와 서브에이전트로 만드는 방법, 그리고 반드시 확인할 비용까지 정리했습니다.
LLM 카운슬은 같은 질문을 여러 관점으로 동시에 검토시키는 구성이고, Claude Code에서는 스킬 파일 하나와 서브에이전트로 만들 수 있습니다. 다만 동시에 돌리는 만큼 토큰 비용이 늘어나니 중요한 결정에만 쓰는 편이 좋습니다.
이 결정에 대해 서로 다른 역할의 서브에이전트를 병렬로 돌려 검토해 줘. - 하나는 장점 위주로 검토 - 다른 하나는 문제점 위주로 검토 각자 결과를 요약해서 돌려주고, 두 결과가 어디서 갈리는지 정리해 줘. 최종 판단은 내가 할 수 있게 근거만 정리해 줘.
LLM 카운슬은 여러 AI 모델에게 같은 질문을 동시에 던지고, 나온 답을 서로 비교하거나 합의를 끌어내는 구성입니다. 한 모델의 답을 그대로 믿는 대신, 여러 관점을 모아서 판단을 보강하는 방식입니다.
이름은 Andrej Karpathy가 제안한 'Council of LLMs'라는 개념에서 따온 것으로 알려져 있습니다. 이 글은 이 구성을 Claude Code에서 만들어 보고 싶은 분을 위한 글입니다.
왜 여러 모델에게 동시에 물어보나요
모델 하나에만 물어보면 그 모델이 갖고 있는 편향이나 실수를 그대로 받아들이게 됩니다.
저도 처음엔 "어차피 다 비슷한 답 아닌가" 생각했습니다. 그런데 설계나 보안 검토 같은 구조적 결정을 여러 모델에 동시에 물어보니, 서로 놓친 부분을 짚어주는 경우가 있었습니다.
다만 이건 만능이 아닙니다. 여러 모델이 똑같이 틀리는 경우도 있고, 답이 갈리면 결국 사람이 최종 판단을 해야 합니다.
스킬 파일 하나 만들기
Claude Code의 스킬(Skill)은 이름이 붙은 폴더 하나와 그 안의 SKILL.md 파일 하나로 구성됩니다.
공식 문서에 따르면 이 파일에 이름과 설명, 실행 절차를 평문으로 적어 두면 그 순간부터 슬래시 명령어(/명령어이름)로 호출할 수 있습니다. 별도 서버나 프레임워크가 필요 없다는 뜻입니다.
서브에이전트로 동시에 돌리기
여러 모델을 동시에 부르는 부분은 서브에이전트(하위 작업) 구조로 처리합니다. 공식 문서는 "메인 대화가 하위 작업을 병렬로 여러 개 띄우고, 각자 자기 컨텍스트(작업 공간)에서 처리한 뒤 요약만 돌려준다"고 설명합니다.
이 구조를 이용하면 "같은 질문을 여러 관점으로 검토해서 보고해줘" 같은 지시 하나로 여러 하위 작업을 동시에 돌릴 수 있습니다.
실제로 써본 결과 확인하기
저는 설계 방향을 정할 때 이 구성을 몇 번 써봤습니다. 하나는 "장점 위주로 검토", 다른 하나는 "문제점 위주로 검토"처럼 역할을 나눠 동시에 돌리면, 한 명(한 모델)에게 물었을 때보다 빠뜨리는 지점이 줄었습니다.
다만 매번 쓸 일은 아니었습니다. 짧은 질문이나 답이 뻔한 작업에는 오히려 시간과 비용만 늘었습니다.
비용부터 확인하세요
여기가 가장 중요합니다. 모델을 여러 개 동시에 부르면 그만큼 토큰(모델이 읽고 쓰는 단위) 비용도 같이 늘어납니다.
공식 문서는 여러 에이전트를 동시에 쓰는 기능에 대해 "일반 세션보다 약 7배 많은 토큰"을 쓴다고 명시하고 있습니다.
저는 이 구성을 중요한 결정 앞에서만 쓰고, 평소 작업에는 쓰지 않습니다. "아끼려고 여러 모델을 켰다가 더 많이 쓴다"는 말이 그대로 맞았습니다.
자주 하는 실수
여러 모델을 켜 두면 답이 더 좋아질 것 같지만, 그만큼 토큰 비용이 같이 늘어납니다. 짧은 질문이나 답이 뻔한 작업에 쓰면 시간과 비용만 늘었습니다. 방향이 여러 개로 갈릴 만한 결정에만 쓰세요.
여러 모델이 똑같이 틀리는 경우도 있습니다. 답이 갈리면 결국 사람이 최종 판단을 해야 하므로, 합의가 나왔다는 이유만으로 그대로 믿지 않습니다.
자주 묻는 질문
꼭 여러 모델을 섞어야 하나요?
아닙니다. 클로드 안에서 역할을 나눈 서브에이전트만으로도 같은 효과를 어느 정도 낼 수 있습니다. 다른 회사 모델을 실제로 섞으려면 각 모델의 API 키와 별도 설정이 필요합니다.
비용이 얼마나 늘어나나요?
정확한 배수는 무엇을 몇 개 동시에 돌리느냐에 따라 다릅니다. 공식 문서에 명시된 참고값은 에이전트 팀 기능이 일반 세션 대비 약 7배라는 것뿐이라, 그 이상의 정확한 수치는 확인이 필요합니다.
매번 이렇게 써야 하나요?
아닙니다. 저는 방향이 여러 개로 갈릴 만한 결정에만 씁니다. 답이 분명한 작업에는 그냥 한 번만 물어봅니다.
정리
파일 하나로 새 명령어를 만들 수 있다는 것은 사실입니다. 다만 그 안에서 모델을 여러 개 동시에 돌리는 순간부터는 비용을 따로 계산해야 합니다.