긴 과제에서 서브에이전트와 스킬 패키지를 어떻게 비교할까 | DAKER 커뮤니티

대표 이미지

긴 과제를 다루는 에이전트 설계에서는 무엇을 재사용할지 못지않게, 그 지식을 어떻게 불러와 실행할지가 중요해집니다. 2026년 9월 10일 arXiv에 공개된 Subagents vs Agent Skills 논문은 바로 이 지점을 묻습니다. 영문 제목은 Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks이며 arXiv 번호는 2609.09233입니다.

이 글은 제공된 초록과 정리된 사실 범위만 바탕으로, 긴 과제에서 스킬 패키지를 메인 컨텍스트에 적재하는 방식과 서브에이전트로 호출하는 방식을 어떻게 구분해 볼 수 있는지 정리합니다. 점수나 외부 저장소 주소처럼 초록에 없는 내용은 덧붙이지 않습니다.

논문이 던지는 질문

초록은 언어모델 에이전트가 긴 과제에서 재사용 지식 라이브러리를 어떻게 효과적으로 활용하는지 묻습니다. 여기서 에이전트 스킬은 특정 과제를 돕는 재사용 능력이며, 지시·스크립트·기타 자원을 담은 멀티파일 번들인 skill package로 설명됩니다.

재사용 지식의 효과는 내용 자체뿐 아니라 그것을 조직하고 호출하는 방식에도 달려 있습니다.

저자는 Piriyakulkij, Wasu Top, Lawrence, Rachel, Curth, Alicia, Karmalkar, Sushrut, Prasad, Niranjani입니다. 이 글에서는 논문 초록이 말하는 범위를 벗어나지 않고, 비교의 핵심만 옮깁니다.

왜 스킬 적재만으로는 부족할 수 있을까

초록에 따르면 전형적인 실행 방식은 스킬 지시를 에이전트의 메인 컨텍스트에 넣고 따르게 하는 것입니다. 문제는 과제 지평이 길어질수록 컨텍스트 창에 정보가 계속 쌓이고, 그 결과 추론 품질이 떨어질 수 있다는 점입니다.

긴 과제에서는 메인 컨텍스트에 정보가 누적되면서 추론 품질이 저하될 수 있습니다.

이 지적은 스킬이 쓸모없다는 뜻이 아닙니다. 초록이 말하는 것은 긴 지평의 과제에서, 스킬을 단순히 컨텍스트에 적재하는 방식이 취약해질 수 있다는 점입니다. 따라서 비교의 초점은 스킬의 유무가 아니라, 스킬을 어떤 실행 구조로 연결하느냐에 놓입니다.

서브에이전트 호출은 무엇이 다른가

초록이 제시하는 대안은 스킬 패키지를 서브에이전트로 호출하는 방식입니다. 이 경우 스킬 지시를 메인 컨텍스트에 직접 쌓지 않고, 개별 서브태스크를 풀기 위한 새 컨텍스트 창을 사용합니다.

논문 초록은 특히 두 조건을 강조합니다. 스킬 패키지가 명확한 입출력 계약을 드러내고 있어야 하며, 지시문은 그 계약을 이행하는 절차 지식을 담고 있어야 합니다. 이런 조건이 맞을 때 서브에이전트 실행이 에이전트-스킬 실행을 능가한다고 설명합니다.

명확한 입출력 계약과 절차 지식이 있을 때, 서브에이전트 실행은 스킬 적재 실행보다 유리할 수 있습니다.

성능만이 아니라 비용도 함께 봐야 한다

초록은 서브에이전트 실행의 장점만 말하지 않습니다. 메인 에이전트와 서브에이전트 사이의 조율에는 추가 통신 비용이 들고, 이를 위해 추가 토큰이 필요하다고 적습니다.

따라서 이 논문을 서브에이전트의 일방적인 승리로 읽는 것은 맞지 않습니다. 초록이 남기는 메시지는 조건부 우위와 트레이드오프입니다. 어떤 방식이 더 적합한지는 과제 길이, 계약의 명확성, 그리고 조율 비용을 함께 놓고 봐야 합니다.

서브에이전트 실행에는 추가 통신 오버헤드가 따릅니다.

이 글에서 분명히 선을 긋는 부분

이 글은 서브에이전트가 모든 긴 과제에서 더 낫다고 주장하지 않습니다. 초록은 계약과 절차 지식이라는 조건 아래에서의 우위를 말합니다.

또한 에이전트 스킬이 무의미하다고 말하지도 않습니다. 초록이 지적하는 것은 긴 과제에서 컨텍스트 적재 방식이 취약해질 수 있다는 점입니다.

마찬가지로 통신 오버헤드가 무시할 만하다고 보증하지 않습니다. 초록은 추가 토큰 비용을 분명히 언급합니다. 이 글은 arXiv 2609.09233 초록 안내이며, DAKER나 DACON의 공식 공지가 아닙니다.

문서화할 때 구분해 두면 좋은 기준

초록의 핵심을 실무 문서로 옮긴다면, 스킬의 내용과 호출 방식을 한 문장으로 뭉개지 않는 편이 좋습니다. 스킬 패키지 자체에는 지시·스크립트·자원이 들어가고, 별도로 입출력 계약이 정리되며, 또 별도로 호출 방식이 정리되어야 비교가 가능합니다.

이렇게 나누어 두면 긴 과제에서 실패가 났을 때 원인을 더 분명하게 볼 수 있습니다. 스킬 내용이 부족한 것인지, 계약이 모호한 것인지, 아니면 메인 컨텍스트 적재와 서브에이전트 호출 중 어떤 실행 구조가 문제였는지 구분하기 쉬워집니다.

스킬 내용, 입출력 계약, 호출 방식은 분리해서 기록할수록 비교가 선명해집니다.

참고 자료

DAKER 커뮤니티
DACON
https://daker.ai/public/hackathons
https://daker.ai/public/rankings
https://daker.ai/public/learning/tracks

긴 과제를 다룰 때 여러분은 스킬 적재와 서브에이전트 호출을 어떤 기준으로 나누어 보고 계신가요?