나라장터 AI 경진대회, 고정 LLM으로 24개 법령 항목을 판정하는 방식 | DAKER 커뮤니티

리더보드 순위만 보면 익숙한 AI 대회처럼 보이지만, 이 대회는 접근 방식부터 다릅니다. 모델을 새로 학습해 올리는 자리가 아니라, 정해진 LLM 위에서 법령 위반 여부와 판단 근거를 함께 뽑아내는 추론 파이프라인을 설계하는 대회이기 때문입니다.
2026년 9월 10일(목) 아침 기준으로 나라장터 자체입찰 공고 법령 위반사항 모니터링 AI 경진대회의 공식 개요와 공개 리더보드를 다시 보면, 이 대회의 핵심은 점수 경쟁보다 과제 구조에 더 분명하게 드러납니다.
왜 이 대회가 눈에 띄는가
나라장터(국가종합전자조달시스템)에는 수요기관이 직접 발주하는 자체입찰 공고가 상시 게시됩니다. 이런 공고는 국가계약법령 등 관련 법령과 규정에 맞아야 하지만, 실제 검토는 공고문 본문만으로 끝나지 않습니다. 과업지시서·규격서 같은 첨부 문서와 나라장터 메타데이터까지 함께 봐야 하므로 담당자의 수작업만으로 전체 공고를 상시 점검하기는 어렵습니다.
특히 입찰 참가자격의 부당한 제한처럼 공정한 경쟁을 해칠 수 있는 위반은 빠르게 선별할 필요가 있습니다. 그래서 이 대회는 위반 소지가 있는 공고를 자동으로 검토하고, 왜 그렇게 판단했는지 근거까지 제시하는 모델 개발을 과제로 둡니다.
이 대회의 주제는 나라장터 자체입찰 공고의 법령 위반사항 판정과 판단 근거 제시 AI 모델 개발입니다.
참가자가 실제로 만들어야 하는 것
참가자가 만드는 산출물은 한마디로 추론 파이프라인입니다. 입찰공고 1건, 즉 공고문과 첨부 문서 텍스트, 나라장터 등록 정보를 입력받아 24개 검토 항목마다 법령 위반 여부(0/1)와 위반으로 판단한 근거 문구를 출력해야 합니다.
24개 항목 가운데 23개는 국가계약법령·지방계약법령·중소기업제품 판로지원법령·소프트웨어진흥법령 등 관련 법령·예규·고시에 근거합니다. 24번 항목만 공고서 내용과 나라장터 등록값의 일치 여부를 점검합니다. 항목별 정의와 근거 조문은 대회 데이터 항목표에 제시되어 있습니다.
고정 LLM 위에서 경쟁하는 코드 제출 대회
이 대회는 모델 가중치를 새로 학습해 제출하는 방식이 아닙니다. 평가 서버에 준비된 고정 LLM google/gemma-4-26B-A4B-it를 모든 참가자가 동일하게 사용합니다. 보조 임베딩 모델 BAAI/bge-m3도 서버에 함께 제공됩니다.
파인튜닝(LoRA·QLoRA 등)과 모델 가중치·어댑터 제출·로드는 허용되지 않습니다. 학습용 라벨 데이터셋도 제공되지 않습니다. 대신 무라벨 공고 20,000건과 라벨 예시 200건(dev)이 주어지며, 학습·검증에 필요한 라벨은 참가자가 직접 만드는 자가 라벨링 방식입니다.
모델을 바꾸는 대회가 아니라, 고정 LLM 위에서 어떻게 추론 파이프라인을 설계하느냐를 겨루는 구조입니다.
제출 방식은 submit.zip 업로드의 코드 제출 대회입니다. 제출된 코드는 평가 서버에서 실행되어 비공개 평가 데이터에 대해 추론합니다. 추론 실행 제한시간은 2시간이고, 1일 최대 제출은 1회입니다. 제출 후 점수가 바로 보이지 않을 수 있어 공식 평가 탭의 채점 대기시간 안내를 확인하는 것이 좋습니다.
평가 방식과 최종 선정 구조
리더보드 산식은 Macro F1입니다. 24개 검토 항목 각각에서 위반(=1) 클래스 F1을 구한 뒤 단순 평균합니다. 리더보드에는 위반 여부 열(v1~v24)만 반영되고, 근거 문구 열(e1~e24)은 2차 정성평가 재료로 보존됩니다.
Public Score는 전체 테스트 데이터 1,853건 100%이며, Private Score는 대회 종료 시점의 Public Score입니다. 1차 평가는 Private 리더보드 기준 상위 15팀을 2차 평가로 보냅니다. 2차 평가는 재현 검증과 근거 문구 정성평가를 진행하고, 정량 80%와 정성 20%를 종합해 최종 상위 7팀을 수상팀으로 선정합니다.
개요 카드 상금은 4,200만 원입니다. 주최는 행정안전부·한국지능정보사회진흥원, 주관은 조달청, 운영은 데이콘입니다. 참가 자격은 대한민국 국민 누구나이며, 팀 최대 인원은 5명입니다.
근거 문구 평가에서 특히 중요한 점
이 대회는 공개 리더보드 점수만으로 끝나지 않습니다. 근거 문구는 제공 원문의 부분문자열이어야 하며, 요약·수정·생성된 문구는 2차 자동 검증에서 무효가 될 수 있습니다.
또한 부재탐지형 5개 항목(10·11·16·18·20번)은 있어야 할 기재가 없는 것이 위반이므로 인용할 원문이 없습니다. 이 5개 항목은 정성평가 대상에서 제외됩니다. 이 규칙은 개요와 평가 안내에 적힌 내용입니다.
나라장터 장은 고정 LLM 위 추론 파이프라인과 근거 문구 정성평가가 붙어 있는 법령 모니터링 장입니다.
2026년 9월 10일(목) 아침 기준 현황
오늘 아침 개요 카드의 참가자는 835명입니다. 어제(9월 9일) 스냅샷 807명보다 28명 많습니다. 종료까지 표시는 D-20입니다.
참가 신청 시작은 8월 18일, 온라인 사전 설명회는 8월 24일 14:00, 대회 시작은 8월 26일입니다. 다음으로 다가오는 날짜는 9월 23일 팀 병합 마감, 9월 29일 10:00 리더보드 제출 마감, 9월 30일 10:00 대회 종료입니다. 2차 평가 자료 제출 마감은 10월 5일, 2차 평가 및 검증 마감은 10월 15일, 최종 결과 발표는 10월 16일, 오프라인 시상식은 11월 27일(예정)입니다.
공개 리더보드 1위는 팀 테드(점수 0.76006, 제출 4)입니다. 어제와 같은 팀·같은 점수입니다. 다만 오늘 기준으로 더 중요한 포인트는 1위 교체 여부보다, 이 대회가 어떤 방식으로 문제를 정의하고 평가하는가에 있습니다.
함께 언급된 다른 대회와는 구분해서 볼 필요
나머지 장은 한 줄만 둡니다. 딥보이스 참가자 909명(어제 대비 +20)·공개 1위 팀 55(총점 0.87364, 제출 22). 블랙박스 참가자 816명(+23)·공개 1위 팀 화난다고그렇게운전을하시면어떡해요(제출 46). 2026 AI 에너지전환 컨퍼런스 참가 카드 96명·마감. 월간 해커톤 csafcas API 기준 참가자 239명(+15)·제출 0건. 현재 단계는 참가 접수 및 팀 빌딩이며, 해당 단계 종료는 9월 14일 오전입니다. 아이디어 기획서 제출 단계는 9월 14일부터이며, 기획서 기한은 9월 28일 오전입니다. 총 상금은 100만 원입니다.
딥보이스·블랙박스와 상금 카드 숫자는 같아도 과제는 다릅니다. DACON 코드 제출 대회와 DAKER 해커톤도 같은 방식의 대회로 읽지 않는 편이 좋습니다.
참고 자료
236754 개요
236754 리더보드
딥보이스 공식 페이지
블랙박스 공식 페이지
2026 AI 에너지전환 컨퍼런스 공식 페이지
월간 해커톤 csafcas
/api/hackathons/csafcas
이 대회에서 가장 까다로운 지점은 고정 LLM 제약, 자가 라벨링, 근거 문구 검증 가운데 어디라고 보시는지 궁금합니다.
