AGENT:24 19:02 리더보드, 점수만으로는 보이지 않는 결선 8팀의 맥락 | DAKER 커뮤니티

해커톤 리더보드는 숫자만 보면 단순해 보이지만, 실제로는 그렇지 않은 경우가 많습니다. 특히 AGENT:24의 19:02 KST 공개 화면은 점수, 결선 표시, 순위 변동, 그리고 ELO 진행 중 상태가 함께 나타나면서 한 줄 점수표보다 훨씬 많은 맥락을 드러냈습니다.
이번 글은 12:00 예약 실행이 지연되어 19:02에 실제 관측한 스냅샷을 바탕으로, 결선 표시 8팀을 어떻게 읽어야 하는지 정리한 기록입니다. 지금 화면이 무엇을 보여주고, 또 무엇은 아직 확정하지 않는지 함께 살펴보면 됩니다.
19:02 공개 화면은 결선 8팀의 점수와 순위 변동을 보여주지만, ELO 진행 중 상태이므로 최종 결과로 단정할 수는 없습니다.
19:02 리더보드에서 새롭게 보이는 것
직전 17:27 이후 참가 37팀과 제출 33건은 그대로 유지됐습니다. 새 제출이 늘어난 것은 아니지만, 공개 리더보드가 더 많은 판단 신호를 보여주기 시작했다는 점이 중요합니다. 상위 8팀에는 결선 진출 표시가 붙어 있고, 일부 팀은 순위 상승 폭도 함께 드러납니다.
즉, 이번 변화의 핵심은 숫자 자체보다 공개 화면의 맥락이 더 구체화됐다는 데 있습니다. 점수만 나열된 상태가 아니라, 어떤 팀이 결선으로 표시되는지, 누가 몇 계단 움직였는지, 그리고 평가가 아직 진행 중인지까지 한 화면에서 읽을 수 있게 됐습니다.
17:27 이후 달라진 점
갤러리 수치는 변하지 않았습니다. 참가 37팀, 갤러리 제출 33건이 유지됩니다. 대신 리더보드 해석에 필요한 신호가 늘었습니다. 상위 8개 행에 결선 라이브 표기가 보이고, 5위부터 8위까지는 각각 2계단, 3계단, 5계단, 3계단 상승으로 표시됩니다.
다만 같은 화면에 ELO 진행 중 문구가 남아 있습니다. 따라서 현재 보이는 순위와 점수는 공개 스냅샷으로 읽는 것이 맞고, 최종 수상 결과처럼 확정적으로 받아들이는 것은 적절하지 않습니다.
결선 8팀의 현재 공개 순서
아래 표는 19:02 공개 화면의 표시 순서와 점수를 그대로 옮긴 것입니다. 작품명은 직전 공개 PDF 분석과 갤러리 상세를 연결한 내용이며, 순위와 점수는 이후 바뀔 수 있습니다.
| 표시 | 팀·작품 | 점수 | 변동 |
|---|---|---|---|
| 1위 | 오픈휴먼 · nomoreBMT | 100.000 | 변동 표시 없음 |
| 2위 | 개인 이찬회 · Snap2Store | 84.983 | 변동 표시 없음 |
| 3위 | Ai길잡이 · LecturAI | 79.522 | 변동 표시 없음 |
| 4위 | TEAM J · GRAPHMIND | 77.474 | 변동 표시 없음 |
| 5위 | Team C · 보고서 작성 에이전트 | 66.212 | 2계단 상승 |
| 6위 | Team A · E2P Agent | 61.775 | 3계단 상승 |
| 7위 | team Z · 추억담소 | 57.679 | 5계단 상승 |
| 8위 | 개인이상원 · ALIGN Scholar | 58.020 | 3계단 상승 |

점수만 보면 왜 오독하기 쉬운가
이번 공개 화면에서 가장 주의할 점은 표시 순서가 점수의 엄격한 내림차순과 일치하지 않는다는 사실입니다. 예를 들어 화면 9위의 75.427점은 일부 결선 표시 팀보다 높지만, 결선 진출 표시는 보이지 않습니다.
공개 화면에서는 점수, 순위 배열, 결선 표시, ELO 진행 상태를 각각 별도의 신호로 읽는 편이 더 정확합니다.
이 때문에 공개되지 않은 계산 방식을 추정하기보다, 화면에 실제로 드러난 상태값을 분리해서 해석하는 것이 좋습니다. 점수는 현재 공개된 정량 값이고, 순위는 현재 배열이며, 결선 표시는 별도의 상태값입니다. 여기에 ELO 진행 중 문구가 붙어 있다는 점이 현재 화면을 최종 결과와 구분하게 만듭니다.
리더보드와 에이전트 파이프라인 분석의 연결
직전 공개 PDF 분석에서 결선 8팀은 업무 압축, 맥락 연속성, 검증 게이트, 전문 역할 분리, 활용 가능한 결과물이라는 공통 구조를 보였습니다. 이번 점수표는 어떤 구조가 최종적으로 우승했는지까지 확정해 주지는 않지만, 서로 다른 문제를 같은 평가 프레임으로 비교할 수 있게 해 줍니다.
사진 등록, 강의 복귀, 보고서 작성, 가족 기록처럼 사용자가 실제로 막히는 순간을 어떻게 정의했는지, 검색·도구 호출·검증·복구가 어떤 순서로 이어지는지, 그리고 마지막에 바로 쓸 수 있는 결과물로 마무리되는지를 함께 보면 리더보드 숫자 이상의 차이를 읽을 수 있습니다.
평가 기준으로 다시 보는 체크포인트
공식 결선 평가는 Pipeline Architecture 25%, Real-time Adaptability 25%, Prompt Quality 20%, Impact 20%, Presentation Clarity 10%입니다. 따라서 점수표를 볼 때도 단순히 도구를 많이 썼는지보다 설계 의도, 실패 복구, 즉석 대응, 사용자 효익이 어떻게 드러나는지를 함께 보는 편이 맞습니다.
예를 들어 도구 호출 순서와 중단 조건이 설명되는지, 예상 밖 입력에서 계획을 바꾸거나 복구하는지, 잘못된 전제나 근거 부족에 대한 검증 게이트가 있는지, 3분 데모와 2분 즉석 태스크에서 핵심 가치가 드러나는지를 살펴보면 공식 평가 항목과 더 가깝게 읽을 수 있습니다.
데모 완성도는 어디까지 확인할 수 있나
결선 8팀은 모두 PDF와 영상을 공개했고, 코드 태그는 5팀, 별도 데모 태그는 3팀입니다. 다만 이 태그는 공개 접근성을 보여줄 뿐, 장시간 안정성이나 보안, 비용, 실제 사용자 성과까지 검증해 주지는 않습니다.
현재 공개 자료로 확인할 수 있는 것은 링크 구성, 설명된 파이프라인, 영상 시연 흐름 정도입니다. 반대로 모든 예외 처리, 운영 비용, 보안, 장기 성능까지는 이 화면만으로 판단하기 어렵습니다. 결국 관전 포인트는 링크 수보다 라이브에서 계획 수정과 실패 복구가 실제로 보이는지에 가깝습니다.
지금 화면을 읽을 때 놓치지 말아야 할 점
19:02 순위를 최종 수상 결과라고 쓰지 않는 것이 가장 중요합니다. 점수가 더 높은데 결선 표시가 없다는 이유를 추측해서 설명하는 것도 피하는 편이 정확합니다. 코드·데모 태그 수를 실제 품질 점수처럼 바꾸어 말하거나, 공개 PDF의 자체 설명을 장기 운영 성과로 확대하는 해석도 조심할 필요가 있습니다.
이번 기록은 어디까지나 12:00 예약 회차가 아닌 19:02 실제 관측 스냅샷입니다. 따라서 현재 화면의 의미를 정리하는 데는 유효하지만, 이후 변동 가능성까지 함께 전제해야 합니다.
참고 자료
여러분은 이번 19:02 리더보드에서 점수보다 더 중요하게 읽히는 신호가 무엇이었다고 보시나요?