독파모 2차 평가가 남긴 것: 벤치마크보다 실제 사용, 그리고 2027년 지원 재검토 | DAKER 커뮤니티
한 줄 답: 2026년 8월 18일 브리핑은 단순한 통과·탈락 소식으로 끝나지 않았습니다.
데이콘·DAKER 커뮤니티 기준으로 정리한 안내입니다.
2026년 8월 18일 브리핑은 단순한 통과·탈락 소식으로 끝나지 않았습니다. 벤치마크에서 앞섰다고 알려진 팀이 3차 진출 명단에서 빠졌고, 같은 자리에서 GPU 지원 확대와 2027년 지원 방식 재검토가 함께 나왔기 때문입니다.
이 세 문장을 같이 보면, 지금 준비해야 할 것이 무엇인지가 달라집니다. 누가 1등이었는지를 따지는 일보다, 국가 선발이 무엇을 점수로 봤는지 읽는 일이 더 중요해집니다.
순위표 없이 드러난 평가의 방향
과기정통부와 NIPA가 공개한 것은 팀별 종합 순위표가 아니라 2차 단계평가의 배점과 평균입니다. 남은 팀은 업스테이지, SK텔레콤, LG AI연구원이고, 빠진 팀은 모티프테크놀로지스입니다. 이 사실은 연합뉴스와 뉴시스가 같은 날 전했습니다.
2차 평가는 벤치마크 40점, 전문가 35점, 사용자 25점으로 구성됐습니다. 연합뉴스가 전한 평균은 벤치마크 22.5, 전문가 28.8, 사용자 17.6입니다. 1위와 4위의 차이는 벤치마크 4.0, 전문가 2.4, 사용자 5.0으로 공개됐습니다.
가장 큰 점수 차이는 사용자 평가에서 났고, 가장 작은 차이는 전문가 평가에서 났습니다.
뉴시스가 옮긴 과기정통부 설명에 따르면 항목마다 줄곧 1등을 한 기업은 없었습니다. 이 말은 곧, 한 항목의 우세만으로 다음 단계 진출을 설명할 수 없다는 뜻이기도 합니다.
특히 모티프 3은 아티피셜 애널리시스 AAII에서 47을 받았고, 뉴시스는 참여팀 사이에서 이 지표가 앞섰다고 전했습니다. 그런데도 종합 평가에서는 3차에 오르지 못했습니다. 팀별 세부 점수는 공개되지 않았지만, 적어도 한 가지는 분명합니다. 벤치마크에서 앞섰다는 사실만으로는 3차 진출이 보장되지 않았습니다.
왜 25점이 작아 보이지 않는가
사용자 평가는 25점이라 비중이 작아 보일 수 있습니다. 하지만 실제로 공개된 점수 차이는 이 항목에서 가장 크게 벌어졌습니다. 반대로 전문가 평가는 35점으로 더 크지만, 팀 간 격차는 2.4점에 그쳤습니다.
이 점은 활용성 평가를 어떻게 읽어야 하는지를 보여줍니다. 뉴시스는 모티프테크놀로지스에 대해 글로벌 벤치마크 같은 기술력에서는 평가가 높았지만, 배점이 더 큰 활용성에서는 다른 기업을 따라가지 못했다고 전했습니다. 여기서 활용성은 전문가 35점과 사용자 25점을 합친 축으로 읽힙니다.
벤치마크 한 항목이 전문가와 사용자 두 항목을 이기지 못했습니다.
결국 2차 평가는 모델의 성능 숫자만이 아니라, 실제로 누가 쓰는지, 어디서 쓰는지, 다시 써도 되는지를 함께 본 셈입니다. 포털 연계, 상용 서비스 탑재, 제조·세무 같은 현장 실증이 반복해서 언급된 이유도 여기에 있습니다.
이 구조에서는 한 번 보여 주는 시연보다 반복 사용 가능한 서비스 경로가 더 중요해집니다. 심사 직전에 급히 만든 화면보다, 실제 사용 기록이 쌓인 경로가 평가 문장으로 남기 쉽습니다.
남은 세 팀의 공통점은 벤치마크가 아니라 사용처
과기정통부가 공개한 자료에서 눈에 띄는 것은 팀별 점수보다 전문가위원회 평가 의견입니다. 뉴시스가 전한 내용을 보면, 업스테이지는 포털 다음과 타임리 연계, 퓨리오사AI NPU 협업이 언급됐습니다. SK텔레콤은 수리 추론과 한국어, 대규모 상용 서비스 탑재, 분야 특화 AX K1, 제조 산업 특화 에이전트 실증, 세무 분야 적용 가능성이 함께 적혔습니다. LG AI연구원은 국제기구 협업, 에이전틱 AI, 신뢰성 방법론, 지속가능성이 강조됐습니다.
세 팀의 문장에서 공통으로 먼저 나오는 것은 벤치마크 순위가 아닙니다. 포털, 상용, 제조, 세무, 국제기구, 에이전트, NPU처럼 실제 사용 환경과 운영 조건이 앞에 놓입니다.
모델 이름보다 붙는 서비스와 운영 맥락이 먼저 평가 문장에 들어갔습니다.
이 점은 3차의 세부 배점이 아직 공개되지 않았더라도, 2차가 어떤 방향을 물었는지는 이미 드러났다는 뜻입니다. 실제 사용과 현장 적용이 빠진 제출은 불리할 수밖에 없습니다.
GPU는 늘지만, 2027년 지원 방식은 다시 검토된다
브리핑에서 류제명 2차관은 3차를 예정대로 진행해 마지막 2팀을 고른다고 밝혔습니다. 동시에 2027년 그 2팀에 대한 지원 방식은 완전히 재검토 중이라고 했습니다. 뉴시스는 지금 같은 경쟁 방식에서 벗어나 프론티어 기업 모델에 버금가는 경쟁이 가능하도록 재편하는 방향의 공감대가 있다고 전했습니다.
바로 움직이는 자원은 GPU입니다. 상반기 B200 768장 수준에서 하반기 1000장 규모로 늘립니다. 뉴시스는 총 1200억 원 규모라고 적었습니다. 다만 GPU 확대와 2027년 지원 방식 확정은 같은 뜻이 아닙니다.
GPU는 늘었지만, 다음 해 지원 규칙은 아직 정해지지 않았습니다.
이 대목이 중요한 이유는 분명합니다. 3차 진출이 곧 다음 해 지원 구조의 확정을 뜻하지 않기 때문입니다. 결선은 예정대로 가지만, 결선 이후 어떤 방식으로 지원을 집중하거나 재편할지는 아직 열려 있습니다.
브리핑의 문제의식도 여기서 읽힙니다. 글로벌 프론티어 모델이 빠르게 올라가는 상황에서, 한정된 예산을 여러 곳에 나누는 방식이 최상위급 독자 모델 육성에 맞는지 다시 묻겠다는 취지입니다. 분산과 집중, 어떤 컨소시엄이 적절한지에 대한 질문이 남아 있습니다.
이 브리핑이 준비 방식까지 바꾸는 이유
이번 발표를 통과·탈락 기사로만 읽으면 놓치는 것이 있습니다. 2차 배점은 이미 공개됐고, 그 배점 아래에서 벤치마크에서 앞섰다고 알려진 팀이 탈락했습니다. 반대로 남은 팀들에 대해서는 실제 사용처와 운영 가능성이 평가 의견으로 남았습니다.
따라서 지금 필요한 것은 새 규칙이 나올 때까지 기다리는 일이 아니라, 이미 공개된 기준을 기준으로 제출의 빈칸을 확인하는 일입니다. 벤치마크 숫자, 활용 문장, 실제 사용 흔적 가운데 무엇이 비어 있는지를 먼저 보는 편이 맞습니다.
특히 3차 배점이 아직 없다는 사실은 준비를 늦추는 이유가 되기보다, 오히려 2차가 물었던 항목을 먼저 채워야 한다는 신호에 가깝습니다. 데모 한 번보다 반복 사용, 연구 노트보다 서비스 경로, 설명보다 사용 기록이 중요해졌다는 점은 이미 드러났습니다.
지원 규칙이 다시 쓰이기 전에 남는 제출은 이미 쓰이고 있는 제출입니다.
모티프테크놀로지스의 사례도 같은 방향을 가리킵니다. AAII 47이라는 숫자는 그대로 남아 있지만, 3차 진출 자격은 사라졌습니다. 이것은 벤치마크를 버리라는 뜻이 아니라, 벤치마크 위에 실제 사용 경로를 올려야 한다는 뜻으로 읽는 것이 자연스럽습니다.
아닌 것부터 분명히 해야 할 점
이번 결과를 두고 모티프테크놀로지스가 기술력이 부족해서 탈락했다고 말할 수는 없습니다. AAII 47은 참여팀 중 앞섰다고 보도된 숫자입니다. 반대로 남은 세 팀이 벤치마크에서 뒤졌다고 말할 수도 없습니다. 팀별 벤치마크 점수와 종합 순위는 공개되지 않았기 때문입니다.
또한 사용자 25점이 합격과 탈락을 혼자 결정했다고 단정하는 것도 과합니다. 공개된 사실은 이 항목의 점수 차가 가장 컸다는 점, 그리고 항목마다 1등이 달랐다는 점입니다. 종합 평가는 세 항목의 합으로 이뤄졌습니다.
2027년 재검토를 두고 3차 자체가 사라진다고 읽는 것도 맞지 않습니다. 3차는 예정대로 열리고, 마지막 2팀을 고릅니다. 다시 검토되는 것은 그다음 해의 지원 형태입니다.
결국 남는 한 문장
이번 브리핑이 남긴 가장 분명한 메시지는 단순합니다. 국가 선발은 벤치마크만으로 결정되지 않았고, 다음 단계로 갈수록 실제 사용과 운영 가능성이 더 중요해졌습니다.
벤치마크 1등만으로 국가 선발에 가지 못합니다.
GPU 1000장 확대 소식도 중요하지만, 더 오래 남는 문장은 2027년 지원 규칙을 다시 쓴다는 발표일 수 있습니다. 규칙이 바뀌는 구간에서는 점수 한 줄보다 사용 기록이 더 강한 제출이 됩니다.
참고 자료: 연합뉴스 — 독파모 LG·SKT·업스테이지 3파전, 모티프 탈락
뉴시스 — 2차 평가 통과와 활용성 평가(종합2보)
연합뉴스 종합2보
이번 브리핑에서 가장 크게 바뀐 기준은 무엇으로 보였는지, 여러분의 해석도 궁금합니다.