GLM-5.3은 아직 오픈 웨이트가 아니다, 8월 19일에 열린 것은 API 호출이다 | DAKER 커뮤니티
새 모델 소식이 쏟아질수록 무엇이 실제로 공개됐는지부터 가려 보는 일이 더 중요해집니다. 특히 API 공개와 가중치 공개는 전혀 다른 사건인데도 한 줄로 묶여 전달되는 경우가 많습니다.
이번 GLM-5.3도 마찬가지입니다. 2026년 8월 19일 즈히푸가 연 것은 공개 가중치가 아니라 API 호출입니다. 오늘 확인할 것은 내려받을 수 있는 웨이트가 아니라, 실제로 glm-5.3이라는 호출 이름이 열렸는지입니다.

모델 사양의 출처는 8월 14일 글입니다. z.ai GLM-5.3 블로그, 모델 문서, 가격표를 기준으로 봐야 합니다. 8월 19일은 그 모델의 API가 공개 호출로 열린 날입니다. 큐웬 2.4조 웨이트 공개나 딥시크 V4-Pro 정식과는 다른 사건입니다.
오늘 열린 것은 GLM-5.3의 공개 가중치가 아니라 API 호출입니다.
무엇이 실제로 나왔나
모델 아이디는 glm-5.3입니다. 베이스는 GLM-5.2와 같고, 즈히푸는 성능 이득이 후훈련에서 왔다고 적고 있습니다. 파라미터 수는 공개하지 않았습니다. 입력은 텍스트만이며, 이 문서 줄에는 비전이 없습니다.
컨텍스트는 100만 토큰, 최대 출력은 12만 8천 토큰입니다. 사고는 강제로 켜집니다. reasoning_effort는 low, high, max를 지원하고 기본값은 max입니다. thinking.type을 disabled로 두면 오류가 납니다. 즉, 이번 공개는 사고를 끄는 스위치가 열린 날이 아닙니다.
GLM-5.3은 호출할 수 있지만, 사고를 끄는 모드는 문서상 열려 있지 않습니다.
종량 가격은 GLM-5.2와 같습니다. 백만 토큰당 입력 1.4달러, 캐시 입력 0.26달러, 출력 4.4달러입니다. 캐시 입력 저장은 한시 무료로 적혀 있지만, 종료 날짜는 이 글의 출처에 없습니다. ZCode와 GLM Coding Plan에서도 사용할 수 있고, Coding Plan의 비피크 사용은 포인트의 50퍼센트입니다. 주말 전체가 포함되며, 피크는 월요일부터 금요일, UTC+8 14시에서 18시입니다.
프로토콜은 세 가지입니다. OpenAI Chat Completions, OpenAI Responses, Anthropic Messages입니다. 중국 주소는 https://open.bigmodel.cn/api/paas/v4, /api/v1, /api/anthropic입니다. 국제 주소는 https://api.z.ai/api/paas/v4와 코딩/paas, anthropic 경로입니다. 다만 예전 Coding Plan 구독 키는 현재 Chat Completions만 된다고 문서에 적혀 있습니다. 따라서 세 프로토콜이 모든 키에 열렸다고 보기는 어렵습니다.
벤치마크 수치는 어떻게 봐야 하나
벤치 숫자는 벤더가 공개한 수치만 옮겨 적는 것이 안전합니다. 우리가 다시 돌린 결과는 아닙니다. 비교 대상은 GLM-5.2입니다.
Terminal-Bench 3.0은 4.6에서 28.3, DeepSWE v1.1은 46.2에서 66.9, Agents’ Last Exam은 23.8에서 28.5로 적혀 있습니다. Z.ai Code Bench는 비공개 벤치입니다. Max는 약 7만 5천 출력 토큰 기준 34.5퍼센트이고, 5.2는 약 9만 6천 출력 토큰 기준 23.4퍼센트입니다. High는 31.4퍼센트로 Claude Opus 4.8의 29.5퍼센트를 앞선다고 적혀 있지만, Claude Fable 5 Max의 39.5퍼센트에는 못 미칩니다.
CyberGym은 84.5퍼센트입니다. ExploitBench는 54.4퍼센트로 5.2의 24.4퍼센트보다 올랐지만, Mythos 78.0과 Sol 76.5에는 못 미칩니다. Artificial Analysis Intelligence Index 60, Kimi K3와 동률이라는 문장도 벤더와 AA 쪽 주장입니다. 이를 우리 점수나 확정 순위처럼 옮기면 안 됩니다.
벤치마크 수치는 공개 출처의 주장일 뿐, 우리 작업 결과나 확정 순위로 읽으면 곤란합니다.
무엇이 아닌가
이번 공개는 오픈 웨이트가 아닙니다. 멀티모달 공개도 아닙니다. 사고를 끄는 모드가 열린 것도 아니고, 파라미터 수가 공개된 날도 아닙니다. 큐웬 2.4조 공개나 딥시크 V4-Pro 정식을 다시 쓴 소식으로 읽을 일도 아닙니다.
지연 시간과 가동률 숫자는 공식 가격 페이지에 없습니다. 따라서 그 수치를 덧붙일 근거도 없습니다. 오픈 모델 1등 같은 표현도 제목으로 쓰기 어렵습니다. 60은 AA 지수이고, 동률 주장은 출처가 있는 주장일 뿐입니다.
GLM-5.3 소식의 핵심은 순위가 아니라 API 공개 여부입니다.
가중치 공개 일정은 어디까지 확인됐나
가중치 일정은 8월 14일 글에서 출시 후 2주, 안전 강화 뒤라고 적고 있습니다. 그 날짜는 금요일 8월 28일입니다. 경제일보도 즈히푸를 인용해 8월 28일을 적었습니다. 다만 오늘 그 가중치가 열린 것은 아닙니다.
Hugging Face의 zai-org/GLM-5.3은 401입니다. 지금은 내려받을 수 없습니다. 따라서 8월 28일을 확정 공개일로 단정하기보다, 약속된 목표 날짜로만 적는 편이 맞습니다.
Hugging Face zai-org/GLM-5.3이 401인 이상, 오늘 시점에서 공개 웨이트는 없습니다.
오늘 DAKER 빌더가 확인할 일
오늘 할 일은 복잡하지 않습니다. 국제 주소 또는 중국 주소 가운데 팀이 실제로 쓸 수 있는 쪽을 고르고, 모델 이름에 glm-5.3을 넣어 한 번 호출해 보면 됩니다. 사고를 끄는 설정은 넣지 않는 것이 좋습니다. 호출이 끝나면 엔드포인트, 모델, 입력·출력 단가를 한 줄로 남기면 다음 사람이 재현할 수 있습니다.
이때 가중치가 풀렸다고 적지 않는 것이 중요합니다. 벤치 숫자를 우리 점수처럼 옮겨 적는 것도 피해야 합니다. 동작하는 결과가 있다면 공개 링크를 남기는 편이 더 분명합니다.
기록할 때 놓치기 쉬운 점
문서의 모델 아이디를 그대로 쓰는 것이 좋습니다. 5.2 키에 5.3 이름을 넣고 추측만 하기보다 실제 호출 여부를 확인해야 합니다. thinking.type: "disabled"는 문서상 오류 동작이므로 넣지 않는 편이 맞습니다.
기본 추론 노력은 max입니다. 짧은 작업에 그대로 두면 출력 토큰이 먼저 늘어날 수 있으니, 필요하면 low로 낮춰 보는 것이 좋습니다. Coding Plan을 쓴다면 피크 시간은 UTC+8 14–18로 그대로 적어 두는 편이 안전합니다.
또한 중국 주소와 국제 주소를 한 환경 변수에 섞지 않는 편이 좋습니다. 어느 쪽이 성공했는지 모르면 다음 사람이 재현하지 못합니다. 성공한 주소를 로그 첫 줄에 남기면 됩니다.
프로토콜도 추측하지 않는 편이 좋습니다. 키가 Chat Completions만 지원한다면 Responses를 먼저 넣었다가 실패할 수 있습니다. 이 경우 모델이 없는 것이 아니라, 그 키에 그 프로토콜이 없는 것일 수 있습니다.
비용과 설정을 볼 때 주의할 점
캐시 입력 0.26달러는 항상 적용되는 단가가 아닙니다. 캐시가 맞을 때의 가격입니다. 첫 호출 견적에는 입력 1.4달러와 출력 4.4달러를 먼저 넣고, 캐시는 별도로 적는 편이 정확합니다. 저장 한시 무료의 종료 날짜도 출처에 없는 만큼 추측하지 않는 것이 맞습니다.
온도 기본값 1.0, top_p 기본값 0.95도 문서에 적힌 값입니다. 그렇다고 이를 곧바로 우리 기본값으로 삼을 필요는 없습니다. 짧은 분류 작업에서는 답이 흔들릴 수 있으니, 작업에 맞는 값을 정하고 로그에 남기면 됩니다.
주말 50퍼센트 포인트는 Coding Plan 이야기입니다. 종량 달러 가격이 주말에 반값이 된다는 뜻은 아닙니다. 두 과금 체계를 한 표에 섞지 않는 편이 좋습니다.
결국 오늘의 결론
한 줄로 줄이면 이렇습니다. 웨이트는 아직입니다. API만 열렸습니다. 베이스는 5.2와 같고, 달라진 것은 후훈련입니다. 오늘 확인할 것은 한 번의 호출과, 그 호출이 실제로 동작했다는 기록입니다.
공개 웨이트를 기다리는 날이 아니라, API가 실제로 열렸는지 확인하는 날입니다.
참고 자료
이 소식을 팀 기록이나 제출 계획에 반영한다면, 여러분은 API 공개와 가중치 공개를 어떻게 구분해 적고 계신가요?