Anthropic이 Claude Haiku 5.5를 내놓아 요약·분류·서브에이전트 같은 대량 작업 비용이 Haiku 4.5보다 75%가량 줄었습니다 | DAKER 커뮤니티

요약, 분류, 문서 질의처럼 건수가 많은 작업을 Claude API로 돌리고 있다면 비용표를 다시 볼 때가 됐습니다. Anthropic이 10월 7일(미국 현지 시각) 공개한 Claude Haiku 5.5는 회사가 지금까지 낸 소형 모델 가운데 가장 싸고 빠르며 성능도 가장 높은 모델입니다. 평균 실행 비용은 Haiku 4.5보다 약 75% 낮고, 같은 날 Sonnet 5.5의 캐시 읽기 가격도 절반으로 내려갔습니다. 대량 처리 파이프라인이나 에이전트의 보조 작업을 설계하는 팀이라면 모델 배치를 다시 짜 볼 만한 발표입니다.

종이학이 책상 위 작업 카드를 분류 상자로 나르는 실사풍 설명용 생성 이미지
설명용 생성 이미지입니다.

Haiku 5.5는 어떤 일에 맞춰졌나

Anthropic 공식 발표는 Haiku 5.5를 대량·저비용 작업용 모델로 소개합니다. 요약, 컨텍스트 압축(compaction), 데이터베이스 질의, 분류처럼 짧고 반복적인 일을 안정적으로 처리하고, 코딩 작업에서는 Opus 5.5나 Sonnet 5.5 아래에서 서브에이전트로 쓰기 좋다고 설명합니다. 회사 모델 가운데 표준 속도 기준으로 가장 빠르기 때문에 실시간 고객 지원이나 브라우저 조작처럼 응답 속도가 중요한 일에도 맞는다고 했습니다. Haiku 계열 최초로 노력 수준(effort) 조절도 지원해, 비용과 성능 가운데 무엇을 우선할지 사용자가 정할 수 있습니다.

복잡한 에이전트 코딩은 여전히 Sonnet 5.5와 Opus 5.5가 낫고, Haiku 5.5는 범위가 좁고 건수가 많은 일을 맡는 모델이라는 것이 Anthropic의 설명입니다.

가격은 얼마나 내려갔나

공식 가격표는 프롬프트 길이 10만 토큰을 기준으로 두 구간을 나눕니다. 발표에 따르면 Haiku 4.5 요청의 약 90%가 10만 토큰 이하 구간에 해당했습니다.

100만 토큰당 가격Haiku 5.5 (10만 토큰 이하 / 초과)Haiku 4.5
입력0.10달러 / 0.50달러1.00달러
출력0.50달러 / 2.50달러5.00달러
캐시 읽기0.01달러 / 0.05달러0.10달러
캐시 쓰기0.125달러 / 0.625달러1.25달러

10만 토큰 이하 요청은 Haiku 4.5보다 90%, 초과 요청은 50% 저렴합니다. 다만 Haiku 5.5는 Sonnet 5.5·Opus 5.5와 비슷한 새 토크나이저를 써서 같은 작업에 토큰을 조금 더 쓰며, 75%라는 평균 절감 폭은 이 차이까지 반영한 값이라고 각주에 밝혔습니다. 자기 데이터로 토큰 수를 다시 재 보고 계산하는 편이 정확합니다.

벤치마크에서 보이는 차이

발표 표에서 가장 큰 변화는 컴퓨터 사용과 에이전트 코딩입니다. OSWorld 2.1(오프라인 부분집합)에서 Haiku 5.5는 72.4%로 Haiku 4.5의 15.7%를 크게 앞섰고, Terminal-Bench 4.0에서는 Haiku 4.5가 0.0%였던 과제에서 39.2%를 기록했습니다. 도구 없이 푸는 Humanity’s Last Exam 점수도 10.2%에서 45.9%로 올랐습니다. 같은 표에서 Sonnet 5.5는 OSWorld 83.9%, Terminal-Bench 70.6%여서 상위 모델과의 간격도 분명히 남아 있습니다.

고객사 초기 평가도 함께 실렸습니다. AlphaSense는 주당 약 800만 건을 처리하는 문서 질의 기능에서 400개 질의로 비교한 결과, Haiku 5.5가 0.84점으로 Haiku 4.5의 0.76점보다 통계적으로 유의하게 높았다고 전했습니다.

함께 바뀐 것들

같은 날 Sonnet 5.5의 캐시 읽기 가격이 100만 토큰당 0.20달러에서 0.10달러로 내려갔고, Anthropic은 이로 인해 대부분의 에이전트 작업에서 Sonnet 5.5 비용이 약 20% 줄어든다고 설명했습니다. Max·Team 구독자에게는 발표 주간부터 월간 API 크레딧이 지급됩니다. Max 5x는 월 100달러, Max 20x는 월 200달러, Team은 사용자 합산 최대 500달러입니다. Python·TypeScript SDK에는 컴퓨터 사용과 브라우저 사용 지원이 베타로 추가됐습니다.

보안 쪽에서는 Haiku 5.5의 사이버 보안 안전장치가 Haiku 4.5보다 엄격하지만 최근 다른 모델보다는 다소 느슨하며, Sonnet 5.5보다 방어 목적 작업을 더 넓게 허용하되 침투 테스트처럼 공격에 쓰일 가능성이 큰 기법은 막는다고 밝혔습니다. 모델 ID는 claude-haiku-5-5이며 AWS, Google Cloud, Azure를 포함한 모든 플랫폼에서 바로 쓸 수 있습니다.

국내 팀이 먼저 해 볼 일

대회나 해커톤에서 대량의 텍스트를 분류하거나 요약해 학습 데이터를 정리하는 단계라면, 지금 쓰는 모델과 Haiku 5.5를 같은 샘플 수백 건에 돌려 정확도와 토큰 수를 함께 비교해 보는 것이 출발점입니다. 에이전트를 만드는 팀은 계획과 판단은 상위 모델에 두고, 검색 결과 요약이나 형식 변환 같은 하위 작업만 Haiku 5.5로 넘기는 구성을 시험해 볼 수 있습니다. 외부 상용 API 사용 가능 여부는 대회마다 다르므로 규정 확인이 먼저입니다.

여러분의 파이프라인에서 가장 많은 토큰을 쓰는 단계는 어디입니까? Haiku 5.5로 바꿔 본 결과가 있다면 댓글로 나눠 주시면 좋겠습니다.

출처: Anthropic, Introducing Claude Haiku 5.5 (2026년 10월 7일)