Claude Haiku 5.5 출시: 입력 $0.10/출력 $0.50, 1M 컨텍스트 소형 모델
Anthropic이 2026년 10월 7일 Claude Haiku 5.5를 출시했다. 입력 100만 토큰당 $0.10부터, 1M 컨텍스트와 적응형 사고를 지원하는 가장 빠른 소형 모델이다.
Anthropic이 2026년 10월 7일 Claude Haiku 5.5를 출시했다. 입력 100만 토큰당 $0.10부터, 1M 컨텍스트와 적응형 사고를 지원하는 가장 빠른 소형 모델이다.
핵심 요약
Anthropic이 2026년 10월 7일 Claude Haiku 5.5를 출시했다. Claude 5.5 라인업에서 가장 작고 빠른 모델로, 분류·추출·라우팅처럼 호출량이 많고 지연 시간에 민감한 작업을 겨냥한다. 모델 ID는 claude-haiku-5-5다. Anthropic은 이 모델을 지금까지 내놓은 소형 모델 중 가장 뛰어나다고 소개했고, Haiku 4.5보다 코딩, 컴퓨터 사용, 지식 업무에서 앞선다고 밝혔다. 다만 이 글이 참고한 보도와 공식 문서에는 수치 벤치마크가 포함되어 있지 않다.
주요 기능
1. 가격
공식 문서 기준 입력은 100만 토큰당 $0.10, 출력은 $0.50부터다. 프롬프트가 100,000 토큰을 넘으면 입력 $0.50, 출력 $2.50이 적용된다. Batch API는 입출력 모두 50% 할인이고, 캐시 읽기는 100,000 토큰 이하 프롬프트에서 $0.01이다. Anthropic은 Haiku 4.5 대비 평균 75% 저렴하다고 밝혔다(Yahoo Finance 보도).
2. 1M 컨텍스트와 128K 출력
컨텍스트 윈도우는 1M 토큰, 동기 호출 기준 최대 출력은 128K 토큰이다. Message Batches API에서는 베타 헤더를 쓰면 최대 300K 출력 토큰을 지원한다. 입력은 텍스트와 이미지, 출력은 텍스트다.
3. 적응형 사고
모델이 생각할 분량을 스스로 정하는 적응형 사고가 기본으로 켜져 있고, effort 파라미터로 깊이를 조절한다. 기본 effort는 medium이다. temperature, top_p, top_k는 생략해야 하며 일부 값은 400 오류를 반환한다.
4. 폭넓은 제공 채널
Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS에서 쓸 수 있다. 신뢰할 수 있는 지식 기준일은 2026년 6월이며, 서비스 종료는 2027년 10월 7일 이전에는 없다.
라인업에서의 위치
공식 문서의 비교표에 따르면 Haiku 5.5는 지연 시간이 가장 짧은 모델이다. 100만 토큰당 가격은 Fable 5.1이 $10/$50, Opus 5.5가 $4/$20, Sonnet 5.5가 $2/$10이다. Haiku 5.5의 기본 가격 $0.10/$0.50은 이들보다 크게 낮다. Yahoo Finance는 Anthropic의 가격이 OpenAI의 가장 작은 모델 GPT-6 Luna와 비슷한 수준이라고 전했다.
사용성 분석
대량의 문서를 분류하거나 필드를 추출하는 파이프라인, 요청을 적절한 모델로 보내는 라우터, 상위 모델이 맡긴 일을 처리하는 서브에이전트에 적합하다. 문서는 서브에이전트 작업도 용도로 명시한다. 전환할 때는 주의할 점이 있다. Claude 4.7 이후 모델과 같은 새 토크나이저를 쓰기 때문에 같은 텍스트가 Haiku 4.5보다 약 30% 더 많은 토큰으로 계산된다. 단가가 내려가도 토큰 수가 늘어 실제 비용 절감 폭은 워크로드마다 달라질 수 있어, 자체 트래픽으로 측정해야 한다. 사고 블록은 생성한 계정 또는 연결된 계정에서만 동작한다.
장점과 한계
장점은 낮은 단가, 1M 컨텍스트, 5개 플랫폼 제공, Batch와 캐싱 할인이다. 한계는 공식 수치 벤치마크가 확인되지 않는다는 점, 출력이 텍스트로 제한된다는 점, 100,000 토큰 초과 프롬프트에서 단가가 5배로 오른다는 점이다.
시장 맥락과 전망
Yahoo Finance는 기업들이 AI 비용 절감에 나서면서 일부가 오픈 웨이트 모델로 옮겨가고 있다고 전했다. 소형 모델 가격 경쟁이 이어지는 배경이다. 이후 실제 채택 규모와 독립 벤치마크 결과는 아직 확인되지 않았다.
결론
Claude Haiku 5.5는 대량 처리와 서브에이전트 용도로 비용을 낮추려는 개발자가 검토할 만한 모델이다. 도입 전에는 토크나이저 변화와 100K 초과 구간 요금을 포함해 자체 데이터로 비용과 품질을 측정하길 권한다. 평점은 4점이다.
장점
- 입력 $0.10, 출력 $0.50의 낮은 기본 단가
- 1M 컨텍스트와 128K 출력 지원
- 5개 플랫폼에서 동일 모델 ID로 제공
- Batch 50% 할인과 캐시 읽기 요금 인하
단점/한계
- 공식 수치 벤치마크 미확인
- 100K 초과 프롬프트에서 단가 5배
- 새 토크나이저로 토큰 수 약 30% 증가
- 출력은 텍스트만 지원
참고 자료
댓글0개
주요 기능/특징
1. 입력 $0.10 / 출력 $0.50 (100만 토큰당, 100K 이하 프롬프트), Haiku 4.5 대비 평균 75% 저렴(Anthropic 발표) 2. 1M 토큰 컨텍스트, 최대 출력 128K (Batch 베타 300K) 3. 적응형 사고와 effort 파라미터 (기본 medium) 4. 라인업 중 지연 시간 최단, 분류·추출·라우팅·서브에이전트 용도 5. Claude API, Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS 제공 6. Claude 4.7 이후 토크나이저 사용, 같은 텍스트가 Haiku 4.5보다 약 30% 많은 토큰으로 계산
핵심 인사이트
- Anthropic은 Haiku 5.5를 분류, 추출, 라우팅처럼 호출량이 많은 작업용으로 규정해 비용과 속도에 초점을 맞췄다
- 기본 가격은 입력 $0.10, 출력 $0.50이며 Haiku 4.5 대비 평균 75% 저렴하다고 Anthropic이 밝혔다
- 100,000 토큰을 넘는 프롬프트는 입력 $0.50, 출력 $2.50으로 단가가 5배가 되므로 긴 컨텍스트 사용 시 비용 설계가 필요하다
- 새 토크나이저로 같은 텍스트가 약 30% 더 많은 토큰으로 계산되어 단가 인하 효과가 일부 상쇄될 수 있다
- 1M 컨텍스트와 128K 출력을 소형 모델에서 지원해 상위 모델 없이도 긴 문서 처리 파이프라인을 구성할 수 있다
- Sonnet 5.5($2/$10), Opus 5.5($4/$20), Fable 5.1($10/$50)과의 계층 구조에서 하위 작업을 Haiku로 위임하는 서브에이전트 설계가 자연스럽다
- Batch API 50% 할인과 캐시 읽기 $0.01 요금을 결합하면 반복 호출 비용을 더 낮출 수 있다
- 수치 벤치마크는 공식 자료에서 확인되지 않아 도입 전 자체 평가가 필요하다
이 리뷰가 유용했나요?
공유하기
관련 AI 리뷰
Anthropic Cyber Verification Program 확장: 3단계 접근 체계 도입
Anthropic이 2026년 10월 6일 Cyber Verification Program을 Defense, Red Team, Specialized 3단계로 확장했다. 보안팀과 레드팀에게 유용하다.
Claude Frontier Academy 발표: 1억 달러로 FDE 1만 명 양성
Anthropic이 1억 달러를 투입해 2027년 말까지 Frontier Deployed Engineer 1만 명을 양성하는 Claude Frontier Academy를 발표했다. 모델이 아닌 인력 양성 프로그램이다.
Claude Code Mods 공개: TypeScript 함수로 에이전트 동작 수정
Anthropic이 TypeScript 함수로 Claude Code의 프롬프트, 도구 호출, 권한 요청을 가로채 수정하는 Mods를 발표했다. 샌드박스가 없어 신뢰 출처 설치가 필수다.
Claude Sonnet 5.5 출시: 작업당 비용 최대 30% 절감, 출력 30% 이상 빠름
Anthropic이 2026년 9월 28일 Claude Sonnet 5.5를 발표했다. 가격은 Sonnet 5와 같고 출력은 30% 이상 빨라졌다. 비용에 민감한 에이전트·코딩 워크로드 운영자에게 유용하다.
