Claude Haiku 5.5의 핵심만 가져가세요. 가격, 성능 변화, effort 조절, Max 구독자 API 크레딧, 그리고 Haiku와 Sonnet을 어떻게 나눠 쓰면 되는지까지 순서대로 정리했어요.
Haiku 5.5, 가장 싸고 가장 빠른 작은 모델

Anthropic이 2026년 10월 7일 Claude Haiku 5.5를 공개했어요. 지금까지 낸 작은 모델 중 가장 싸고 가장 빠르고 가장 성능이 높다고 소개해요. 요약, 컴팩션, 데이터베이스 조회, 분류처럼 대량으로 반복되는 작업에 맞춘 모델이고, 같은 일을 시키면 전작 Haiku 4.5보다 평균 약 75% 적은 비용으로 끝나요. 모델 ID는 claude-haiku-5-5이고 Claude Platform과 Amazon Web Services, Google Cloud, Microsoft Azure에서 바로 쓸 수 있어요.
이런 소식, 남들보다 먼저 받으실 분?
직접 돌려보고 되는 것만 골라 매주 보내드립니다. 광고성 하이프는 거릅니다.
가격이 Haiku 4.5의 10분의 1이에요

100만 토큰 기준 입력은 $0.10, 출력은 $0.50이에요. Haiku 4.5는 입력 $1.00, 출력 $5.00이었으니 요청이 10만 토큰 이하일 때는 딱 10분의 1 수준이에요. 10만 토큰을 넘기면 입력 $0.50, 출력 $2.50으로 올라가요. 그래서 긴 문서를 통째로 넣는 작업은 계산을 한 번 해 보고, 짧은 요청을 많이 보내는 작업일수록 효과가 커요. 캐시 읽기는 $0.01, 캐시 쓰기는 $0.125부터 시작해요.
컴퓨터 조작이 4배 넘게 올랐어요

Anthropic이 공개한 비교표를 보면 성능이 단순히 싸진 게 아니라 달라졌어요. 컴퓨터를 직접 조작하는 OSWorld 2.1 오프라인 구간에서 Haiku 4.5는 15.7%였는데 Haiku 5.5는 72.4%예요. GPT-6 Luna의 48.9%도 넘었어요. 터미널 코딩 시험 Terminal-Bench 4.0에서는 0.0%에서 39.2%로, Humanity's Last Exam은 도구 없이 10.2%에서 45.9%로 올랐어요. 지식 노동 지표 GDPval-AA는 735에서 1620이에요.
Haiku 최초로 effort를 고를 수 있어요

Haiku급 모델 중에서는 처음으로 노력 수준(effort)을 조절할 수 있어요. 다른 Claude 모델처럼 비용을 아낄지 지능을 끌어올릴지 직접 정하는 방식이에요. 빨리 끝낼 일은 낮게, 깊이 생각해야 하는 일은 높게 두면 돼요. Anthropic 차트에는 low부터 max까지 단계별 점수와 시도당 비용이 같이 나와 있어서, 내 작업에서 어느 단계가 가장 가성비가 좋은지 비교해 볼 수 있어요. 실시간 고객 지원이나 브라우저 사용처럼 속도가 중요한 작업에 특히 잘 맞는다고 해요.
Max 구독자는 API 크레딧이 매달 따라와요

같은 날 Anthropic은 Claude Max와 Team 구독자를 위한 월간 API 크레딧을 새로 만든다고 밝혔어요. Max 5x 구독자는 매달 $100, Max 20x 구독자는 $200을 받고, Team 구독자는 최대 $500을 사용자끼리 나눠 써요. 에이전트나 앱을 Claude Platform 위에서 만들어 보라고 주는 크레딧이에요. 구독만 쓰던 분이라면 이 크레딧으로 Haiku 5.5를 붙여 API 실험을 시작하기 좋은 시점이에요.
Sonnet 5.5도 캐시 읽기가 반값이 됐어요

Haiku만 싸진 게 아니에요. Sonnet 5.5의 캐시 읽기 가격이 100만 토큰당 $0.20에서 $0.10으로 절반 줄었어요. 에이전트 작업은 같은 맥락을 반복해서 읽는 경우가 많아서, 대부분의 장기 실행 작업에서 비용이 약 20% 낮아진다고 Anthropic이 설명해요. 이미 Sonnet으로 에이전트를 돌리고 있다면 코드를 바꾸지 않아도 이번 달 청구서부터 달라질 수 있어요.
이럴 땐 Haiku, 이럴 땐 Sonnet

Anthropic 스스로도 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 더 적합하다고 말해요. Terminal-Bench 4.0에서 Sonnet 5.5가 70.6%, Haiku 5.5가 39.2%예요. 반대로 요약, 분류, 데이터베이스 조회, 고객 응대처럼 가볍고 많은 일은 Haiku 5.5가 맡고, 큰 모델이 지휘하는 코딩 작업에서는 Haiku 5.5를 서브에이전트로 붙이는 구성이 잘 맞아요. 메인 모델은 그대로 두고 보조 일꾼만 바꾸는 방식이라 시도해 보기에 부담이 적어요.
정리 — 이번 주에 해볼 것
한 줄로 줄이면 반복되는 가벼운 일은 Haiku 5.5, 어려운 코딩은 Sonnet 5.5예요. 바로 해볼 수 있는 순서는 이래요.
- 모델 ID
claude-haiku-5-5로 요약, 분류, 조회 작업 한 가지만 바꿔 보세요. - 요청이 10만 토큰을 넘는지 확인하세요. 넘으면 입력 $0.50, 출력 $2.50이 적용돼요.
- effort는 낮은 단계에서 시작해서, 결과가 모자라면 한 단계씩 올려 보세요.
- Max 5x·20x나 Team 구독이라면 이번 달 API 크레딧이 있는지 확인하세요.
- Sonnet 5.5로 에이전트를 돌리고 있다면 캐시 읽기 인하로 비용이 얼마나 줄었는지 비교해 보세요.