Claude Sonnet 5.5가 나왔습니다. 오퍼스 5.5의 절반 값이고 소넷 5보다 30% 넘게 빠르다는데, 그럼 오퍼스는 이제 필요 없을까요. 발표문의 근거로 소넷과 오퍼스를 언제 나눠 쓸지 정리했습니다.
실적 자료 한 뭉치가 열 장짜리 초안이 됐다

Anthropic이 2026년 9월 28일 공개한 Claude Sonnet 5.5는 오퍼스 5.5의 더 빠르고 값싼 짝으로 소개됐습니다. 발표문은 소넷 5.5가 범위가 정해진 일상 업무, 버그 수정, 그리고 문서·슬라이드·스프레드시트 작성에 가장 강하다고 설명합니다. 이 글은 비개발자에게 가까운 사례부터 봅니다. 상장사의 분기 실적 자료와 슬라이드 틀을 주고 열 장짜리 보고서를 만들게 한 시험입니다. 이어서 소넷과 오퍼스를 어떻게 나눠 쓰면 좋을지까지, 발표문에 나온 근거만으로 정리합니다.
이런 소식, 남들보다 먼저 받으실 분?
직접 돌려보고 되는 것만 골라 매주 보내드립니다. 광고성 하이프는 거릅니다.
전문가 두 명이 본 첫 초안, 판정은 ‘그대로 발송’

발표문에 따르면 Anthropic은 내부 시험에서 상장사의 분기 실적 자료와 실적 발표 통화 녹취록, 그리고 슬라이드 틀을 소넷 5.5에게 주고 열 장짜리 운영 보고서를 만들게 했습니다. 전문가 두 명이 첫 초안을 보고 그대로 보내도 되는 수준이라고 판단했다고 합니다. 이 시험은 Anthropic이 직접 밝힌 내부 시험이라 제3자 검증은 아닙니다. 같은 맥락에서 발표문은 초기 시험자들이 소넷 5.5가 슬라이드 틀을 따라 손볼 곳이 적은 덱을 만든다고 평가했다고 덧붙입니다.
오퍼스 값의 절반으로 돌아가는 5.5 모델

소넷 5.5의 가격은 100만 토큰당 입력 2달러, 출력 10달러이고 소넷 5와 같습니다. 오퍼스 5.5는 입력 4달러, 출력 20달러입니다(오퍼스 5.5 발표 페이지). 입력과 출력 모두 소넷 5.5가 절반입니다. 여기에 발표문은 소넷 5.5가 같은 일을 하는 데 필요한 토큰이 훨씬 적어서 작업 한 건 비용이 소넷 5보다 최대 30% 적다고 밝힙니다(자체 시험). 기본 노력 수준은 클로드 앱과 클로드 코드에서는 중간, 클로드 플랫폼에서는 높음입니다.
앱 118개 시험에서 고쳐 쓴 횟수가 반으로

소넷 5.5 발표문에는 고객사 Base44의 AI 엔지니어링 리드 Gabriel Grinberg의 말이 실려 있습니다. 실제 앱 118개를 만들어 본 시험에서 소넷 5.5가 만든 앱의 점수가 오퍼스 5와 같은 수준이었고, 앱 하나를 만드는 데 평균 3.6번 반복한 반면 오퍼스 5는 7.7번이었다는 내용입니다. 도구 호출 실패도 비교한 모델 중 가장 적었고, 만드는 도중 사용자에게 질문하느라 멈추는 일도 드물었다고 합니다. 오퍼스 5.5가 아니라 오퍼스 5와의 비교라는 점, 고객사가 자기 시험에서 잰 결과라는 점을 함께 봐야 합니다.
값은 그대로, 속도는 30% 넘게 빨라졌다

발표문은 소넷 5.5가 소넷 5보다 출력을 30% 넘게 빨리 만들어 소넷 중 가장 빠른 모델이라고 밝힙니다. 값은 소넷 5와 같으니 같은 돈으로 더 빠르게 받는 셈입니다. 발표문은 고객 사례도 여럿 싣습니다. 한 고객은 지원 티켓 처리가 20% 빨라졌다고 했고, 다른 고객은 금융 과제 2,441개 시험에서 답변 하나에 약 12만 1천 토큰을 써서 소넷 5의 49만 7천 토큰보다 적게 썼다고 합니다. 모두 각 회사가 자체 시험으로 밝힌 수치입니다.
점수가 비슷해도 복잡한 판단은 오퍼스

발표문은 소넷 5.5가 여러 평가에서 소넷 5보다 크게 올랐고, 일부 평가에서는 최대 노력 수준일 때 오퍼스 5.5와 비슷한 점수를 낸다고 인정합니다. 발표문 표에서 Terminal-Bench 4.0 점수는 소넷 5.5가 70.6%, 소넷 5가 10.3%, 오퍼스 5.5가 66.4%입니다(오퍼스 5.5는 가장 높은 노력 수준 기준). 그러면서도 발표문은 벤치마크 점수가 모델 능력의 한 단면일 뿐이라고 말하고, 자체 시험과 외부 시험자의 시험에서 오퍼스 5.5가 오래 판단해야 하는 복잡하고 열린 일에서는 여전히 분명히 더 강하다고 밝힙니다.
일상 업무는 소넷, 복잡한 일은 오퍼스

발표문은 소넷 5.5를 범위가 정해진 일상 업무와 문서·슬라이드·스프레드시트 작성에 가장 강한 모델로, 오퍼스 5.5를 세심한 판단이 필요한 복잡한 일에 맞춘 모델로 소개합니다. 여러 벤치마크에서 소넷 5.5가 낮음이나 중간 노력 수준으로도 소넷 5의 최고 점수를 넘고, 작업당 비용은 약 10분의 1이라는 설명도 있습니다. 이를 묶으면 범위가 정해진 일은 소넷에 맡기고 결과를 오래 판단해야 하는 일만 오퍼스에 맡기는 나눔이 됩니다. 이 나눔은 발표문의 두 설명을 묶은 우리 정리이며 발표문이 직접 권하는 사용법은 아닙니다.
소넷과 오퍼스 고르는 기준표
소넷 5.5와 오퍼스 5.5를 고를 때 발표문에서 확인되는 기준을 한 곳에 모았습니다.
- 맡길 일: 범위가 정해진 일상 업무, 버그 수정, 문서·슬라이드·스프레드시트 작성은 소넷 5.5, 세심한 판단이 오래 필요한 복잡하고 열린 일은 오퍼스 5.5.
- 값(100만 토큰당 입력/출력): 소넷 5.5는 2달러/10달러, 오퍼스 5.5는 4달러/20달러. 소넷 5.5는 같은 일에 필요한 토큰이 적어 작업 한 건 비용이 소넷 5보다 최대 30% 적습니다.
- 속도: 소넷 5.5는 소넷 5보다 출력이 30% 넘게 빠르고, 오퍼스 5.5도 오퍼스 5보다 30% 넘게 빠릅니다.
- 노력 수준: 클로드 앱과 클로드 코드의 기본은 중간, 클로드 플랫폼의 기본은 높음입니다. 낮음과 중간에서 소넷 5.5가 소넷 5의 최고 점수를 약 10분의 1 비용으로 넘는 평가가 있습니다.
- 점수 비교: Terminal-Bench 4.0에서 소넷 5.5 70.6%, 소넷 5 10.3%, 오퍼스 5.5 66.4%. 다만 발표문은 복잡하고 열린 일에서는 오퍼스 5.5가 분명히 더 강하다고 밝힙니다.
- 주의: 슬라이드 시험과 Base44 시험, 고객 수치는 모두 Anthropic이나 각 회사가 자체 시험으로 밝힌 것입니다.
위 나눔은 발표문의 설명을 묶은 정리입니다. 내 일이 어느 쪽인지는 소넷으로 먼저 돌려 보고 결과가 모자라면 오퍼스로 올려 보는 식으로 확인하면 됩니다.
출처: Introducing Claude Sonnet 5.5 · Introducing Claude Opus 5.5