Claude Sonnet 5.5 공개: 단가는 그대로, 작업당 비용은 줄었다
출처: Anthropic
원문: https://www.anthropic.com/claude-sonnet-5-5
작성자: 팔복소프트-김팔복
한눈에 보기
- Anthropic이 2026년 9월 28일 Claude 5.5 제품군의 두 번째 모델인 Sonnet 5.5를 공개했습니다.
- 토큰 단가는 Sonnet 5와 같지만 같은 일을 더 적은 토큰으로 끝내서, 작업당 비용은 최대 30% 낮아졌습니다.
- 출력 속도는 Sonnet 5보다 30% 이상 빨라 역대 Sonnet 중 가장 빠릅니다.
- 에이전트 코딩 벤치마크 Terminal-Bench 4.0에서 70.6%로, Sonnet 5(10.3%)와 Opus 5.5 최고점(66.4%)을 모두 넘었습니다.
- 그래도 판단이 길게 이어지는 복잡한 작업은 Opus 5.5가 확실히 낫다고 Anthropic 스스로 밝혔습니다.
- 고위험 사이버보안 요청은 Sonnet 5로 자동 전환되는 안전장치가 Sonnet 최초로 들어갔습니다.
- thinking을 끄고 쓰던 팀은 새
between_tools설정으로 바꾼 뒤 이전해야 합니다.
배경
Claude는 Opus(고성능), Sonnet(성능·비용 균형), Haiku(대량·저비용) 세 등급으로 나뉩니다. 실무 호출의 상당수가 Sonnet에 몰리는 만큼, Sonnet의 효율은 월 청구서와 직결됩니다. 5.5 세대는 Opus 5.5가 먼저 나왔고, Haiku 5.5는 몇 주 안에 합류할 예정입니다.
가격표는 그대로, 줄어든 건 토큰 수
| 100만 토큰당 | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 입력 | $2 | $4 |
| 출력 | $10 | $20 |
| 캐시 쓰기 | $2.50 | $5 |
| 캐시 읽기 | $0.20 | $0.20 |
Sonnet 5.5의 단가는 Sonnet 5와 똑같습니다. 비용이 줄어드는 이유는 모델이 일하는 방식에 있습니다. 여러 도구 호출을 한 번에 묶어 처리하면서 단계 수 자체가 줄었습니다. 사전 테스트 기업 수치도 같습니다. 금융사 Balyasny의 과제에서는 답변당 토큰이 Sonnet 5의 약 49만7천 개에서 약 12만1천 개로 줄었고, Slack은 출력 토큰이 약 14% 감소했다고 전했습니다.
벤치마크: 코딩·컴퓨터 사용에서 Opus에 근접
실무형 지식 작업 평가인 GDPval-AA에서도 1844점으로 Opus 5.5(1846점)와 사실상 같고, Sonnet 5보다 약 400점 높습니다.
눈여겨볼 부분은 effort(추론에 들이는 노력 수준) 설정입니다. 여러 벤치마크에서 Low나 Medium만으로 Sonnet 5의 최고 점수를 넘었고, 작업당 비용은 약 10분의 1이었습니다. 반대로 코드 병합 가능성을 보는 FrontierCode에서는 Max(46.2%)가 Xhigh(52.1%)보다 낮았습니다. 리뷰를 여러 서브에이전트로 쪼개다 시간 초과나 범위 밖 수정이 생긴 탓입니다.
| 사용 환경 | 기본 effort |
|---|---|
| Claude Code, Claude 앱 | Medium |
| Claude Platform(API) | High |
이전 전에 확인할 것
- 제공 범위: AWS, Google Cloud, Microsoft Azure를 포함한 전 플랫폼에서 제공되며, 모델 ID는
claude-sonnet-5-5입니다. zero data retention도 지원합니다. - 사이버보안 폴백: 일반적인 버그 탐색·수정은 영향이 없지만, 고위험 보안 작업은 눈에 보이게 Sonnet 5로 넘어갑니다.
- 생물학: 기존 Sonnet 5와 같은 안전장치입니다. 일부 미생물·바이러스학 요청은 잘못 걸릴 수 있습니다.
- thinking 계정 귀속: 모델 추론 추출을 막기 위해 thinking이 생성한 계정과 분리되지 않습니다. Claude Code 세션 중 계정을 바꾸는 식으로 대화를 옮긴다면 공식 문서를 먼저 확인하세요.
팔복소프트 관점
- 비용은 단가표가 아니라 작업 단위로 재야 합니다. 이번 절감은 전부 토큰 효율에서 나왔습니다. 기존 로그에서 요청당 토큰 수를 뽑아 Sonnet 5와 나란히 돌려보는 것이 가장 정확한 비교입니다.
- Opus 호출 일부는 Sonnet으로 내려도 됩니다. 단가가 절반인데 코딩 점수 차이가 2~3점 수준이라, 코드 리뷰나 정형화된 문서 생성은 Sonnet 5.5로 먼저 옮겨볼 만합니다. 설계 결정이나 대규모 리팩터링은 Opus에 남기고, Opus가 설계하고 Sonnet이 구현하는 분업이 현실적입니다.
- 한국어 품질은 직접 확인해야 합니다. 발표된 벤치마크는 모두 영어 중심이고 한국어 언급이 없습니다. 한국어 비중이 큰 서비스라면 자체 평가셋 30~50건으로 먼저 돌려보세요.
- 보안 조직은 폴백을 모니터링하세요. 취약점 분석이나 모의해킹 보조 도구를 Sonnet 기반으로 만들었다면, 일부 요청이 조용히 이전 세대 품질로 처리될 수 있습니다. 응답 모델을 로그로 남겨두세요.
- effort를 무조건 올리지 마세요. FrontierCode 사례처럼 CI에 붙인 에이전트는 Max에서 오히려 범위 밖 수정을 할 수 있습니다. Medium부터 시작해 필요할 때만 올리는 편이 비용과 품질 모두 낫습니다.
- 클라우드 계약 안에서 바로 쓸 수 있습니다. 기존 AWS·GCP·Azure 계약으로 쓰는 국내 기업이라면 조달 부담은 적습니다. 다만 원문에 리전 정보가 없으니 서울 리전 제공 여부는 콘솔에서 확인하세요.
정리
Sonnet 5.5는 새 기능보다 효율이 바뀐 모델입니다. 기억할 것은 세 가지입니다. 비용은 작업 단위로 다시 재고, effort는 낮게 시작하고, 한국어 품질은 제조사 벤치마크가 아니라 우리 데이터로 확인하는 것입니다. Sonnet 5 사용 중이라면 지금 A/B 테스트를 돌려보세요.
- Claude
- Anthropic
- LLM
- AI코딩
- API비용
아직 댓글이 없습니다.