Claude Sonnet 5.5 공개: 단가는 그대로, 작업당 비용은 줄었다

김팔복 2026-09-29 11:52:01
조회 51 추천 0 댓글 0

출처: Anthropic
원문: https://www.anthropic.com/claude-sonnet-5-5
작성자: 팔복소프트-김팔복

한눈에 보기

  • Anthropic이 2026년 9월 28일 Claude 5.5 제품군의 두 번째 모델인 Sonnet 5.5를 공개했습니다.
  • 토큰 단가는 Sonnet 5와 같지만 같은 일을 더 적은 토큰으로 끝내서, 작업당 비용은 최대 30% 낮아졌습니다.
  • 출력 속도는 Sonnet 5보다 30% 이상 빨라 역대 Sonnet 중 가장 빠릅니다.
  • 에이전트 코딩 벤치마크 Terminal-Bench 4.0에서 70.6%로, Sonnet 5(10.3%)와 Opus 5.5 최고점(66.4%)을 모두 넘었습니다.
  • 그래도 판단이 길게 이어지는 복잡한 작업은 Opus 5.5가 확실히 낫다고 Anthropic 스스로 밝혔습니다.
  • 고위험 사이버보안 요청은 Sonnet 5로 자동 전환되는 안전장치가 Sonnet 최초로 들어갔습니다.
  • thinking을 끄고 쓰던 팀은 새 between_tools 설정으로 바꾼 뒤 이전해야 합니다.

배경

Claude는 Opus(고성능), Sonnet(성능·비용 균형), Haiku(대량·저비용) 세 등급으로 나뉩니다. 실무 호출의 상당수가 Sonnet에 몰리는 만큼, Sonnet의 효율은 월 청구서와 직결됩니다. 5.5 세대는 Opus 5.5가 먼저 나왔고, Haiku 5.5는 몇 주 안에 합류할 예정입니다.

가격표는 그대로, 줄어든 건 토큰 수

100만 토큰당 Sonnet 5.5 Opus 5.5
입력 $2 $4
출력 $10 $20
캐시 쓰기 $2.50 $5
캐시 읽기 $0.20 $0.20

Sonnet 5.5의 단가는 Sonnet 5와 똑같습니다. 비용이 줄어드는 이유는 모델이 일하는 방식에 있습니다. 여러 도구 호출을 한 번에 묶어 처리하면서 단계 수 자체가 줄었습니다. 사전 테스트 기업 수치도 같습니다. 금융사 Balyasny의 과제에서는 답변당 토큰이 Sonnet 5의 약 49만7천 개에서 약 12만1천 개로 줄었고, Slack은 출력 토큰이 약 14% 감소했다고 전했습니다.

벤치마크: 코딩·컴퓨터 사용에서 Opus에 근접

Sonnet 5, Sonnet 5.5, Opus 5.5의 벤치마크 점수 비교 막대그래프

실무형 지식 작업 평가인 GDPval-AA에서도 1844점으로 Opus 5.5(1846점)와 사실상 같고, Sonnet 5보다 약 400점 높습니다.

눈여겨볼 부분은 effort(추론에 들이는 노력 수준) 설정입니다. 여러 벤치마크에서 Low나 Medium만으로 Sonnet 5의 최고 점수를 넘었고, 작업당 비용은 약 10분의 1이었습니다. 반대로 코드 병합 가능성을 보는 FrontierCode에서는 Max(46.2%)가 Xhigh(52.1%)보다 낮았습니다. 리뷰를 여러 서브에이전트로 쪼개다 시간 초과나 범위 밖 수정이 생긴 탓입니다.

사용 환경 기본 effort
Claude Code, Claude 앱 Medium
Claude Platform(API) High

이전 전에 확인할 것

  • 제공 범위: AWS, Google Cloud, Microsoft Azure를 포함한 전 플랫폼에서 제공되며, 모델 ID는 claude-sonnet-5-5입니다. zero data retention도 지원합니다.
  • 사이버보안 폴백: 일반적인 버그 탐색·수정은 영향이 없지만, 고위험 보안 작업은 눈에 보이게 Sonnet 5로 넘어갑니다.
  • 생물학: 기존 Sonnet 5와 같은 안전장치입니다. 일부 미생물·바이러스학 요청은 잘못 걸릴 수 있습니다.
  • thinking 계정 귀속: 모델 추론 추출을 막기 위해 thinking이 생성한 계정과 분리되지 않습니다. Claude Code 세션 중 계정을 바꾸는 식으로 대화를 옮긴다면 공식 문서를 먼저 확인하세요.

팔복소프트 관점

  • 비용은 단가표가 아니라 작업 단위로 재야 합니다. 이번 절감은 전부 토큰 효율에서 나왔습니다. 기존 로그에서 요청당 토큰 수를 뽑아 Sonnet 5와 나란히 돌려보는 것이 가장 정확한 비교입니다.
  • Opus 호출 일부는 Sonnet으로 내려도 됩니다. 단가가 절반인데 코딩 점수 차이가 2~3점 수준이라, 코드 리뷰나 정형화된 문서 생성은 Sonnet 5.5로 먼저 옮겨볼 만합니다. 설계 결정이나 대규모 리팩터링은 Opus에 남기고, Opus가 설계하고 Sonnet이 구현하는 분업이 현실적입니다.
  • 한국어 품질은 직접 확인해야 합니다. 발표된 벤치마크는 모두 영어 중심이고 한국어 언급이 없습니다. 한국어 비중이 큰 서비스라면 자체 평가셋 30~50건으로 먼저 돌려보세요.
  • 보안 조직은 폴백을 모니터링하세요. 취약점 분석이나 모의해킹 보조 도구를 Sonnet 기반으로 만들었다면, 일부 요청이 조용히 이전 세대 품질로 처리될 수 있습니다. 응답 모델을 로그로 남겨두세요.
  • effort를 무조건 올리지 마세요. FrontierCode 사례처럼 CI에 붙인 에이전트는 Max에서 오히려 범위 밖 수정을 할 수 있습니다. Medium부터 시작해 필요할 때만 올리는 편이 비용과 품질 모두 낫습니다.
  • 클라우드 계약 안에서 바로 쓸 수 있습니다. 기존 AWS·GCP·Azure 계약으로 쓰는 국내 기업이라면 조달 부담은 적습니다. 다만 원문에 리전 정보가 없으니 서울 리전 제공 여부는 콘솔에서 확인하세요.

정리

Sonnet 5.5는 새 기능보다 효율이 바뀐 모델입니다. 기억할 것은 세 가지입니다. 비용은 작업 단위로 다시 재고, effort는 낮게 시작하고, 한국어 품질은 제조사 벤치마크가 아니라 우리 데이터로 확인하는 것입니다. Sonnet 5 사용 중이라면 지금 A/B 테스트를 돌려보세요.


  • Claude
  • Anthropic
  • LLM
  • AI코딩
  • API비용

댓글 0

아직 댓글이 없습니다.