AI 브리핑/Anthropic

Claude Sonnet 5.5 출시 — 더 빠르다는 발표, 실제 비용은?

Sonnet 5.5의 속도·가격 발표를 토큰 단가와 작업당 비용으로 나눠 보고, Opus와의 역할 차이도 짚었습니다.

Anthropic이 2026년 9월 28일 Claude Sonnet 5.5를 공개했습니다. 회사는 이전 Sonnet 5보다 출력이 30% 이상 빠르고, 같은 작업을 처리하는 총비용은 최대 30% 낮아질 수 있다고 설명합니다. 중요한 점은 토큰 단가를 30% 내린 것이 아니라 작업에 필요한 토큰과 시간의 감소를 주장한다는 것입니다.

어떤 일을 맡길 만한가요?

Anthropic은 Sonnet 5.5를 일상적인 코딩, 버그 수정, 범위가 분명한 문서·슬라이드·스프레드시트 작업에 맞는 모델로 소개합니다. 오래 걸리고 판단이 복잡한 열린 과제에서는 상위 모델인 Opus 5.5가 여전히 강하다고 회사도 구분합니다. 따라서 ‘Sonnet이 Opus를 완전히 대체한다’는 해석은 정확하지 않습니다.

새 모델의 장점은 매번 한 번의 질문으로 끝내는 작업보다, 수정과 확인을 여러 번 반복하는 흐름에서 드러날 수 있습니다. 예를 들어 같은 코드베이스의 버그 10건을 고치게 하거나, 기존 회사 서식에 맞춘 발표자료를 만들게 한 다음 결과물의 수정 횟수와 처리 시간을 함께 비교해 볼 수 있습니다.

속도·성능 발표는 어떻게 읽어야 하나요?

Anthropic은 자체 발표에서 Sonnet 5 대비 출력 속도 30% 이상 개선을 제시했습니다. 코딩·지식업무 평가에서도 개선을 보고했지만, 벤치마크는 설정한 노력 수준과 도구, 채점 방식에 따라 달라집니다. 발표사의 수치를 모든 회사의 실제 업무 성공률로 그대로 받아들이면 안 됩니다.

특히 ‘최대 30% 저렴’은 모든 요청의 가격 인하가 아닙니다. 실제 비용을 보려면 같은 데이터와 지시문으로 구형·신형 모델을 각각 실행하고, 완료율뿐 아니라 입력·출력 토큰, 재시도 횟수, 사람의 수정 시간을 기록하는 편이 좋습니다.

API 요금과 이용 경로는?

  • Anthropic이 공개한 기본 API 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러입니다. 캐시 읽기는 100만 토큰당 0.20달러입니다.
  • 이 단가는 Sonnet 5와 같으며, 작업당 비용 절감은 처리 효율에 관한 회사의 측정치입니다.
  • Anthropic은 Claude 서비스와 Claude Platform뿐 아니라 AWS, Google Cloud, Microsoft Azure에서도 제공한다고 밝혔습니다. API 모델 식별자는 claude-sonnet-5-5입니다.

Claude 앱과 Claude Code의 기본 노력 수준은 Medium, 개발자 플랫폼의 기본값은 High라고 안내합니다. 노력 수준이 높아질수록 품질·지연시간·비용이 함께 변할 수 있으므로 비교 테스트에서는 이 설정을 맞춰야 합니다.

바꾸기 전에 확인할 점

기존 자동화나 API를 바로 교체하기보다, 정확도가 중요한 작업을 따로 골라 병행 시험하는 것이 안전합니다. Anthropic은 일부 고위험 사이버보안 요청에 별도의 안전장치와 이전 모델로의 대체 응답을 적용한다고 설명합니다. 또 기존에 사고 과정을 끈 상태로 Sonnet을 쓰던 개발자는 새 between_tools 설정으로의 전환이 필요할 수 있습니다.

Infosence의 판단: 모델을 선택할 때 발표 수치 하나보다 ‘내 작업의 결과 품질 ÷ 실제 총비용’을 보는 것이 유용합니다. 이 문단은 Anthropic의 성능 보장이 아니라 적용 방법에 대한 편집 의견입니다.

확인 기준: 2026년 9월 30일. 출시일, 가격, 제공 경로, 회사의 성능 수치는 Anthropic 공식 발표를 기준으로 정리했습니다. 업무 적용과 검증 방법은 Infosence의 해석입니다.