EN

클로드 소넷 5.5, 단가보다 ‘작업당 비용’이 중요한 이유

2026년 10월 6일 · 한국

앤트로픽은 9월 28일 클로드 소넷 5.5를 공개했습니다.

새 모델은 이전 소넷 5와 같은 토큰 가격을 유지하면서도, 더 적은 토큰과 단계로 업무를 처리하는 데 초점을 맞췄습니다.

그렇다면 빠르고 저렴해졌다는 설명은 실제 이용 비용에 어떤 차이를 뜻할까요.

3줄 요약
1. 클로드 소넷 5.5는 단가를 낮춘 모델이 아닙니다
2. 입력 2달러·출력 10달러는 전작과 같습니다
3. 반복 업무는 비용과 추론 설정을 함께 봐야 합니다

가격은 같고, 같은 일을 끝내는 방식이 달라졌습니다

클로드 소넷 5.5는 앤트로픽(생성형 AI 기업)의 클로드 5.5 제품군 두 번째 모델입니다. 회사는 이 모델을 복잡하고 장기적인 판단이 필요한 작업보다는 코드 수정, 문서·슬라이드·스프레드시트 작성처럼 범위가 비교적 뚜렷한 업무에 맞춘 모델로 소개했습니다.

API 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러입니다. 캐시 읽기는 0.20달러, 캐시 쓰기는 2.50달러입니다. 이는 소넷 5와 같은 단가입니다. 따라서 ‘비용 최대 30% 절감’은 가격표가 내려갔다는 뜻이 아니라, 앤트로픽이 같은 작업에 필요한 토큰과 작업 단계를 줄였다고 설명한 결과입니다.

출력 생성 속도도 소넷 5보다 30% 이상 빨라졌다고 회사는 밝혔습니다. 다만 이 수치와 비용 절감 폭은 앤트로픽의 발표 및 내부 평가에 따른 것입니다. 실제 비용은 요청의 길이와 반복 횟수, 선택한 추론 수준에 따라 달라질 수 있습니다.

코딩 평가 점수보다 업무 범위가 더 중요합니다

앤트로픽은 에이전트형 코딩 평가인 터미널벤치 4.0에서 소넷 5.5가 70.6%를 기록했다고 발표했습니다. 소넷 5의 10.3%보다 높은 수치입니다. 여러 코드 파일을 다루는 커서벤치 4.0에서는 55.5%를 기록했다고 밝혔습니다.

하지만 이 점수만으로 모든 업무에 상위 모델을 대신한다고 보기는 어렵습니다. 앤트로픽은 지속적인 판단이 필요한 복잡하고 개방적인 작업에서는 클로드 오퍼스 5.5가 여전히 강점이 있다고 설명했습니다. 소넷 5.5의 핵심은 최고 난도 과제를 모두 맡는 데 있기보다, 목표가 선명한 업무를 빠르게 반복하는 데 있습니다.

추론에 쓰는 자원을 조절하는 노력 수준 설정도 이 구분과 연결됩니다. 설정을 높이면 더 많은 토큰을 쓰고 처리 과정이 길어질 수 있습니다. 단가가 같더라도 결과를 여러 차례 고치거나 높은 추론 수준을 계속 쓰면, 작업당 비용이 회사가 제시한 절감 폭과 다르게 나타날 수 있습니다.

서울 리전 지원은 데이터 처리 위치의 선택지입니다

AWS는 9월 30일 아마존 베드록에서 클로드 오퍼스 5와 클로드 소넷 5를 포함한 모델을 AWS 아시아태평양(서울) 리전 기반으로 제공한다고 밝혔습니다. 이에 따라 기업과 기관은 클로드 모델의 추론 과정과 고객 데이터를 국내에서 처리할 수 있는 선택지를 갖게 됐습니다.

이는 금융·공공·헬스케어처럼 데이터 국내 처리 요건을 살펴야 하는 조직에 특히 관련이 있습니다. 별도의 인프라 변경 없이 베드록에서 리전별 추론 프로필을 선택하면 된다는 것이 AWS의 설명입니다. 다만 각 조직이 실제로 어떤 데이터와 업무에 적용할 수 있는지는 자체 보안·규정 검토가 필요합니다.

클로드 소넷 5.5를 볼 때는 ‘더 싸다’는 한 문장보다, 반복할 업무가 명확한지와 그 업무에 얼마나 많은 토큰·추론 단계를 쓰는지를 함께 따져보는 편이 정확합니다.

이 글은 생성형 AI를 활용해 자료를 정리하고 작성했습니다. 오류나 정정 요청은 [email protected]로 알려 주세요.