클로드 소네트 5를 소개합니다
요약
앤트로픽 팀이 가장 에이전틱(Agentic)한 성능을 자랑하는 새로운 클로드 소네트 5 모델을 출시했어요. 이전 모델보다 똑똑하고 안전하며, 고가 모델에 버금가는 성능을 합리적인 가격에 제공해서 개발자들의 다단계 작업 효율을 크게 높여줄 거예요.
인사이트
- **향상된 에이전틱 능력**: 소네트 5는 계획 수립, 도구 사용, 자율 실행 능력이 대폭 향상되어 이전에는 더 크고 비싼 모델에서나 가능했던 복잡한 다단계 작업을 효과적으로 처리할 수 있어요.
- **가격 대비 성능 최적화**: 오푸스(Opus) 모델에 근접하는 성능을 더 낮은 가격으로 제공해서, 특히 중간 수준의 노력(effort)에서 탁월한 비용 효율성을 보여줍니다.
- **강화된 안전성과 안정성**: 이전 모델인 소네트 4.6보다 원치 않는 행동이 적고, 악성 요청 거부, 프롬프트 주입 공격 저항 등 에이전트 환경에서 더 안전하게 사용할 수 있도록 개선되었어요.
왜 중요한가
클로드 소네트 5는 개발자들이 더 저렴한 비용으로 복잡한 에이전트 작업을 수행할 수 있게 해주는 중요한 모델이에요. 특히 코드 작업, 디버깅, 지식 작업 등에서 탁월한 성능을 발휘하며, 이는 AI 기반 자동화의 접근성을 넓히고 개발 워크플로우의 생산성을 크게 향상시킬 수 있다는 점에서 중요합니다.
클로드 소네트 5를 소개합니다

클로드 소네트 5는 역대 소네트 모델 중 가장 에이전틱(Agentic)하게 설계되었어요. 불과 몇 달 전까지만 해도 더 크고 비싼 모델에서나 가능했던 수준으로 계획을 세우고, 브라우저나 터미널 같은 도구를 사용하며, 자율적으로 작업을 수행할 수 있죠.
많은 개발자에게 에이전틱 AI 시대는 소네트 클래스 모델들과 함께 시작되었어요. 클로드 소네트 3.5, 3.6, 3.7은 코딩과 도구 사용에서 인상적인 실력을 보여준 최초의 모델들이었죠. 하지만 최근에는 에이전틱 기능의 가장 큰 발전은 앤트로픽 팀의 오푸스(Opus) 클래스 모델들에서 나타났어요.
소네트 5는 그 격차를 좁혀줘요. 오푸스 4.8과 비슷한 성능을 보여주면서도 가격은 더 저렴하거든요. 추론, 도구 사용, 코딩, 지식 작업 등 에이전틱 성능의 중요한 측면에서 이전 모델인 소네트 4.6보다 훨씬 개선되었어요.

앤트로픽 팀의 안전성 평가에 따르면, 소네트 5는 소네트 4.6보다 전반적으로 바람직하지 않은 행동 발생률이 더 낮았어요. 그래서 에이전트 환경에서 사용하기에 전반적으로 더 안전하다고 할 수 있죠. 또한 평가 결과, 현재 오푸스 모델들보다 사이버 보안 작업을 수행하는 능력은 훨씬 낮다는 것도 확인되었어요.
오늘부터 클로드 소네트 5는 모든 요금제에서 사용할 수 있어요. 무료 및 Pro 요금제의 기본 모델이며, Max, Team, Enterprise 사용자도 이용할 수 있죠. 클로드 코드(Claude Code)와 클로드 플랫폼(Claude Platform)에서도 사용 가능하며, 2026년 8월 31일까지는 백만 입력 토큰당 2달러, 백만 출력 토큰당 10달러의 출시 기념 할인가가 적용될 예정이에요. 그 이후에는 백만 입력 토큰당 3달러, 백만 출력 토큰당 15달러로 가격이 책정돼요. 개발자들은 클로드 API를 통해 claude-sonnet-5를 이용할 수 있어요.
클로드 소네트 5와 함께 작업하기
아래 차트들은 에이전틱 검색 평가인 BrowseComp와 컴퓨터 사용 평가인 OSWorld-Verified에서 다양한 노력(effort) 수준별로 소네트 5와 소네트 4.6, 오푸스 4.8의 성능을 비교한 결과예요. 소네트 5(주황색 선)는 소네트 4.6(회색 선)보다 확실히 개선된 모습을 보여주며, 오푸스 4.8(노란색 선)보다 훨씬 더 다양한 비용-성능 옵션을 제공해요. 중간 수준의 노력에서는 비용 효율성이 상당히 좋아졌고요, 더 높은 노력 수준에서는 일부 작업에서 오푸스 4.8과도 맞먹는 성능을 보여줄 수 있어요. 소네트 5와 오푸스 4.8 사이에서 사용자들은 노력 수준을 조절해서 비용과 성능의 적절한 균형을 찾을 수 있을 거예요.

앤트로픽 팀의 얼리 액세스 파트너들로부터 받은 피드백은 한결같았어요. 소네트 5가 이전 모델들보다 훨씬 더 에이전틱하다는 내용이었죠. 테스터들은 이전 소네트 모델들이 중간에 멈추던 복잡한 작업들을 소네트 5가 끝까지 완료한다는 점, 명시적으로 요청하지 않아도 스스로 결과물을 확인한다는 점, 그리고 이 모든 에이전틱 작업을 매력적인 가격으로 수행한다는 점을 언급했어요.
클로드 소네트 5는 다단계 소프트웨어 엔지니어링 작업에서 앤트로픽 팀의 에이전트들에게 강력한 실행 계층을 제공해요. 복잡한 기술 환경에서 지속적인 코딩, 도구 사용, 디버깅을 잘 처리하고, 특히 완료율과 기술적 기반이 중요한 워크플로우에서 매우 유용하다고 해요.
클로드 소네트 5에게 세일즈포스(Salesforce) 계정 등급 업데이트와 기업 고객에게 출시 발표 알림 보내기라는 두 가지 작업을 맡겼더니, 처음부터 끝까지 다 끝내버리더군요. 예전 같으면 중간에 멈췄을 거예요. 일상적인 자동화 작업에는 정말 탁월한 선택이에요.
클로드 소네트 5는 더 적은 것으로 더 많은 것을 해내요. 결과물 품질은 동일하면서도 거기에 도달하는 단계는 줄어들었죠. 게다가 안전하지 않은 요청은 깔끔하고 일관되게 거부하고요. Lovable에서는 수백만 명의 빌더들에게 강력한 도구를 제공하고 있어요. '안 돼'라고 말할 줄 아는 모델은 '만들 줄 아는' 모델만큼이나 중요해요.
앤트로픽 팀은 클로드 소네트 5에 수십 개의 가장 까다로운 실제 풀 리퀘스트를 맡겼는데, 소네트 5는 각각을 테스트하고 검증된 결과까지 스스로 처리했어요. 덕분에 앤트로픽 팀의 엔지니어들은 판단, 결정, 최종 승인에 집중할 수 있었죠.
클로드 소네트 5에게 버그 조사를 요청했는데, 별다른 프롬프트 없이도 재현 테스트를 작성하고, 수정 사항을 구현한 다음, 변경 사항 없이 버그가 다시 발생하는지 확인하기 위해 수정 내용을 임시 저장까지 하더군요. 이 모든 것을 한 번에 처리했어요.
클로드 소네트 5 덕분에 에이전트들은 계획대로 작업을 진행하고, 앤트로픽 팀의 컨벤션을 따르며, 깔끔한 다단계 변경 사항을 효율적인 비용으로 제공하고 있어요.

0
클로드 소네트 5는 브라운필드 코드(brownfield code) 작업에 특히 강해요. 경쟁 조건, 숨겨진 테스트, 아무도 손대고 싶어 하지 않는 부분 같은 곳에서 말이죠. 실패의 실제 근본 원인을 추적해서 증상만 패치하는 대신 영구적인 해결책을 제공해요.

1
클로드 소네트 5는 이브(Eve)의 원고측 법률 업무에서 파레토 효율(Pareto frontier)을 달성했어요. 법률 연구 및 분석에서 가장 확실한 개선을 보았고, 가격 대비 성능 비율이 너무 좋아서 쉽게 전환할 수 있었죠.

2
클릭하우스(ClickHouse) 에이전트들은 실시간 데이터를 탐색하고 즉석에서 인사이트를 생성하기 때문에, 새로운 모델을 테스트할 때는 인사이트 도달 시간이 중요해요. 클로드 소네트 5는 더 촘촘한 단계로 추론하고 사용자들에게 훨씬 더 빠르게 답변을 제공합니다. 이 속도 차이는 고객들이 체감할 수 있는 수준이에요.

3
Pace에서는 앤트로픽 팀의 컴퓨터 사용 에이전트들이 운영팀이 이미 사용하는 시스템에서 보험 워크플로우(제출 접수, 최초 통지, 손실 기록 등)를 실행해요. 클로드 소네트 5는 일관되게 올바른 조치를 빠르고 신속하게 취하는데, 이게 바로 실제 보험 업무가 요구하는 바죠.
안전성 평가
앤트로픽 팀의 배포 전 안전성 평가에 따르면, 소네트 5는 전반적으로 소네트 4.6보다 개선되었어요. 에이전트 안전성 측면에서는 악의적인 요청을 거부하고 프롬프트 주입 공격에서 탈취 시도를 저항하는 능력이 더 좋아졌죠. 또한 소네트 4.6보다 환각(Hallucination) 및 아첨(Sycophancy) 발생률이 낮게 나타났어요. 오용 협력 및 기만과 같은 다양한 오정렬(misaligned) 행동을 테스트하는 자동 행동 감사에서는 소네트 5가 전반적으로 더 낮은 점수(즉, 더 안전함)를 기록했어요. 하지만 이 평가에서 더 강력한 오푸스 4.8 및 클로드 미토스 프리뷰(Claude Mythos Preview)에 비해서는 오정렬 행동 발생률이 다소 높게 나타나기도 했어요.

앤트로픽 팀은 소네트 5를 사이버 보안 작업에 의도적으로 훈련하지 않았어요. 이 모델은 일부 일상적이고 해롭지 않은 사이버 작업을 수행할 수 있지만, 소프트웨어 익스플로잇 개발과 같이 잠재적으로 위험한 사이버 기술을 테스트하는 평가에서는 오푸스 4.8 및 미토스 5(Mythos 5)와 같은 모델보다 성능이 훨씬 떨어지는 것으로 나타났어요. 파이어폭스(Firefox) 브라우저의 취약점에 대한 익스플로잇 개발 능력을 테스트한 한 평가의 점수가 아래 차트에 나와 있어요. 소네트 5는 완전한 작동 익스플로잇을 개발한 적은 없지만, 소네트 4.6보다는 부분적인 성공률이 약간 더 높게 나타났어요. 이 변화는 특정 훈련보다는 전반적인 지능 향상 때문일 가능성이 커요.

소네트 5가 이러한 작업에서 이전 모델보다 다소 강력해졌기 때문에, 앤트로픽 팀은 사이버 안전장치를 기본으로 활성화해서 출시했어요. 실시간으로 위험한 사이버 사용을 감지하고 차단하는 이 안전장치는 클로드 오푸스 4.7 및 4.8에 적용된 것과 동일해요. (소네트 5의 전반적인 사이버 보안 위험 수준이 낮다고 판단했기 때문에, 훨씬 더 광범위한 사이버 보안 작업을 차단하는 Fable 5와 함께 출시된 안전장치보다는 덜 엄격해요.)1
앤트로픽 팀은 소네트 5의 다양한 안전성 및 기능 평가에 대한 전체 보고서는 클로드 소네트 5 시스템 카드에서 확인할 수 있어요.
출시 및 가격
클로드 소네트 5는 오늘부터 어디서든 사용할 수 있으며, 2026년 8월 31일까지는 백만 입력 토큰당 2달러, 백만 출력 토큰당 10달러의 출시 기념 할인가가 적용돼요. 그 이후에는 백만 입력 토큰당 3달러, 백만 출력 토큰당 15달러의 표준 가격으로 변경될 예정이에요.2 더 높은 노력 수준에서 더 많은 토큰 사용량을 수용하기 위해 앤트로픽 팀은 챗(Chat), 코워크(Cowork), 클로드 코드(Claude Code), 클로드 플랫폼(Claude Platform) 전반에 걸쳐 API 호출 한도(rate limits)를 늘렸어요.3 사용자들은 특정 프로젝트에 맞는 적절한 수준을 선택할 수 있습니다.
변경 로그
2026년 6월 30일 수정: 이 게시물의 원본 버전에서는 에이전틱 검색 평가에 사용되는 표준 방법론을 반영하지 않는 더 간단한 방법론의 데이터를 기반으로 한 BrowseComp 평가 비용-성능 차트를 포함했었어요. 이로 인해 평가에서 소네트 5의 성능이 과소평가되었죠.
현재는 소네트 5 시스템 카드에서 사용하고 논의했던 방법론(압축 및 프로그램 방식 도구 호출을 포함한 1천만 토큰 예산 사용)과 일치하도록 차트를 업데이트했어요. 관련 본문도 함께 업데이트했습니다.
각주
1 소네트 5는 앤트로픽 팀의 사이버 검증 프로그램의 일부이며, 이 프로그램은 오늘부터 네이티브 클로드 플랫폼, AWS의 클로드 플랫폼, Microsoft Foundry의 클로드(Azure 및 Anthropic에서 호스팅)에서 사용할 수 있고, 곧 Google Vertex의 클로드에서도 제공될 예정이에요. 이미 사이버 검증 프로그램에 등록된 조직은 다시 신청할 필요 없이 소네트 5에서도 동일하게 접근할 수 있어요. 전반적으로 가드레일(guardrails)이 완화된 사이버 보안 작업에는 클로드 오푸스 4.8을 추천합니다.
2 소네트 5는 소네트 4.6의 업그레이드 버전이지만, 성능 향상을 위해 텍스트 처리 방식을 변경하는 업데이트된 토크나이저를 사용해요(이는 클로드 오푸스 4.7에서 도입했던 토크나이저 변경과 유사하죠). 그 결과, 동일한 입력이 콘텐츠 유형에 따라 약 1.0~1.35배 더 많은 토큰에 매핑될 수 있어요. 출시 기념 할인가격은 소네트 5로의 전환이 대략적인 비용 중립을 유지하도록 설정되었습니다.
3 2026년 4월 26일, 앤트로픽 팀은 네이티브 클로드 플랫폼에서 모든 사용 계층의 소네트 및 하이쿠(Haiku) API 호출 한도를 늘리고, Start, Build, Scale의 세 가지 계층으로 단순화했어요. 클로드 콘솔에서 현재 계층 및 한도를 확인하거나 문서를 읽고 더 자세히 알아볼 수 있어요.
인류의 마지막 시험(Humanity’s Last Exam): 앤트로픽 팀은 인류의 마지막 시험 채점 모델을 업데이트했고, 소네트 4.6 점수를 (도구 사용 없이) 34.6%, (도구 사용 시) 46.8%로 업데이트했어요. 이 때문에 소네트 4.6 출시 블로그에 보고된 점수와 차이가 나는 거예요. OSWorld-Verified: 앤트로픽 팀은 모델의 실제 성능을 더 정확하게 반영하기 위해 OSWorld-Verified 평가 실행 방식을 변경했으며, 소네트 4.6 점수를 78.5%로 업데이트했어요. 이 때문에 소네트 4.6 출시 블로그에 보고된 점수와 차이가 나는 거예요.
관련 콘텐츠
Fable 5 재배포
Fable 5가 7월 1일에 전 세계적으로 다시 출시될 예정이에요. 앤트로픽 팀은 또한 아마존, 마이크로소프트, 구글 및 다른 글래스윙(Glasswing) 파트너들과 함께 탈옥(jailbreak) 심각도를 평가하기 위한 산업 전반의 프레임워크를 제안하고 있어요.
과학자들을 위한 AI 워크벤치, 클로드 사이언스(Claude Science)가 출시되었어요
클로드 사이언스는 연구자들이 가장 자주 사용하는 도구와 패키지를 통합하고, 감사 가능한 결과물을 생성하며, 컴퓨팅 리소스에 유연하게 접근할 수 있도록 해주는 맞춤형 앱이에요.