본문 바로가기

콩's AI

앤트로픽 Claude Sonnet 5 출시! 가격, 성능, 보안 정보 완벽 정리

반응형
앤트로픽 Claude Sonnet 5 출시! 가격, 성능, 보안 정보 완벽 정리

스스로 일하는 AI의 등장! 클로드 5 소넷(Claude Sonnet 5) 출시 분석

1. 클로드 5 소넷의 핵심은 '에이전트 능력'

2026년 6월 30일, 앤트로픽이 완전히 새로워진 Claude Sonnet 5 모델을 공식 출시했습니다. 이번 모델의 핵심 키워드는 단연 에이전트(Agentic) 능력입니다.

단순히 답변을 제공하는 것을 넘어 스스로 계획을 세우고, 브라우저와 터미널 등의 도구를 직접 조작하며 자율적으로 작업을 수행하는 수준에 이르렀습니다. 불과 몇 달 전까지만 해도 훨씬 무겁고 값비싼 모델(Opus 클래스)에서만 가능했던 일들을 이제는 소넷 클래스에서 가볍게 처리할 수 있게 되었습니다.

  • 과거 Sonnet 3.5, 3.6, 3.7 모델이 코딩과 도구 사용 능력으로 에이전트 시대의 막을 열었다면, 이제 Sonnet 5는 그 흐름을 완성하는 단계에 접어들었습니다.
  • 가장 뛰어난 Opus 4.8 모델과의 성능 격차를 크게 좁혔으면서도, 비용은 훨씬 저렴하여 실용성을 극대화했습니다.
  • 이전 세대인 Sonnet 4.6과 비교했을 때 추론력, 도구 사용, 코딩, 지식 작업 등 모든 영역에서 괄목할 만한 성장을 이루어냈습니다.

2. 압도적인 가성비와 유연성

에이전트 검색 평가(BrowseComp)와 컴퓨터 조작 능력 평가(OSWorld-Verified) 그래프에서 알 수 있듯이, Sonnet 5는 이전 Sonnet 4.6에 비해 월등히 개선된 비용 대비 성능 효율을 보여줍니다.

사용자는 프로젝트 상황에 따라 AI의 '노력 수준(Effort Level)'을 조절할 수 있습니다.

  • 중간(Medium) 노력 수준: 가격 대비 생산성 효율이 가장 극대화되는 구간입니다.
  • 높은(High) 노력 수준: 한층 심도 있는 자율 추론 작업을 수행하며, 일부 작업 영역에서는 최고 사양인 Opus 4.8에 필적하는 성능을 뿜어냅니다.

사전 테스트에 참여한 얼리 액세스 파트너들은 "Sonnet 5는 이전 모델들이 막히거나 멈추던 복잡한 태스크를 끝까지 완수하며, 직접 요청하지 않아도 결과물을 스스로 교차 검증하고 수정하는 놀라운 능력을 보여준다"라며 칭찬을 아끼지 않았습니다.

요금 및 이용 안내

3. 이용 요금 및 요금제 혜택

Claude Sonnet 5는 오늘부터 즉시 모든 요금제 사용자가 만날 수 있습니다. Free(무료) 요금제와 Pro 요금제의 기본 모델로 지정되었으며, Max, Team, Enterprise 사용자에게도 모두 열려 있습니다. 또한 개발자 도구인 Claude Code와 Claude API(모델명: claude-sonnet-5)로도 바로 연동 가능합니다.

토큰당 가격 정책

기간 구분 입력(Input) 토큰 가격 (100만 개 기준) 출력(Output) 토큰 가격 (100만 개 기준)
출시 기념 할인 (2026년 8월 31일까지) $2 $10
정상가 (2026년 9월 1일부터) $3 $15

참고로 가장 뛰어난 Opus 4.8의 가격이 입력 $5 / 출력 $25인 것에 비하면 대단히 파격적인 요금 책정입니다.

다만, 이번 Sonnet 5는 성능 극대화를 위해 Claude Opus 4.7에서 처음 선보였던 새로운 토크나이저(Tokenizer)를 탑재했습니다. 텍스트 처리 방식이 개선되면서 같은 분량의 입력이라도 약 1.0 ~ 1.35배 더 많은 토큰으로 변환될 수 있습니다. 앤트로픽은 사용자의 실질적인 전환 비용 부담을 덜어주기 위해 8월 말까지 할인 혜택을 제공하므로, 체감 비용은 이전과 거의 비슷하게 유지될 것입니다.

4. 더욱 견고해진 안전성과 보안 성능

에이전트가 알아서 컴퓨터와 브라우저를 만지는 시대가 온 만큼, 해킹이나 악용 우려에 대비한 안전성 평가도 한층 엄격하게 거쳤습니다.

  • 유해 요청 거부 및 프롬프트 주입 공격 방어: 악성 요청을 단호하게 거부하고 교묘한 탈옥 시도를 무력화하는 능력이 Sonnet 4.6보다 뛰어납니다.
  • 환각(Hallucination) 및 아첨(Sycophancy) 지표 감소: 사실이 아닌 정보를 지어내거나 사용자의 의견에 무조건 동조하는 성향을 눈에 띄게 개선했습니다.
  • 태도 감사(Behavioral Audit): 기만적이거나 일탈적인 행동 양상을 측정하는 테스트에서 Sonnet 4.6보다 안전하다는 점이 증명되었습니다. 단, 최고 스펙인 Opus 4.8이나 Claude Mythos Preview와 비교하면 다소 미성숙한 모습을 보이기도 합니다.

사이버 보안 및 가드레일 작동 방식

Sonnet 5는 악의적인 사이버 활동을 위해 특화 훈련된 모델이 아닙니다. 모질라(Mozilla)와 협업하여 파이어폭스 브라우저 취약점 해킹 테스트를 진행한 결과, Sonnet 5는 완전한 익스플로잇 코드를 작성하는 데 전혀 성공하지 못해 최종 성공률 0%를 기록했습니다. (일부 부분 성공률만 단순 지능 향상 덕에 소폭 늘어났을 뿐입니다.)

안전한 사용을 돕기 위해 실시간 사이버 보안 가드레일이 기본으로 켜진 상태로 출시되었습니다. 이 방어막은 Claude Opus 4.7 및 4.8에 적용된 수준과 동일하며, 무차별적으로 모든 활동을 차단하는 Fable 5 시스템에 비해서는 유연하게 설계되어 정상적인 비즈니스 활용을 방해하지 않습니다.

5. 기타 변경 사항 및 수정된 벤치마크 결과

앤트로픽은 이번 출시와 함께 더욱 객관적인 비교를 위해 과거 벤치마크 측정 기준을 바로잡고 일부 오류를 투명하게 공개했습니다.

  • BrowseComp 차트 데이터 수정: 최초 공지 당시 복잡한 에이전트 검색 평가를 간략한 방법론으로 측정하여 Sonnet 5의 실제 능력이 과소평가되어 있던 문제를 수정했습니다. 시스템 카드에 명시된 정식 표준 방법론(1,000만 토큰 한도 압축 및 프로그래밍 도구 호출 방식)을 적용해 차트를 업데이트했습니다.
  • Humanity's Last Exam (난이도 최상 테스트) 데이터 갱신: 채점기 모델의 기준을 재정비함에 따라, 비교 대상인 Sonnet 4.6의 기존 점수가 도구 미사용 시 34.6%, 도구 사용 시 46.8%로 정정되었습니다.
  • OSWorld-Verified 기준 수정: 실제 환경에 더욱 부합하도록 실행 방식을 고침에 따라 Sonnet 4.6의 점수가 78.5%로 업데이트되었습니다. 이전 출시 블로그의 기록과 다른 점은 이 때문입니다.
  • API 사용량 한도 간소화 및 상향: 높은 노력 수준의 추론 사용에 원활히 대응하기 위해 Chat, Cowork, Claude Code, Platform 전 영역의 사용량 한도를 늘렸습니다. 아울러 플랫폼 등급을 기존 복잡한 단계에서 Start, Build, Scale 3개 단계로 단순화하여 체계적으로 관리할 수 있게 되었습니다.

※ Sonnet 5는 앤트로픽의 '사이버 검증 프로그램(Cyber Verification Program)' 대상 모델입니다. 이미 프로그램에 등록되어 있던 기업은 AWS, Microsoft Foundry, Google Vertex 및 기본 플랫폼 어디서나 재신청 없이 바로 보안 적용 혜택을 이어받을 수 있습니다. 고도의 보안 작업이 요구되는 환경에서는 원칙적으로 가드레일을 커스터마이징할 수 있는 Claude Opus 4.8 버전을 강력히 권장합니다.

반응형

⚠️ 광고 차단 프로그램 감지

애드블록, 유니콘 등 광고 차단 확장 프로그램을 해제하거나
화이트리스트에 추가해주세요.