클로드 페이블 5 및 클로드 미토스 5
요약
Anthropic이 최신 '미토스급' 모델인 클로드 페이블 5(일반 사용자용)와 클로드 미토스 5(사이버 방어 전문가용)를 출시했어요. 이 모델들은 소프트웨어 엔지니어링, 지식 작업, 비전, 생명 과학 등 여러 분야에서 이전 모델들을 뛰어넘는 최첨단 성능을 자랑하며, 특히 페이블 5는 강력한 안전장치를 통해 안전한 AI 배포를 강조하고 있어요.
인사이트
- 페이블 5와 미토스 5는 Anthropic의 역대 모델 중 가장 강력한 성능을 보여주며, 소프트웨어 엔지니어링, 지식 작업, 비전, 기억력, 약물 설계, 유전체학 연구 등 다양한 영역에서 혁신적인 발전을 이끌었어요.
- 일반 사용자를 위한 페이블 5는 사이버 보안, 생물학/화학, 지식 증류(모델 역량 추출)와 같은 민감한 주제에 대한 요청을 자동으로 클로드 오푸스 4.8로 넘기는 강력한 안전 분류기를 탑재하여 오용을 방지하고 있어요.
- 미토스 5는 페이블 5와 동일한 모델이지만, '프로젝트 글라스윙'에 참여하는 사이버 방어 전문가나 생물학 연구를 위한 '신뢰할 수 있는 접근' 프로그램 참여자들에게는 일부 안전장치를 해제하여 특정 분야에서 최고 수준의 역량을 제공해요.
왜 중요한가
이 모델들은 AI가 단순한 정보 처리기를 넘어 복잡한 문제를 자율적으로 해결하고, 인간의 전문성을 보강하며, 과학 연구와 산업 생산성을 획기적으로 향상시킬 수 있는 잠재력을 보여줘요. 동시에, 강력한 AI 모델을 안전하게 배포하기 위한 Anthropic의 노력과 접근 방식은 책임감 있는 AI 개발의 중요성을 강조하고 있어요.

클로드 미토스 5와 페이블 5 재배포
2026년 7월 1일
클로드 페이블 5와 미토스 5가 이제 사용 가능해요.
더 읽어보기
클로드 미토스 5 및 페이블 5 접근 불가
2026년 6월 12일
Anthropic은 클로드 페이블 5와 클로드 미토스 5에 대한 접근을 일시 중단하고 있어요. 고객 여러분께 불편을 드려 죄송하며, 최대한 빨리 접근을 복원하기 위해 노력하고 있어요.
더 읽어보기
오늘 Anthropic은 클로드 페이블 5를 출시했어요. 페이블 5는 일반적인 용도로 안전하게 사용할 수 있도록 만든 미토스급1 모델이에요.
페이블 5의 역량은 Anthropic 팀이 지금까지 일반에 공개했던 어떤 모델보다도 뛰어나요. 테스트된 거의 모든 AI 성능 벤치마크에서 최첨단 성능을 보여주며, 소프트웨어 엔지니어링, 지식 작업, 비전, 과학 연구 및 기타 여러 분야에서 탁월한 성능을 발휘하고 있어요. 작업이 길고 복잡할수록 페이블 5는 다른 모델들보다 훨씬 앞서나가요.
이렇게 강력한 모델을 출시하는 데는 위험이 따르죠. 안전장치가 없다면, 페이블 5의 사이버 보안 같은 분야에서의 역량은 심각한 피해를 유발하는 데 오용될 수 있거든요. 그래서 Anthropic은 특정 주제에 대한 문의는 Anthropic 팀의 다음으로 유능한 모델인 클로드 오푸스 4.8이 대신 답변하도록 안전장치를 적용해서 모델을 출시했어요. 모델을 안전하고 빠르게 출시하기 위해, 이 안전장치들은 보수적으로 튜닝되었어요. 그래서 가끔은 무해한 요청도 걸러낼 수 있지만, 평균적으로는 전체 세션의 5% 미만에서만 작동해요. 앞으로 몇 달 안에 더 강력한 모델들이 출시될 예정이므로, Anthropic 팀은 가능한 한 빨리 안전장치를 개선하고 오탐지율(false positive)을 줄이기 위해 노력하고 있어요.
사이버 방어 전문가 및 인프라 제공업체 소수의 그룹을 위해 Anthropic은 클로드 미토스 5도 출시하고 있어요. 이 모델은 페이블 5와 동일한 기반 모델이지만, 일부 영역에서 안전장치를 해제했어요.2 미토스 5는 처음에는 프로젝트 글라스윙을 통해 미국 정부와 협력하여 클로드 미토스 프리뷰의 업그레이드 버전으로 배포될 거예요. 이 모델은 전 세계 어떤 모델보다도 강력한 사이버 보안 역량을 가지고 있어요. 곧 Anthropic 팀은 더 광범위한 '신뢰할 수 있는 접근' 프로그램을 통해 미토스 5의 접근을 확대할 계획이에요.
페이블 5와 미토스 5 같은 모델의 역량은 세상에 엄청난 선한 영향을 미칠 잠재력을 가지고 있어요. Anthropic 팀은 프로젝트 글라스윙에서 그 가능성의 시작을 봤어요. 거기서 모델들은 사이버 방어팀을 도왔고 핵심 소프트웨어의 보안을 강화하는 데 기여했어요. 또한 생명 과학 연구에서도 모델들이 새로운 가설을 제시하고 신약 개발 속도를 높이는 것을 봤어요.
페이블 5와 미토스 5는 백만 입력 토큰당 10달러, 백만 출력 토큰당 50달러에 제공되고 있어요. 이는 클로드 미토스 프리뷰 가격의 절반도 안 되는 가격이죠. 오늘의 동시 출시는 가능한 한 빠르고 안전하게 많은 사용자에게 고급 AI 역량을 제공하려는 Anthropic 팀의 목표를 향한 또 다른 단계라고 할 수 있어요.
클로드 페이블 5 및 클로드 미토스 5 평가하기
아래 표는 페이블 5와 미토스 5의 역량을 다른 선두 모델들과 비교한 거예요.

페이블 5와 미토스 5는 이전 클로드 모델들보다 더 오랫동안 자율적으로 작동할 수 있어요. 아래에서는 이 기술들이 소프트웨어 엔지니어링에 어떻게 적용되는지 논의하고, 모델의 지식 작업, 비전, 기억력 및 생명 과학 연구에서의 향상된 역량을 다룰 거예요.
소프트웨어 엔지니어링. 초기 테스트에서 스트라이프는 페이블 5가 몇 달이 걸릴 엔지니어링 작업을 며칠로 단축했다고 보고했어요. 5천만 줄 규모의 루비 코드베이스에서, 이 모델은 전체 팀이 수작업으로 두 달 이상 걸렸을 코드베이스 전체 마이그레이션을 단 하루 만에 수행했어요. 페이블 5는 과거 클로드 모델보다 토큰 효율성도 더 뛰어나요. 모델이 어려운 코딩 작업을 수행하면서 고품질 프로덕션 코드베이스의 표준을 충족하는지 테스트하는 코그니션의 프론티어 코드 평가에서, 페이블 5는 중간 난이도에서도 최첨단 모델들 중 가장 높은 점수를 기록했어요.


지식 작업. 페이블 5는 복잡한 분석 작업에서 강력한 성능을 보여줘요. 시니어 레벨 추론을 위한 헤비아의 금융 벤치마크에서, 페이블 5는 문서 기반 추론, 차트 및 표 해석, 문제 해결에서 상당한 개선을 보이며 모든 모델 중 가장 높은 점수를 얻었어요. IMC는 페이블 5가 사실 조회, 개념적 추론, 근본 원인 분석, 기대 가치 분석 등 거의 모든 거래 분석 평가에서 만점을 받았다고 언급했어요.
비전. 페이블 5는 비전 관련 작업에서 새로운 최첨단 모델이에요. 상세한 과학 그림에서 정확한 숫자를 추출할 수 있고, 스크린샷만으로 웹 앱의 소스 코드를 재구성하는 것과 같은 복잡한 비전 기반 작업을 수행할 수 있어요. 또한 스캐폴딩(scaffolding)도 덜 필요해요. 예를 들어, 이전 클로드 모델들은 추가적인 유용한 도구를 제공하는 하네스(harness)를 사용했음에도 불구하고 포켓몬 파이어레드를 플레이하는 데 어려움을 겪었지만, 페이블 5는 최소한의 비전 전용 하네스로 파이어레드를 이겨냈어요.
기억력 및 긴 컨텍스트. 페이블 5는 장기 실행 작업에서 수백만 토큰에 걸쳐 집중력을 유지하고, 자체 메모를 사용하여 출력을 개선해요. Anthropic 팀이 모델에게 덱 빌딩 게임인 슬레이 더 스파이어를 플레이하게 했을 때, 영구적인 파일 기반 메모리에 접근 권한을 주자 오푸스 4.8보다 3배 더 성능이 향상되었고요. 페이블은 또한 게임의 최종 막에 3배 더 자주 도달했어요.
약물 설계: 미토스 5를 사용해서, Anthropic 팀의 내부 단백질 설계 전문가들은 약물 설계 프로세스의 여러 측면을 약 10배 정도 가속화했어요. 한 예로, 그들은 미토스 5가 단백질 설계 및 생물정보학 도구를 사용하고 인간의 도움 없이도 숙련된 인간 작업자와 같거나 더 나은 성능을 보인다는 것을 발견했어요. 이 과정에서 모델은 일반적으로 과학자가 수행하는 모든 작업, 즉 결합 부위 선택, 단백질 설계 도구 선택 및 실행, 그리고 과정 중의 실패로부터 복구하는 작업을 실행했어요. 이 연구의 14개 단백질 표적 중 9개(아래 참조)에서 Anthropic 팀이 현재 조사 중인 강력한 약물 설계 후보가 나왔어요.

분자 생물학 분야의 새로운 가설. 미토스 5는 일관되게 새롭고 설득력 있는 과학적 가설을 생성하는 Anthropic 팀의 첫 번째 모델이에요. 오푸스급 모델들과 블라인드 헤드투헤드 비교에서, Anthropic 팀의 과학자들은 미토스의 분자 생물학 가설을 약 80%의 확률로 선호했고, 여러 가설을 실험적 평가 단계로 진행시켰어요. 그동안, 미토스의 한 가설인 E. coli 단백질의 새로운 메커니즘은 동일한 문제를 독립적으로 연구하던 한 연구실의 한 연구에서 입증되었어요.
유전체학 분야의 새로운 연구. 미토스 5는 일주일 이상 거의 자율적으로 작업하여 새로운 유전체학 연구를 수행했어요. 수백만 개의 세포에 대한 단일 세포 데이터를 138종의 동물에서 수집하고, 멀리 떨어진 유기체에서도 동일한 역할을 수행하는 세포를 식별하기 위한 맞춤형 머신러닝 모델을 설계하고 훈련했어요. 높은 수준의 인간 입력만으로, 미토스 5의 훈련된 모델은 사이언스 저널에 최근 발표된 모델보다 100배 더 작았음에도 불구하고 더 뛰어난 성능을 보였어요. Anthropic 팀은 앞으로 몇 달 안에 이 결과를 발표할 예정이에요.
정렬 (Alignment). Anthropic 팀의 자동 정렬 평가에서, 미토스 5의 정렬되지 않은 행동 수준(기만 및 사용자의 모델 오용 협력과 같은 모델에 의해 취해진 정렬되지 않은 행동 포함)은 낮았고, 오푸스 4.8과 유사한 수준이었어요. 동일한 기반 모델이기 때문에 페이블 5의 정렬 수준도 비슷할 거예요. 평가는 모델의 시스템 카드 및 Anthropic 팀의 최신 위험 보고서에서 다른 안전 및 역량 테스트 스위트와 함께 자세히 설명되어 있어요.

클로드 페이블 5에 대한 초기 피드백
초기 접근 권한을 가진 고객들은 페이블 5에 대해 자체 테스트를 진행했어요. 아래는 그들이 목격한 내용 중 일부를 직접 언급한 거예요.
클로드 페이블 5는 CursorBench에서 최첨단 모델이에요. 이전 모델로는 불가능했던 장기적인 문제들을 해결할 수 있게 해줬죠.

0
클로드 페이블 5는 GitHub가 서비스하는 개발자들에게 진정한 발전이에요. 초기 테스트에서 이 모델은 이전 벤치마크를 뛰어넘는 자율성과 신뢰성으로 복잡하고 장기적인 코딩 작업을 수행했어요. 하지만 저희를 가장 흥분시키는 것은 이것이 가리키는 방향이에요. 개발자들이 점점 더 야심찬 작업을 에이전트에게 맡기고 소프트웨어 수명 주기 전반에 걸쳐 결과를 신뢰할 수 있는 미래 말이죠.

1
이것은 우리가 테스트할 기회가 있었던 모든 클로드 모델 중 가장 강력한 결과예요. 클로드 페이블 5는 에이전틱 코딩과 프로토타이핑에서 명확한 진보를 보여줘요.

2
클로드 페이블 5의 추론 능력은 오푸스 4.8을 명확히 뛰어넘어요. 선임 연구 과학자 수준으로 작동하며, 방향을 정하고, 자원을 할당하고, 잘못된 믿음을 버리고, 새로운 근본 원리 결과물을 생산하죠.

3
클로드 페이블 5는 빌더들이 입력한 내용뿐만 아니라 그들이 무엇을 의미하는지 이해해요. 1년 전에는 100개의 프롬프트가 필요했던 앱들이 이제는 한 번에 완성되죠. 고객이 정말 막다른 길에 부딪혔을 때, 저희가 그들을 빠르게 돌파하게 하고 그들이 만들고자 했던 것을 끝낼 수 있도록 사용하는 모델이에요.

4
클로드 페이블 5는 실질적으로 달라요. 블라인드 리뷰에서 우리 변호사들은 이 모델의 수정본이 현재 저희 모델과 같거나 더 낫다는 것을 매번 발견했어요.

5
최대 노력 시, 클로드 페이블 5는 자신의 작업을 성찰하고 검증해요. 저희에게는 이것이 고도로 자율적인 운영을 가능하게 하는 것이죠. 추가적인 사고 과정이 그 자체로 가치를 지불하니까요.

6
클로드 페이블 5는 이전 모델보다 더 적은 상호작용으로 더 유능한 엔지니어링을 제공해요. 저희 직원이 클로드 코드에서 매일 실행하는 복잡한 다중 에이전트 워크플로우를 처리하죠.

7
클로드 페이블 5는 코그니션의 프론티어 코딩 평가인 FrontierBench에서 가장 높은 점수를 받은 모델이에요. 장기적인 추론에 탁월하고, 낯선 도구에도 즉시 일반화할 수 있어요.

8
클로드 페이블 5는 일반 금융 및 추론 모두에서 저희가 테스트한 금융 전용 모델 중 가장 강력해요. 주목할 만한 발전이죠.

9
클로드 페이블 5는 복잡하고 장기적인 분석 작업에 대한 저희의 핵심 분석 벤치마크에서 90%를 넘은 첫 번째 모델이에요. 이는 오푸스보다 10점이나 뛰어넘는 수치죠. 가장 어려운 질문에서도 강력한 판단력과 미묘한 차이에 대한 주의력을 보여줘요.
클로드 페이블 5는 최첨단 물리학 연구에서 저희가 테스트한 모델 중 가장 강력하면서도 추론 토큰은 3분의 1만 사용했어요. 36시간 만에 GPT-5.5가 4일 만에 도달한 수준에 거의 도달했죠.
저희의 엔드투엔드 바이브 코딩 벤치마크인 ViBench에서 클로드 페이블 5는 저희가 테스트한 모델 중 가장 성능이 뛰어나요. 기본 사용 사례를 거의 포화시키고 더 적은 시간과 토큰으로 앱을 구축하죠.

0
클로드 페이블 5는 모든 노력 수준에서 저희의 일상적인 스프레드시트 스위트에서 오푸스 4.8을 이겼어요. 그리고 더 적은 상호작용으로 실행을 25~30% 더 빠르게 완료하죠.
클로드 페이블 5의 새로운 안전장치
미토스급 모델들은 상당한 위험을 초래하는 임계점에 도달했어요. 지난 4월, Anthropic 팀은 프로젝트 글라스윙을 시작했고, 첫 미토스급 모델인 클로드 미토스 프리뷰를 소수의 사이버 방어 전문가 및 중요 소프트웨어 인프라 제공업체에게만 출시했어요. 그때 Anthropic 팀은 오용을 확실히 방지할 수 있는 새로운 안전장치를 개발하는 한, 궁극적으로 모든 사용자에게 미토스급 역량을 제공할 수 있기를 바란다고 밝혔어요.
지난 몇 달 동안 Anthropic 팀은 이러한 안전장치를 개선해 왔고, 이제 일반 출시를 위한 충분한 견고성을 갖추게 되었어요. 안전을 최우선으로 했기 때문에, Anthropic 팀은 안전장치를 신중하게 조정했고, 여전히 이상적인 것보다 엄격해요. 예를 들어, 때로는 양성 요청도 분류기에 의해 걸러질 수 있죠. Anthropic 팀은 이것이 일부 사용자에게는 불편할 것이라는 점을 인식하고 있으며, 출시 후 안전장치를 업데이트하고 개선하면서 오탐지율을 줄이는 것을 목표로 하고 있어요.
아래에서는 페이블 5의 새로운 안전장치 각각에 대해 논의할 거예요. Anthropic 팀의 더 광범위한 안전장치 스위트는 모델의 시스템 카드와 최신 위험 보고서에서 논의되고 평가되어 있어요.
안전 분류기
미토스급 모델의 최첨단 사이버 보안 및 연구 생물학 역량은 악의적인 행위자에게 상당한 향상(uplift) 위험을 초래할 수 있어요. 즉, 이 모델들은 악의적인 행위자들이 다른 출처(예: 인터넷 검색 엔진)에서는 얻을 수 없었던 정보를 제공하거나 조언을 하여 심각한 피해를 유발하는 데 도움을 줄 수 있다는 말이죠. 게다가 AI 모델의 고급 사용은 상당 부분 이중 용도에요. 사이버 보안 전문가와 생물학 연구자에게는 유익한 동일한 쿼리가 악의적인 행위자에게 제공되면 위험할 수 있거든요.
따라서 Anthropic 팀은 오용을 방지하기 위한 강력한 안전장치가 필요하고, 그 적용 범위는 광범위해야 해요. 안전장치 자체는 이를 우회하려는 지속적이고 정교한 시도(일명 시스템 '탈옥' 시도)에도 견딜 수 있어야 하죠. 미토스급 역량으로부터 얻을 수 있는 향상 효과는 많은 적대자들(예: 사이버 공격으로 금전적 이득을 얻을 수 있는 사람들)에게 가치가 있으므로, Anthropic 팀은 그들이 Anthropic 팀의 안전 조치를 우회하려고 할 것이라고 예상해요.
페이블 5에는 새로운 분류기 세트가 함께 제공돼요. 이 분류기들은 잠재적 오용(탈옥 시도 포함)을 감지하고 주 모델(이 경우 페이블 5)이 응답하는 것을 방지하는 별도의 AI 시스템이에요. Anthropic 팀은 꽤 오래전부터 모델에 분류기를 적용해왔고요. 페이블 5의 분류기들은 이 이전 작업의 확장으로, 추가적인 적용 범위를 가지고 있어요.
페이블의 분류기가 사이버 보안, 생물학 및 화학, 또는 지식 증류와 관련된 요청을 감지하면, 응답은 자동으로 클로드 오푸스 4.8에 의해 처리돼요. 이러한 상황이 발생할 때마다 사용자에게 통보될 거고요. 오푸스 4.8은 그 자체로 매우 유능한 모델이에요. 오푸스로 대체되는 응답은 페이블의 단호한 거부보다는 훨씬 나은 경험을 제공하죠. Anthropic 팀의 초기 데이터에 따르면 페이블 세션의 95% 이상에서 대체가 전혀 발생하지 않아요. 이 세션에서는 페이블 5의 성능이 미토스 5와 사실상 동일해요.
다음은 분류기가 다루는 영역들이에요:
- 사이버 보안. 미토스급 모델들은 소프트웨어 취약점을 발견하고 악용하는 데 뛰어나요. 따라서 사이버 공격을 훨씬 더 쉽고 저렴하게 만들 수 있죠. 미토스급 모델들은 또한 에이전틱 해킹에서도 강력한 기술을 보여줘요. 이는 익스플로잇 발견 외에도 정찰, 발견, 측면 이동 등 다양한 사이버 공격 부분을 수행하는 것을 포함해요. 이러한 에이전틱 해킹 기술이 사이버 공격에서 향상 효과를 제공하는 것을 방지하기 위해, Anthropic 팀은 사이버 보안 분류기를 익스플로잇 및 더 넓은 의미의 공격적 사이버 작업까지 포괄하도록 설계했어요. 아래 그래프에서 볼 수 있듯이, Anthropic 팀의 분류기는 페이블이 이러한 작업에서 어떤 진전도 이루지 못하도록 막아줘요.

Anthropic 팀은 탈옥 시도에 대한 견고성을 테스트하기 위해 분류기를 광범위하게 레드팀 테스트했어요. 내부 테스트뿐만 아니라 외부 버그 바운티를 진행했는데, 1,000시간 이상의 테스트에서 보편적인 탈옥이 발견되지 않았어요. Anthropic 팀이 참여했던 외부 레드팀 조직들도 지금까지 장기 에이전틱 작업에서 보편적인 탈옥을 찾지 못했어요. 비록 영국 AISI는 짧은 초기 테스트 기간 내에 하나의 탈옥에 진전을 보였지만요.4 보편적인 탈옥을 완전히 막는 것은 불가능할 수 있지만, Anthropic 팀의 목표는 남아 있는 탈옥이 대규모로 사용되기 전에 감지하고 막을 수 있을 만큼 느리고 비용이 많이 들도록 만드는 거예요.
아래 그래프는 Anthropic 팀의 내부 평가 중 하나로, 페이블 5의 안전장치가 이전의 일반 접근 모델보다 탈옥에 대한 저항력이 더 크다는 것을 보여줘요.

Anthropic 팀의 한 외부 파트너는 페이블 5의 유해한 사이버 쿼리에 대한 안전장치가 테스트된 모든 모델(오푸스 4.8 및 오푸스 4.7 포함) 중에서 가장 견고하다는 것을 발견했어요. 페이블 5는 사이버 공격 계획, 익스플로잇 개발 또는 방어 회피와 관련된 유해한 단일 턴 요청에 대해 전혀 응답하지 않았어요. 이는 30가지의 다른 공개 탈옥 기술 중 하나를 사용했는지 여부와 상관없이 유지되었어요.
- 생물학 및 화학. Anthropic 팀은 Anthropic 팀의 분류기를 사용하여 생물학 무기 관련 쿼리 중 일부만 모델이 응답하지 못하도록 꽤 오래전부터 차단해왔어요. 하지만 Anthropic 팀은 이러한 좁은 범위의 차단만으로는 충분하지 않다고 더 이상 확신할 수 없게 되었어요. 여기에는 두 가지 이유가 있어요. 첫째, Anthropic 팀은 자원과 역량을 갖춘 악의적인 행위자들이 매우 위험한 생물학 연구를 위해 Anthropic 팀 모델로부터 향상 효과를 얻으려 할 수 있다는 우려를 가지고 있어요. 둘째, 이제 모델들이 실제 과학적 작업을 수행하는 능력이 더 커졌기 때문이죠.
예를 들어, Anthropic 팀은 아데노 관련 바이러스(AAV) 설계의 어려운 단계를 완료하는 미토스 5의 능력을 테스트했어요. AAV는 유전자 치료 전달을 위한 구성 요소이지만, 동일한 역량이 잘못된 손에 들어가면 위험한 바이러스를 설계하는 데 사용될 수 있어요. 이 작업에서 다양한 AI 모델들은 유전적 변형이 바이러스의 외부 껍질 조립에 어떻게 영향을 미칠지 예측하는 능력(다이노 테라퓨틱스 Dyno Therapeutics가 개발한 치료 관련 미공개 후보들 중에서)을 평가받았어요. Anthropic 팀은 모델들이 이 작업을 수행하도록 명시적으로 훈련하지 않았지만, 미토스급 모델들은 생물학적 추론만으로 단백질 작업 전용의 정교한 모델('단백질 언어 모델'로 알려짐)보다 뛰어난 성능을 보였어요. 이는 유전자 치료 연구 및 개발에서 간단하지만 중요한 작업을 완료할 수 있는 유망한 능력을 보여주지만, 동시에 그러한 이중 용도 역량으로 인한 위험도 강조하고 있어요.

Anthropic 팀의 우선순위는 가능한 한 빨리, 그리고 안전하게 페이블을 출시하는 것이었기 때문에, 지나치게 광범위한 안전장치도 감수했어요. 따라서 당분간은 생물학 및 화학과 관련된 대부분의 요청에 대해 페이블이 오푸스 4.8로 대체되도록 조치했어요. Anthropic 팀의 모든 분류기와 마찬가지로, 가능한 한 빨리 이러한 안전장치를 좁히기를 바라고 있어요. 위에서 본 증거에서 알 수 있듯이, 과학 분야에서 페이블의 긍정적인 응용 가능성이 매우 크고, 분류기의 오탐지가 이를 방해하는 것을 원치 않으니까요. 앞으로 몇 주 안에 일부 생의학 연구자 및 기업은 미토스 5의 생물학 역량을 위한 '신뢰할 수 있는 접근' 프로그램(아래에서 논의)에 참여할 수 있을 거예요.
- 지식 증류. Anthropic 팀은 권위주의 국가에서 경쟁 모델을 훈련하기 위해 클로드의 역량을 추출하려는('증류') 대규모 시도를 이전에 식별했어요. 페이블 5의 능력을 증류하는 것은 간접적으로 최첨단 AI 역량의 확산을 초래할 수 있으며, 이러한 역량은 적절한 안전장치 없이 출시될 수 있거든요. Anthropic 팀의 분류기에 의해 이러한 증류 시도의 일부로 플래그된 요청은 오푸스 4.8로 처리돼요.
새로운 데이터 보존 정책
마지막으로, Anthropic 팀은 페이블 5, 미토스 5 및 유사하거나 더 높은 역량 수준의 미래 모델에 대한 비즈니스 고객 데이터 처리 방식에 변화를 줄 거예요. Anthropic 팀은 모든 미토스급 모델의 모든 트래픽에 대해, 1자 및 3자 표면 모두에서 30일간 데이터 보존을 의무화할 거예요. Anthropic 팀은 이 데이터를 새로운 클로드 모델을 훈련하거나 안전 관련 목적 이외의 용도로 사용하지 않을 것이며, 모든 인간의 데이터 접근 기록 및 거의 모든 경우 30일 후 데이터 삭제를 보장하는 새로운 개인 정보 보호 조치를 시행했어요(자세한 내용은 이 게시물 참조). 이 데이터는 Anthropic 팀이 복잡하고 새로운 공격(새로운 탈옥 및 여러 요청에 걸쳐 작동하는 공격 포함)을 방어하고 오탐지를 식별하고 줄이는 데 도움이 될 거예요.
클로드 미토스 5 및 '신뢰할 수 있는 접근' 프로그램
오늘부터 클로드 미토스 프리뷰에 현재 접근 권한이 있는 모든 사용자(예: 프로젝트 글라스윙의 사이버 보안 파트너)는 클로드 미토스 5로 업그레이드할 수 있어요. 이는 클로드 페이블 5와 동일한 모델이지만 사이버 안전장치가 해제되어 있죠. 사용자들은 미토스 5가 대부분의 경우 미토스 프리뷰와 비슷하거나 다소 더 강력하며, 비용은 훨씬 저렴하다는 것을 알게 될 거예요.
미국 정부와 협의하여, Anthropic 팀은 정기적인 파트너 추가를 계속하고, 사이버 보안 조직이 보다 체계적인 방식으로 신청할 수 있는 '신뢰할 수 있는 접근' 프로그램을 추진하면서 클로드 미토스 5에 대한 접근을 꾸준히 확대할 계획이에요.
Anthropic 팀의 계획에는 생의학 연구를 가속화하고 미토스급 역량으로 새로운 치료법을 발견하는 데 도움이 될 생물학 분야 '신뢰할 수 있는 접근' 프로그램을 개설하는 것도 포함되어 있어요. 이 프로그램은 생물학 및 화학 안전장치가 제거된(그러나 사이버 안전장치는 그대로 유지되는) 페이블 5에 대한 접근을 제공할 거예요. 이 프로그램에는 기초 및 번역 연구를 아우르는 다양한 생명 과학 조직의 소수의 연구자들이 참여할 예정이에요. Anthropic 팀은 안전장치를 개선하면서 이 프로그램에 대한 접근을 확대할 계획이에요.
가용성
클로드 페이블 5는 오늘부터 전 세계에서 사용 가능해요. 클로드 미토스 5는 더 광범위한 '신뢰할 수 있는 접근' 프로그램이 제공될 때까지 글라스윙 파트너(사이버 안전장치 해제) 및 곧 선정될 생물학 연구자(생물학 및 화학 안전장치 해제)에게만 제한적으로 제공될 거예요.
두 모델의 가격은 백만 입력 토큰당 10달러, 백만 출력 토큰당 50달러예요. 개발자들은 클로드 API를 통해 claude-fable-5를 사용할 수 있어요.
페이블 5에 대한 수요는 매우 높을 것으로 예상되며 예측하기 어려워요. 클로드 API 및 사용량 기반 엔터프라이즈 플랜에서는 오늘부터 페이블 5가 완전히 사용 가능해요. 구독 플랜의 경우, Anthropic 팀은 가능한 한 빨리 접근을 제공하고자 하므로, 좀 더 보수적으로 단계별로 출시할 거예요.
- 오늘부터 6월 22일까지는 Pro, Max, Team 및 좌석 기반 엔터프라이즈 플랜에 추가 비용 없이 페이블 5가 포함돼요.
- 6월 23일에는 해당 플랜에서 페이블 5를 제거할 거예요. 그 이후 사용하려면 사용 크레딧이 필요할 거예요. 용량이 허용한다면 포함 기간을 연장할 거고요.
- 이 시점 이후, 충분한 용량이 허용되면 페이블 5를 구독 플랜의 표준 기능으로 복원하는 것을 목표로 하고 있어요. Anthropic 팀은 가능한 한 빨리 이 작업을 수행할 예정이에요.
이 기간 동안 Anthropic 팀은 사용자들이 현황을 알 수 있도록 변경 사항이 있으면 미리 알려드릴 거예요.
2026년 6월 9일 수정: AAVs에 대한 논의를 업데이트하여 후보들이 다이노 테라퓨틱스 Dyno Therapeutics에 의해 개발되었음을 명시했어요.
각주
- 미토스급 모델은 Anthropic 팀의 오푸스급 모델보다 역량 면에서 위에 있는 클로드 모델의 계층이에요. 첫 번째 모델인 클로드 미토스 프리뷰는 4월에 프로젝트 글라스윙을 통해 출시되었어요. 오늘 클로드 페이블 5와 클로드 미토스 5가 그 뒤를 잇는 거죠.
- 페이블은 라틴어 fabula에서 유래했고, 이는 "들려지는 것"을 의미하며 그리스어 mythos와 유사해요. 안전장치가 두 모델(페이블과 미토스)을 구별하는 요소이고, 그래서 다른 이름을 부여한 이유예요.
- 지표: 파이어폭스 = 임의 코드 실행(익스플로잇의 완전 성공 등급)을 달성한 시도 비율. OSS-Fuzz = 5단계 점수(0.2 충돌 → 1.0 제어 흐름 하이재킹)의 심각도 가중 평균이므로, 값은 가중 평균이며 성공률이 아니에요. 사이버짐 = 대상 취약점을 재현한 비율(공개 리더보드 지표). 사이시나리오벤치 = 도전 과제 전반에 걸쳐 균등하게 평균화된 성공률.
- 보편적인 탈옥은 사용자가 안전장치가 없는 것처럼 모델과 상호작용할 수 있도록 하는 모든 프롬프트, 스크립트 또는 하네스를 의미해요. 이는 매우 제한된 컨텍스트에서만 효과적이거나 각 새로운 상황에 맞게 조정하는 데 추가적인 노력이 필요한 사소한 탈옥과는 대비돼요.
관련 콘텐츠
클로드 소넷 5 소개
소넷 5는 코딩, 에이전트 및 전문 작업 전반에 걸쳐 대규모로 최첨단 성능을 제공해요.
페이블 5 재배포
페이블 5가 7월 1일 전 세계적으로 다시 배포돼요. 또한 아마존, 마이크로소프트, 구글 및 다른 글라스윙 파트너들과 함께 탈옥 심각도를 평가하기 위한 산업 전반의 프레임워크를 제안하고 있어요.
과학자들을 위한 AI 워크벤치, 클로드 사이언스(Claude Science) 출시
클로드 사이언스는 연구자들이 가장 자주 사용하는 도구와 패키지를 통합하고, 감사 가능한 결과물을 생성하며, 컴퓨팅 리소스에 유연하게 접근할 수 있는 맞춤형 앱이에요.