List of Best

Anthropic, 범용 Fable 5.1 출시… Mythos 5.1은 제한 유지

Table of contents5

하나의 모델, 두 개의 운영 경계

Anthropic은 01-09-2026에 Claude Fable 5.1과 Claude Mythos 5.1을 발표했습니다. 두 구성은 동일한 모델 가중치를 사용합니다. 핵심적인 차이는 동일한 기본 모델을 둘러싼 안전 장치(safeguard) 계층에 있으므로, 접근 정책은 각주가 아니라 제품 정의 자체의 일부를 구성합니다.

Fable 5.1은 유료 Claude 사용자에게 제공되며 웹, 모바일, 데스크톱, Cowork, Claude Code, Claude Design, Microsoft 365, Tag, Claude API 및 클라우드 플랫폼을 통해 이용할 수 있습니다. Mythos 5.1은 일반적인 범용 릴리스가 아닙니다. 현재 일련의 미국 기관을 포함하여 검증된 기관과 신뢰할 수 있는 프로그램에만 직접 접근이 허용됩니다.

AI 에이전트 개발팀에게 있어 선택의 본질은 어떤 안전 장치와 접근 경계가 진행 중인 워크플로에 부합하는가에 있습니다.

노력 수준을 제어 영역으로 만드는 가격 정책

Anthropic은 Fable 5.1과 Mythos 5.1의 가격을 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50로 책정했습니다. 캐시 읽기 비용은 100만 토큰당 $0.25로 기존 $1 요율에서 75% 인하되었으며, 캐시 쓰기 비용은 변동이 없습니다. 이는 토큰 단위 기준 가격이므로 개별 요금제나 클라우드 마켓플레이스에 따라 청구 방식이 다르게 표시될 수 있습니다.

Fable 5.1은 low, medium, high, xhigh, max 등 선택 가능한 노력 수준(effort level)을 도입했습니다. Anthropic은 기본값으로 high를 권장하며, low나 medium은 약간의 성능을 희생하는 대신 비용을 낮출 수 있고 자체 평가에서 Fable 5와 유사하거나 더 나은 결과를 낸다고 설명합니다. 또한 Anthropic은 기본 노력 수준 하에서 2026년 8월의 실제 4주간 사용 데이터를 기준으로 일반적인 워크로드에서 약 25%, 복잡하고 고도화된 에이전트 작업에서는 최대 약 45%의 비용 절감 효과가 있을 것으로 추산합니다.

노력 수준 전반에 걸쳐 Mythos 5.1, Fable 5.1, Mythos 5를 비교한 사용자가 제공한 Terminal-Bench 4.0 정확도 대 비용 차트.

이러한 수치는 확정된 예산 보증이 아니라 검증해야 할 시험 가설로 다루어야 합니다. 캐시 읽기와 노력 수준을 작업 성공률, 재시도 횟수, 지연 시간, 출력 품질, 완료된 워크플로당 비용에 대입하여 면밀히 측정하십시오.

이와 관련된 한도 변경 또한 동일한 정밀도로 살펴볼 필요가 있습니다. 공식 ClaudeDevs 업데이트에 따르면, 13-09-2026에 임시 50% 한도 인상이 종료되고 14-09-2026부터 기본값 대비 영구적인 25% 인상이 시작되면 Pro, Max, Team 및 좌석 기반 Enterprise 요금제의 Claude Code 주간 한도는 현재 대비 17% 순감소하게 됩니다. 이는 Claude Code 주간 한도에 국한된 비교이며, Claude의 모든 메시지 한도가 전반적으로 삭감되는 것은 아닙니다.

벤치마크는 방향성을 보여줄 뿐, 최종 판결이 아니다

Anthropic의 보고에 따르면 Terminal-Bench-Science 0.1에서 Fable 5.1은 52.6%를 기록하여 Fable 5의 24.7%, Opus 5의 29.0%, GPT-5.6 Sol의 22.4%와 대조를 보였습니다. Terminal-Bench 4.0에서 보고된 수치는 Fable 5.1이 55.8%, Fable 5가 42.0%, Mythos 5.1이 60.9%, Opus 5가 52.3%, GPT-5.6 Sol이 37.3%입니다.

과학, 코딩, 지식 작업 및 컴퓨터 사용 테스트 전반에서 Fable 5.1, Fable 5, Opus 5, GPT-5.6 Sol을 나열한 사용자가 제공한 벤치마크 비교표.

이 지표들은 벤더가 배포 전에 자체 측정한 결과이며, 모델의 우수성에 대한 독립적인 객관적 증거는 아닙니다. Terminal-Bench-Science는 모델당 ±3.5–4.5점의 표준 오차를 갖습니다. Anthropic은 또한 OSWorld가 이전 릴리스와 직접 비교할 수 없는 2026년 8월 작업 세트를 사용하고 있으며, 프로덕션 안전 장치와 폴백 시스템이 점수에 영향을 미칠 수 있음을 명시했습니다.

범용적인 거부 감소가 아닌 제한된 안전 장치 완화

Anthropic은 Claude Code 사용자가 세션당 겪는 사이버 보안 안전 장치의 개입 빈도가 Fable 5 안전 장치 대비 약 60% 감소할 것으로 기대할 수 있다고 밝혔습니다. 또한 기초 생물학 및 일상적 의료 관련 무해한 요청에 대해 Fable 5.1의 생물학 안전 장치 오작동이 85% 덜 발생한다고 보고했습니다. 그러나 이러한 수치가 전체 제품군에서 거부 반응이 전면적으로 60% 또는 85% 줄어든다는 의미는 아닙니다. 이중 용도 생명과학 분야의 전문 연구는 여전히 Opus나 검증된 신뢰 채널을 통해 라우팅됩니다.

시스템 카드에는 Trajectory Labs가 약 74시간 동안 6,500건 이상의 요청을 수행한 외부 테스트 결과가 수록되어 있으며, 11건의 잠재적 취약점 후보가 식별되었으나 Fable 5.1 단독으로 완전한 익스플로잇에 성공한 사례는 없었습니다. 또한 외부 테스트 과정에서 Mythos 5.1과 관련된 낮은 수준의 샌드박스 취약점 사고가 1건 기록되었습니다. 이는 릴리스가 완전히 무결하다고 간주하기보다는 명확한 접근 경계를 지속적으로 유지해야 하는 근거가 됩니다.

에이전트 빌더를 위한 선택 기준

Fable 5.1은 유연한 접근 권한과 비용 통제 실험이 필요한 팀에 적합합니다. 모델 엔드포인트, 노력 수준, 캐시 동작 방식, Claude Code 한도 주기를 명확히 고정하십시오. 통제된 작업 환경에서 성공적인 워크플로당 비용을 측정하고, Anthropic의 비용 절감 및 벤치마크 주장을 직접 재현해 검증해야 할 가설로 취급하십시오.

Mythos 5.1은 전혀 다른 평가 트랙에 위치합니다. Cyber Verification Program은 방어적 보안 업무에 초점을 맞추고 있으며, Life Sciences Verification Program은 전문 연구 안전 장치가 적용된 Mythos 5.1을 활용하는 전문가를 위한 초대 전용 베타입니다. Project Glasswing은 관련된 방어적 보안 협력 프로그램이며, 이 두 프로그램을 포괄하는 단어가 아닙니다.

Fable 5.1 및 Mythos 5.1의 생성물에는 통계적이며 비가시적인 텍스트 워터마크가 적용됩니다. Anthropic은 이 메커니즘이 추가 토큰을 소모하지 않고 사용자 식별 데이터를 활용하지 않는다고 설명하며, 탐지 도구는 비공개 프리뷰 상태입니다. 이는 감사 및 출처 검증 파이프라인을 구축하는 팀에 유의미할 수 있으나, 접근 통제나 워크로드 부하 검증, 독립적인 실사를 대체할 수는 없습니다.