하루인포팁

생활·건강·지원금·IT까지, 하루에 필요한 정보를 한 번에

Claude Fable 5.1 도입판단, 가격과 실측 비용 비교

Claude Fable 5.1 도입판단, 가격과 실측 비용 비교

작성자

카테고리:

약 12분 소요

Claude Fable 5.1의 가격, 컨텍스트, 실측 벤치마크와 Opus 5·GPT-5.6·Gemini 3.1 비교까지 도입 전 확인해야 할 핵심 수치를 정리했다.

ClaudeFable5.1 개요

ClaudeFable5.1 개요

결론부터 말하면 Claude Fable 5.1 도입은 대부분의 개발 워크로드에서 급하지 않다. Anthropic 스스로도 공식 문서에서 “대부분 워크로드는 Claude Opus 5로 시작하고, Opus 5의 상위 추론 강도로도 부족할 때만 Fable 5.1을 검토하라”고 명시하고 있다(2026년 9월 4일 기준 platform.claude.com). 2026년 9월 1일 Anthropic은 Claude Fable 5.1과 신뢰 기반 접근 프로그램(Project Glasswing) 전용인 Claude Mythos 5.1을 동시에 발표했는데, 가격은 입력 $10·출력 $50(1M 토큰당)로 전작과 동일했지만 독립 벤치마크 기관 Artificial Analysis의 실측에 따르면 최고 성능 모드(max effort) 기준 작업당 비용은 오히려 전작보다 20% 높게 나왔다. 이 글은 API·플랫폼에서 Fable 5.1을 실제로 도입할지 판단해야 하는 개발자·엔지니어링 리더를 대상으로, 가격표·breaking change·독립 측정치·경쟁 모델 비교를 근거 중심으로 정리했다. Mythos 5.1처럼 초대제로 제한돼 외부 검증이 불가능한 항목은 “확인 필요”로 별도 표시했다.


1. Claude Fable 5.1 스펙·가격 총정리

Fable 5.1은 Fable 5와 표시 가격이 같지만 캐시 비용 구조가 바뀌었다. 아래는 2026년 9월 4일 기준 platform.claude.com 공식 문서 수치다.

항목 비고
발표일 2026-09-01 GA(일반 공개)
입력 가격 $10 / MTok 전작 Fable 5와 동일
출력 가격 $50 / MTok 전작 Fable 5와 동일
캐시 읽기 $0.25 / MTok 전작 $1 대비 75% 인하
캐시 쓰기(5분) $12.50 / MTok 변동 없음
캐시 쓰기(1시간) $20 / MTok 변동 없음
컨텍스트 윈도우 1M 토큰
최대 출력 토큰 128K
지식 컷오프 2026년 6월 “신뢰 가능한” 기준
모델 ID Bedrock만 anthropic.claude-fable-5-1
기본 추론 강도 high (adaptive thinking 상시 켜짐, 끌 수 없음)
은퇴 예정 시점 2027-09-01 이전 아님

제공 채널은 Pro·Max·Team·Enterprise 사용자, Claude Platform, AWS, Google Cloud, Microsoft Foundry다. Fable 5에서 마이그레이션할 때는 3가지 breaking change를 반드시 점검해야 한다.

  • 강제 tool use(tool_choice force) 요청 시 오류를 반환한다
  • 이전 세대 모델이 Fable 5.1의 thinking block을 읽을 수 없다
  • 이전 턴을 편집하면 해당 thinking block이 무효화된다

Mythos 5.1은 Fable 5.1과 동일 모델에 안전장치 수준만 다르다는 것이 Anthropic의 설명이다. 사이버보안·생명과학 분야 전문가용으로 안전장치가 덜 제한적이며, Project Glasswing 참여자에게만 열려 있어 일반 개발자가 API로 접근할 수 있는 대상이 아니다.


2. 자사 발표 vs 독립 검증 — 간극부터 확인

2. 자사 발표 vs 독립 검증 — 간극부터 확인

도입판단에서 가장 중요한 것은 홍보 문구와 실측치의 차이다. Artificial Analysis가 사전 공개 평가 지원 후 자체 측정한 결과를 자사 발표와 나란히 놓으면 다음과 같다.

발표(Anthropic) 조건 실측/독립 측정
일반 워크로드 25%, 고도 에이전틱 워크로드 최대 45% 비용 절감 캐시 적중률이 높은 워크로드에서만 성립 max effort 기준 작업당 비용은 전작 대비 오히려 20% 증가
“세계에서 가장 진보된 모델” Intelligence Index 기준 1위는 사실 66점으로 1위이나 2위 Opus 5(63점)와 3점 차의 근소한 우위
사이버보안 오탐 60%·생물학 오탐 85% 감소 자사 자체 측정 독립 매체·제3자 재현 결과는 확인되지 않음
HLE 60.9%(도구 미사용) 자사 발표 Artificial Analysis 실측은 59.1%로 다소 낮음

두 벤치마크를 직접 비교할 수 없는 경우도 있다. Artificial Analysis의 Terminal-Bench v2.1 91.4%는 자사 발표 Terminal-Bench 4.0 55.8%와 아예 다른 버전의 벤치마크라 수치를 나란히 놓고 비교하는 것 자체가 오류다. 도입판단 자료를 찾을 때 “몇 퍼센트 향상됐다”는 문구가 어느 벤치마크 버전 기준인지부터 확인해야 하는 이유다.


3. effort 단계별 비용 실측 — 왜 20% 더 비쌀 수 있는가

3. effort 단계별 비용 실측 — 왜 20% 더 비쌀 수 있는가

Fable 5.1은 adaptive thinking이 상시 켜져 있고 low부터 max까지 5단계 추론 강도(effort)를 선택할 수 있다. Artificial Analysis 실측에 따르면 단계별 점수와 토큰 소비량 차이가 매우 크다.

effort 단계 Intelligence Index 점수 출력 토큰 소비량(참고)
low 58 약 1,310만 토큰
max 66 약 1억 4,370만 토큰

출력 토큰 소비량이 low와 max 사이에서 약 11배 차이가 난다. “66점”이라는 최고 점수는 가장 비싼 설정에서만 나오는 값이라는 뜻이다. 실제 작업당 비용을 비교하면 Fable 5.1(max) $3.76 vs Fable 5(max) $3.14로, 캐시 가격이 75% 인하됐음에도 작업당 비용이 20% 더 높게 측정됐다. 캐시 인하로 절감된 금액(작업당 약 $1.40 추정)보다 출력 토큰 사용량 증가(약 1.7배)로 늘어난 비용이 더 컸기 때문이다. 캐시 적중률이 낮은 워크로드라면 이 절감 효과 자체를 기대하지 않는 것이 안전하다.


4. 경쟁 모델과 비교 — Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro

4. 경쟁 모델과 비교 — Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro

2026년 9월 4일 기준 각 사 공식 가격과 Artificial Analysis Intelligence Index를 함께 보면 Fable 5.1의 위치가 분명해진다.

모델 입력 가격(1M 토큰당) 출력 가격(1M 토큰당) Intelligence Index(최고 effort)
Claude Fable 5.1 $10 $50 66
Claude Opus 5 $5 $25 63
GPT-5.6 Sol $4(프로모션가, 2026-11-21까지) $20(프로모션가) 61
Gemini 3.1 Pro $2(200K 토큰 이하) $12(200K 토큰 이하) 확인 필요

Fable 5.1은 표에서 가장 비싼 모델이면서 근소한 1위다. Opus 5는 가격이 정확히 절반인데 점수는 3점만 낮다. Anthropic 공식 가이드가 “대부분 워크로드는 Opus 5로 시작하라”고 말하는 배경이 이 표에 그대로 드러난다. 순수 비용 대비 성능을 우선한다면 Opus 5나 Gemini 3.1 Pro가 유리하고, Opus 5의 상위 effort로도 처리되지 않는 장시간·다단계 에이전틱 작업(백로그 처리, 브라우저 조작, 관리형 에이전트 무인 실행 등)에 한해서만 Fable 5.1을 검토 대상에 올리는 것이 합리적이다.


5. 도입 전 체크리스트와 확인 필요 항목

5. 도입 전 체크리스트와 확인 필요 항목

실제 도입판단에 들어가기 전 아래 항목을 순서대로 점검하길 권한다.

즉시 점검 가능한 항목
– 강제 tool use, thinking block 하위 호환, 이전 턴 편집 시 무효화 — 3가지 breaking change가 현재 파이프라인에 영향을 주는지
– 워크로드의 캐시 적중률이 높은지 — 낮다면 비용 절감을 기대하지 말 것
– 작업이 Opus 5의 상위 effort로 실패하는 유형인지, 아니면 처음부터 Opus 5로 충분한지

규제 리스크로 별도 고려할 사항
전작 Claude Fable 5는 2026년 6월 9일 출시 사흘 만인 6월 13일 미 상무부 수출통제 조치로 전 세계 접근이 차단됐다가, 6월 30일 통제 해제·7월 1일 접근이 복구된 전례가 있다. 19일간 전면 차단이라는 이력은 이번 5.1 발표 내용과는 별개지만, 같은 계열 모델에 프로덕션 로직을 단일 의존시키는 설계는 이 사례만으로도 재검토할 가치가 있다.

아직 T1 자료로 확인되지 않은 항목은 도입판단에서 단정하지 말고 미확인 상태로 남겨야 한다.

확인 필요
1. Fable 5.1/Mythos 5.1의 ASL(AI Safety Level) 등급 — 시스템 카드 원문 대조 실패로 미확정
2. Mythos 5.1의 “부정렬 행동 증가” 구체 수치 — TechCrunch가 언급했으나 정량 데이터 없음
3. 안전장치 오탐 60%·85% 감소에 대한 독립 재현 결과 — 자사 발표 외 검증 자료 없음


정리

Claude Fable 5.1은 표시 가격이 전작과 같지만, 최고 성능 모드로 장시간 작업을 돌리면 출력 토큰 소비 증가로 작업당 실비용이 오히려 늘어날 수 있다는 점이 독립 측정의 핵심 결론이다. Intelligence Index 1위는 사실이지만 Opus 5와의 격차는 3점에 불과하고, Anthropic 스스로도 대부분 워크로드는 Opus 5로 충분하다고 안내한다. breaking change 점검, 캐시 적중률 확인, 규제 이력을 고려한 이중화 설계까지 마친 뒤, Opus 5로도 처리되지 않는 장시간·다단계 에이전틱 작업에 한해 Fable 5.1 도입을 검토하는 순서가 비용 효율적이다.



참고 자료

조사 기준일: 2026년 09월 04일

본문의 수치는 아래 자료에서 확인한 것입니다. 제조사 공식 자료(T1)와 전문 매체 실측(T2)을 구분해 표기했습니다. 가격·공급 상황은 변동이 크므로 기준일 이후의 값은 다시 확인해야 합니다.

Tier 1
https://www.anthropic.com/claude-fable-and-mythos-5-1 (확인일 2026-09-04)
https://platform.claude.com/docs/en/models/fable-5-1/overview (확인일 2026-09-04)
https://platform.claude.com/docs/en/about-claude/models/overview (확인일 2026-09-04)
https://www.anthropic.com/news/redeploying-fable-5 (확인일 2026-09-04)
https://developers.openai.com/api/docs/pricing (확인일 2026-09-04)
https://ai.google.dev/gemini-api/docs/pricing (확인일 2026-09-04)
Tier 2
https://artificialanalysis.ai/articles/claude-fable-5-1 (확인일 2026-09-04)
https://techcrunch.com/2026/09/01/anthropics-new-fable-release-is-cheaper-less-restrictive/ (확인일 2026-09-04)
https://datasciencedojo.com/blog/claude-fable-5-1-performance-and-safety/ (확인일 2026-09-04, 보조 참고)
https://www-cdn.anthropic.com/…/Claude%20Fable%205.1%20&%20Claude%20Mythos%205.1%20System%20Card.pdf (파일 용량 초과로 WebFetch 불가, ASL 등급 등 확정 못함)


코멘트

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다