클로드 페이블 5.1 vs 페이블 5 비교: 가격·캐시 비용·성능·데이터 보관은 무엇이 달라졌나

클로드 페이블 5.1 페이블 5 비교를 위해 AI 모델의 캐시 효율과 장시간 에이전트 작업 차이를 표현한 이미지

작성자

카테고리:

클로드 페이블 5.1(Claude Fable 5.1)은 2026년 9월 1일 공개된 Anthropic의 최신 고성능 모델입니다. 기존 페이블 5에서 바꿀 가치가 있는지를 먼저 답하면, 반복해서 긴 문맥을 읽는 에이전트·대규모 코드 작업이라면 업그레이드 효과가 크지만, 모든 작업에서 비용이 무조건 줄어드는 것은 아닙니다.

기본 API 입력·출력 가격은 페이블 5와 같습니다. 가장 큰 가격 변화는 프롬프트 캐시 읽기 비용이 100만 토큰당 1달러에서 0.25달러로 75% 낮아졌다는 점입니다. 동시에 장시간 에이전트 작업과 복잡한 코딩·리서치 성능도 개선됐습니다. 반면 데이터 보관은 기본적으로 30일이라는 점과 API 호환성 변경 사항은 업그레이드 전에 확인해야 합니다.

페이블 5.1과 페이블 5, 먼저 표로 비교하면

항목Claude Fable 5.1Claude Fable 5실제 의미
출시2026년 9월 1일2026년 6월 9일5.1이 후속 모델
기본 입력 가격$10 / 100만 토큰$10 / 100만 토큰동일
기본 출력 가격$50 / 100만 토큰$50 / 100만 토큰동일
5분 캐시 쓰기$12.50 / 100만 토큰$12.50 / 100만 토큰동일
1시간 캐시 쓰기$20 / 100만 토큰$20 / 100만 토큰동일
캐시 읽기$0.25 / 100만 토큰$1 / 100만 토큰5.1이 75% 저렴
컨텍스트100만 토큰100만 토큰큰 변화 없음
최대 출력12만8천 토큰12만8천 토큰급핵심 차이는 가격보다 실행 품질
기본 데이터 보관30일30일 적용 대상기업 환경은 계약·플랫폼 확인 필요

가격은 Anthropic의 2026년 9월 2일 기준 Claude Platform 공식 가격표 기준입니다.

1. 가격 자체가 내려간 것은 아니다

페이블 5.1이 “25% 저렴해졌다”는 설명만 보면 API 가격이 전체적으로 인하된 것처럼 보일 수 있습니다. 실제 구조는 다릅니다.

입력 가격은 100만 토큰당 10달러, 출력은 50달러로 페이블 5와 그대로입니다. 캐시를 새로 기록하는 비용도 동일합니다. 바뀐 것은 이미 저장해 둔 프롬프트나 문맥을 다시 읽을 때 적용되는 캐시 읽기 단가입니다.

페이블 5에서는 100만 캐시 토큰을 다시 읽을 때 1달러가 들었지만, 5.1에서는 0.25달러입니다. Anthropic은 이 변화 때문에 일반적인 워크로드에서는 약 25%, 반복적인 문맥 참조가 많은 에이전트 작업에서는 최대 약 45%의 비용 절감이 가능하다고 설명합니다. 이 수치는 Anthropic이 제시한 예상치이지 모든 사용 환경에서 보장되는 할인율은 아닙니다.

캐시를 얼마나 쓰느냐가 비용 차이를 만든다

예를 들어 한 달 동안 이미 캐시된 문맥 1억 토큰을 반복해서 읽었다고 가정하면 캐시 읽기 비용만 비교할 때 다음과 같습니다.

캐시 읽기량Fable 5Fable 5.1차이
1,000만 토큰$10$2.50$7.50 절감
5,000만 토큰$50$12.50$37.50 절감
1억 토큰$100$25$75 절감

대형 코드베이스, 긴 시스템 프롬프트, 반복적으로 같은 문서를 참조하는 에이전트처럼 같은 앞부분의 문맥을 계속 읽는 구조일수록 5.1의 가격 변경이 직접적인 효과를 냅니다.

반대로 매 요청이 새로운 입력과 긴 새 출력으로 구성된다면 캐시 인하 효과는 작아집니다.

2. “5.1이면 무조건 작업당 비용도 싸다”는 해석은 주의해야 한다

가격표와 실제 작업 비용은 구분해야 합니다.

독립 모델 평가 기관 Artificial Analysis가 Fable 5.1을 최대 effort 조건으로 평가한 결과에서는 지능 지수가 Fable 5보다 높아졌지만, 해당 평가 세트의 작업당 비용은 Fable 5보다 약 20% 높게 측정됐습니다. 더 강한 추론을 사용하면서 생성하는 토큰이나 추론량이 늘면 캐시 절감분보다 전체 사용량 증가가 더 클 수도 있기 때문입니다.

따라서 실제 비용 판단은 이렇게 하는 편이 안전합니다.

캐시 재사용 비중이 높고 장시간 작업을 돌린다 → 5.1의 비용 구조가 유리할 가능성이 높음

짧은 단발성 질문이나 매번 새로운 긴 출력이 많다 → 모델을 직접 비교해 봐야 함

최고 effort만 고정해서 사용한다 → 캐시 단가만 보고 비용 절감을 예상하면 안 됨

Anthropic도 대부분의 일반적인 워크로드에서는 우선 Opus 5로 시작하고, 더 어려운 추론이나 장시간 에이전트 작업에서 Opus 5가 부족할 때 Fable 5.1을 고려하도록 안내하고 있습니다.

3. 성능 차이는 장시간 에이전트 작업에서 특히 크다

Anthropic이 공개한 자체 평가에서는 페이블 5.1이 여러 장기 작업 벤치마크에서 페이블 5보다 높은 결과를 기록했습니다.

벤치마크Fable 5.1Fable 5차이
Terminal-Bench-Science 0.152.6%24.7%+27.9%p
Terminal-Bench 4.055.8%42.0%+13.8%p
GDPval-AA v21,8531,723+130
OSWorld 2.0 partial77.9%72.9%+5.0%p

이 수치는 Anthropic이 발표한 평가 결과이므로 실제 업무 성능과 동일하다고 단정할 수는 없습니다. 특히 일부 평가는 안전장치와 fallback 모델의 영향을 받습니다. 다만 개선 방향 자체는 독립 평가에서도 확인됩니다. Artificial Analysis의 2026년 9월 1일 평가에서 Fable 5.1 최대 effort는 Intelligence Index 66점, Fable 5는 62점으로 측정됐습니다.

실사용 관점에서는 “한 번의 답변이 조금 더 똑똑하다”보다 수십 단계가 이어지는 작업에서 중간 판단을 유지하고 실패했을 때 복구하는 능력이 5.1의 핵심 변화에 가깝습니다.

AWS와 Microsoft도 출시 자료에서 코드베이스 전체를 건드리는 기능 개발, 장시간 도구 사용, 여러 단계의 리서치와 문서 제작 같은 작업을 대표적인 활용 사례로 제시하고 있습니다.

4. 개발자는 모델 ID만 바꾸면 끝나는 것이 아니다

기존 Fable 5 API 사용자가 5.1로 전환한다면 성능보다 먼저 호환성을 확인해야 합니다.

Anthropic의 공식 마이그레이션 문서에는 몇 가지 breaking change가 명시돼 있습니다.

강제 tool_choice는 사용할 수 없다

Fable 5.1에서는 tool_choiceany 또는 특정 tool로 강제하면 400 오류가 발생합니다. auto 또는 none을 사용하고, 필요한 경우 지시문이나 strict tool 설정을 활용해야 합니다.

adaptive thinking은 항상 켜져 있다

Fable 5.1에서는 thinking 자체를 끄는 방식이 지원되지 않습니다. 추론량은 effort 수준으로 조정해야 합니다.

대화 기록을 중간에 수정하는 구현은 점검해야 한다

이전 턴을 수정하거나 시스템·도구 정의를 다시 만드는 방식에 따라 뒤쪽 thinking block이 무효화될 수 있습니다. 자체적으로 대화 기록을 압축하거나 재구성하는 애플리케이션이라면 트래픽 전환 전에 테스트가 필요합니다.

즉, 기존 API 코드에서 모델 이름만 claude-fable-5-1로 변경하고 바로 운영 트래픽 전체를 넘기는 방식은 피하는 편이 좋습니다.

5. 데이터 보관은 오히려 업그레이드 전 필수 확인 항목이다

Fable 5.1은 강력한 모델인 만큼 Anthropic이 Covered Model로 분류하고 있습니다.

Claude Platform 공식 문서상 기본 데이터 보관 기간은 30일입니다. 일반적인 zero data retention(ZDR) 계약에서 자동으로 이용할 수 있는 모델이 아니며 Anthropic의 별도 승인이 필요한 경우가 있습니다.

다만 기업용 환경에서는 별도 경로가 마련되고 있습니다.

Anthropic은 Enterprise Frontier Safeguards(EFS)를 통해 고객이 제어하는 클라우드 인프라에 데이터를 저장하는 구조를 도입하고 있습니다. AWS는 EFS 자격을 갖춘 고객에게 일정 조건에서 Fable 5.1의 zero-data-retention 사용을 지원한다고 안내합니다.

Google Cloud 역시 Fable 5.1을 2026년 9월 1일부터 GA로 제공하지만, Advanced AI Safety Addendum에 따른 프롬프트·응답 보관 조건을 별도로 명시하고 있습니다.

따라서 사내 기밀 코드나 고객 정보처럼 보관 정책이 중요한 데이터를 처리한다면 “Claude Fable 5.1은 ZDR인가?”라고 모델 이름만 보고 판단하면 안 됩니다.

Claude API를 직접 쓰는지, AWS·Google Cloud·Microsoft 환경을 사용하는지, Enterprise 계약 조건이 무엇인지까지 함께 확인해야 합니다.

클로드 페이블 5.1 페이블 5 비교를 위해 AI 모델의 캐시 효율과 장시간 에이전트 작업 차이를 표현한 이미지
클로드 페이블 5.1 페이블 5 비교를 위해 AI 모델의 캐시 효율과 장시간 에이전트 작업 차이를 표현한 이미지

6. Fable 5에서 5.1로 바꾸기 좋은 경우

다음 조건이 많다면 5.1 전환을 시험할 가치가 큽니다.

  • 대형 코드베이스나 긴 문서를 반복해서 참조한다.
  • 하나의 작업이 여러 시간 또는 여러 도구 호출에 걸쳐 이어진다.
  • 프롬프트 캐싱 비중이 높다.
  • 코딩·리서치 중 중간 실패를 스스로 판단하고 복구하는 능력이 중요하다.
  • Fable 5에서 성능은 만족하지만 캐시 읽기 비용이 부담이었다.
  • 기존 시스템을 대상으로 Fable 5와 5.1을 나란히 평가할 테스트 세트가 있다.

반대로 단순 채팅, 짧은 콘텐츠 생성, 응답 속도와 낮은 단가가 우선이라면 Fable 5.1이 항상 최적 선택은 아닙니다. Anthropic 자체 문서도 대부분의 워크로드에서는 Opus 5부터 평가하도록 권장합니다.

업그레이드 전 체크리스트

확인 항목확인할 내용
모델 성능실제 업무 평가 세트에서 Fable 5와 5.1 비교
총비용입력·출력뿐 아니라 캐시 hit, 생성 토큰, effort까지 계산
캐시 비중긴 문맥을 반복해서 읽는 작업인지 확인
API 호환성forced tool choice, thinking block 처리 확인
대화 이력이전 메시지를 수정·압축하는 구조인지 확인
데이터 보관30일 보관 및 ZDR 적용 가능 여부 확인
클라우드AWS·Google Cloud·Microsoft별 이용 조건 확인
fallback안전장치가 작동할 때 다른 모델로 라우팅되는지 확인

핵심 요약

Fable 5.1의 가장 명확한 변화는 기본 토큰 가격 인하가 아니라 캐시 읽기 가격 인하입니다.

입력 $10, 출력 $50이라는 기본 가격은 Fable 5와 같지만 캐시 읽기는 $1에서 $0.25로 75% 내려갔습니다. 반복 문맥이 많은 에이전트에서는 이 변화가 상당한 비용 절감으로 이어질 수 있습니다.

성능 역시 장시간 코딩·리서치·도구 사용에서 개선됐습니다. 다만 독립 평가에서는 높은 effort로 사용할 때 실제 작업당 비용이 전작보다 증가한 사례도 확인됩니다. “신형이므로 무조건 싸고 빠르다”보다 자신의 프롬프트 구조와 캐시 사용량으로 다시 측정하는 것이 정확합니다.

그리고 기업 사용자는 데이터 보관 조건을 반드시 따로 확인해야 합니다. 기본적으로 30일 보관이 적용되며, ZDR·EFS 조건은 이용 플랫폼과 계약에 따라 달라질 수 있습니다.

FAQ

Fable 5.1의 API 가격은 Fable 5보다 싸졌나요?

기본 입력·출력 가격은 같습니다. 두 모델 모두 100만 토큰당 입력 10달러, 출력 50달러입니다. 달라진 것은 캐시 읽기로, Fable 5의 1달러에서 Fable 5.1은 0.25달러로 낮아졌습니다.

Fable 5.1이 실제로 25% 저렴한가요?

Anthropic은 일반적인 워크로드에서 약 25%, 에이전트형 작업에서는 최대 약 45% 절감 가능하다고 추정합니다. 실제 비용은 캐시 사용량, 출력 토큰, effort에 따라 다르며 독립 평가에서는 특정 최대 effort 조건에서 Fable 5.1의 작업당 비용이 Fable 5보다 높게 측정되기도 했습니다.

Fable 5.1의 컨텍스트 크기는 얼마인가요?

Claude Platform 공식 문서 기준 컨텍스트 윈도는 100만 토큰, 최대 출력은 12만8천 토큰입니다.

Fable 5에서 API 모델 이름만 바꾸면 되나요?

권장하지 않습니다. forced tool choice 지원 변경, thinking block 호환성, 이전 대화 수정 시 동작 변화가 있어 Anthropic의 마이그레이션 체크리스트를 먼저 확인해야 합니다.

Fable 5.1은 Zero Data Retention을 지원하나요?

기본 정책은 30일 데이터 보관입니다. ZDR은 Anthropic의 별도 승인이나 Enterprise Frontier Safeguards, 이용 중인 클라우드·계약 조건 등에 따라 달라질 수 있으므로 기업 사용자는 자신의 계약을 확인해야 합니다.

출처 및 참고자료

  1. Anthropic, Introducing Claude Fable 5.1 and Claude Mythos 5.1, 2026-09-01. Anthropic 공식 발표 보기
  2. Anthropic Claude Platform Docs, Claude Fable 5.1 / Pricing / Migration Guide, 2026-09-01 확인본. Fable 5.1 공식 모델 문서
  3. AWS, Introducing Claude Fable 5.1 on AWS, 2026-09-01. AWS 공식 발표 보기
  4. Google Cloud, Claude Fable 5.1 on Google Cloud, 2026-09-01. Google Cloud 공식 문서 보기
  5. Artificial Analysis, Claude Fable 5.1 tops the Artificial Analysis Intelligence Index, 2026-09-01. 독립 평가 결과 보기
  6. The Verge, Anthropic launches Claude Fable 5.1 and says it’s up to 45 percent cheaper for agentic work, 2026-09-01. The Verge 보도 보기