클로드 코드에서 페이블(Fable) 5를 선뜻 메인 모델로 쓰지 못했던 이유는 성능이 아니라 토큰 소모량이었다. 나도 MAX 요금제로 1년째 바이브 코딩을 하고 있지만 페이블 5는 어드바이저에 가깝게 활용했다. 복잡한 설계나 막힌 문제만 맡겼다. 구현까지 계속 맡겼다가는 주간 사용량이 순식간에 사라졌다.
지금 바로 사용 가능
그런 페이블이 5.1로 업데이트됐다. 결론부터 말하면 장시간 에이전트 작업에서는 메인으로 올릴 근거가 생겼지만 모든 코딩을 맡기기에는 여전히 비싸다. 최대 45%라는 숫자부터 정확히 해석해야 한다.
장시간 작업에 집중한 성능 개선
앤트로픽은 2026년 9월 1일 페이블 5.1을 공개했다. 100만 토큰 컨텍스트와 최대 12만 8천 토큰 출력, 기본으로 켜져 있는 적응형 사고는 페이블 5와 큰 틀에서 같다. 달라진 부분은 코드베이스 전체에 걸친 기능 구현, 성능 개선, 코드 리뷰처럼 여러 단계가 이어지는 작업을 도중에 놓치지 않고 끝내는 능력이다. 작업이 실패하면 무엇을 시도했고 어디서 막혔는지도 중간에 알려준다.
앤트로픽 자체 평가에서 Terminal-Bench-Science 0.1 점수는 52.6%였다. 같은 조건에서 측정한 페이블 5는 24.7%로 두 배 이상 차이가 난다. 다만 표준오차가 모델별 ±3.5~4.5% 포인트이고 만든 쪽이 공개한 결과인 만큼 절대적인 우열로 받아들일 필요는 없다.
독립 평가인 CursorBench 3.2도 흐름은 비슷하다. 모호한 지시로 여러 파일을 수정하는 테스트에서 5.1의 Max 설정은 73.4%, 5의 Max 설정은 70.5%를 기록했다. 점수 차는 2.9% 포인트지만 작업당 비용은 17.32달러에서 9.64달러로 줄었다.
게다가 5.1의 High 설정은 4.80달러로 69.4%를 기록했다. 추론 강도를 무조건 Max로 올리기보다 작업 난도에 맞춰야 효율적이라는 의미다.
앤트로픽이 공개한 데모에서는 Medium 설정으로 3D ISS 추적기를 구현했다. 첫 결과에 오류가 발생했지만 모델이 로그를 분석해 핵심 추적 기능을 복구했다. 회전과 확대 같은 시각적 인터랙션에는 결함이 남았다. 한 번에 완성하는 마법보다 실패 후 스스로 수정하는 능력이 이번 업데이트를 판단할 현실적인 기준이다.
45% 절감의 진짜 의미
API 기본 단가는 그대로다. 입력 100만 토큰당 10달러, 출력은 50달러이며 5분 캐시 쓰기도 12.50달러로 동일하다. 바뀐 것은 캐시 읽기 단가다. 100만 토큰당 1달러에서 0.25달러로 75% 인하됐다.
클로드 코드는 대화가 길어질수록 기존 시스템 지침과 코드 문맥을 반복해서 다시 읽는다. 이 반복분이 캐시에서 걸리는 비율이 높으면 일반 작업은 약 25%, 에이전트 작업은 최대 약 45%까지 비용이 줄어든다는 것이 앤트로픽의 추산이다. 모든 요청의 토큰 사용량이나 요금이 일괄적으로 45% 감소한다는 뜻은 아니다.
짧은 질문이나 캐시가 자주 깨지는 작업에서는 차이가 작다. 새 컨텍스트를 계속 넣는 세션도 마찬가지다. 비용이 줄어드는 이유는 토큰을 덜 쓰게 돼서가 아니라 캐시 읽기 가격이 내려갔기 때문이다.
요금제 한도와 도입 전 확인할 것
참고로 MAX 요금제에서 페이블 5와 5.1은 주간 사용량 한도의 최대 50%까지만 기본 구독 범위로 쓸 수 있다. 해당 구간을 소진하면 사용 크레딧을 결제하거나 다른 모델로 바꿔야 한다. API 비용이 최대 45% 내려갔다고 해서 MAX의 주간 한도가 같은 비율로 늘었다고 단정할 수 없는 이유다.
클로드 코드 2.1.250 이상이라면 모델 선택 메뉴에서 페이블(Fable) 5.1을 고를 수 있다. 기존 모델보다 경제성이 좋아진 것은 분명하지만 오퍼스 5와 비교하면 여전히 비싸다. 오퍼스의 API 단가는 입력 5달러, 출력 25달러로 정확히 절반이다. 간단한 UI 수정과 반복 구현까지 전부 최상위 모델에 맡길 이유는 없다.
데이터 처리 조건도 확인해야 한다. 일반적인 페이블 사용 데이터는 안전 모니터링을 위해 기본 30일간 보관된다. 민감한 저장소를 다룬다면 성능보다 조직의 보안 정책부터 확인해야 한다.
메인 모델로 써도 될까?
GPT-5.6 Luna와는 성능 차이가 꽤 난다.
지금까지 공개된 자료를 놓고 보면 역할을 나누는 방식이 가장 현실적이다. 여러 파일을 건드리는 리팩터링과 원인 파악이 어려운 버그는 5.1에 맡길 만하다. 테스트와 검증을 반복해야 하는 긴 작업도 여기에 해당한다. 반면 짧은 구현과 문서 수정은 오퍼스나 소넷으로 처리해야 사용량이 남는다.
개인적으로는 페이블 5를 어드바이저로만 쓰던 운용에서 한 단계 올려 어려운 작업 단위의 메인 모델로 먼저 시험해 볼 생각이다. 다른 사용자들의 벤치마크만 확인하는 것보단 반복 업무 몇 가지를 정해 기존 모델과 같은 조건으로 비교하는 편이 정확하다. 매번 새로운 모델이 나오면 일주일 동안 작업 완료율과 재수정 횟수, 주간 한도 소모량을 기록하면 메인으로 쓸지말지 판단이 서더라.
45%는 모든 사용자에게 똑같이 적용되는 할인이 아니다. 컨텍스트를 길게 물고 가는 작업에서만 나오는 숫자다. 그런데 그게 하필 지금까지 비용 때문에 페이블에 못 맡기던 작업이다. 이번 업데이트를 그냥 넘기기 어려운 이유다. 지금 바로 Fable 5.1로 토큰을 녹여보길!
















댓글0