Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

Claude Fable 5.1 마이그레이션: 도구 호출·thinking 변경점


반응형

Fable 5.1 전환 주의점 제목과 append-only 대화 기록 카트리지를 표현한 대표 이미지

Claude Fable 5.1의 append-only 대화 구조를 표현한 AI 생성 대표 이미지

Claude Fable 5.1 마이그레이션은 모델 아이디만 바꾸는 작업으로 끝나지 않습니다. 2026년 9월 2일 기준, 기존 코드가 강제 도구 호출을 쓰거나 과거 대화·도구 목록을 매 요청마다 다시 만들면 400 오류 또는 thinking 블록 무효화가 발생할 수 있으므로 호출 정책과 대화 저장 방식을 함께 점검해야 합니다.

Anthropic의 Fable 5.1 발표, 모델 개요, 변경점 문서, 마이그레이션 가이드를 기준으로 실제로 바뀐 API 동작만 정리합니다.

이 글의 핵심
  • 모델 아이디·가격·제공 범위
  • 기존 에이전트 통합이 깨지는 지점
  • 강제 도구 호출을 대체하는 방법
  • thinking 블록을 보존하는 대화 구조
  • effort·캐시 비용 재조정 기준
  • 배포 전에 돌릴 전환 체크리스트
먼저 팩트체크할 부분

Fable 5.1과 Mythos 5.1은 같은 기반 모델이지만 공개 범위와 안전장치가 다릅니다. 일반 개발자는 Fable 5.1을 사용하며, Mythos 5.1은 Project Glasswing의 신뢰 접근 프로그램 참여자에게만 제공됩니다.

공식 발표: Introducing Claude Fable 5.1 and Claude Mythos 5.1


1. Claude Fable 5.1 마이그레이션 범위

Fable 5.1의 모델 아이디, 가격 유지, 캐시 절감을 세 카드로 비교한 인포그래픽

모델 아이디는 claude-fable-5-1입니다

Claude API에서는 claude-fable-5-1을 사용합니다. Amazon Bedrock은 anthropic.claude-fable-5-1, Google Cloud와 Microsoft Foundry는 claude-fable-5-1로 안내됩니다. 컨텍스트 창은 100만 토큰, 동기식 Messages API 최대 출력은 12만8천 토큰입니다.

Claude Code 앱 자체의 모델 전환과 캐시 동작이 궁금하다면 Claude Code 2.1.251 모델 전환·캐시 비용 정리를 함께 보면 범위를 구분하기 쉽습니다.

가격은 유지되고 캐시 읽기만 내려갔습니다

기본 입력은 백만 토큰당 10달러, 출력은 50달러로 Fable 5와 같습니다. 캐시 읽기는 1달러에서 0.25달러로 내려갔고, 5분 캐시 쓰기는 12.50달러, 1시간 캐시 쓰기는 20달러입니다.


2. 기존 통합이 왜 깨질 수 있나

강제 도구 호출, 이전 대화 수정, 병렬 호출 감소라는 세 전환 위험을 보여주는 인포그래픽

강제 tool_choice 두 종류가 더 이상 지원되지 않습니다

tool_choiceany로 두거나 특정 도구 이름을 강제로 지정하면 Fable 5.1은 400 invalid_request_error를 반환합니다. autonone은 계속 지원됩니다.

thinking 블록 앞부분을 바꾸면 접두사가 달라집니다

이전 사용자 메시지, 시스템 프롬프트, 도구 배열처럼 thinking 블록보다 앞선 바이트를 수정하면 해당 블록이 만들어진 대화와 현재 요청의 접두사가 달라집니다. 새 계정에서는 오류가 나거나 설정에 따라 블록이 제거될 수 있습니다.

긴 에이전트 루프의 호출 묶음도 재측정해야 합니다

공식 문서는 코딩·컴퓨터 사용 루프에서 다음 읽기 작업이 암시적으로만 주어질 때 Fable 5.1이 독립 도구를 한 턴에 하나씩 호출할 수 있다고 설명합니다. 정답 품질 문제라기보다 왕복 횟수와 지연 시간이 늘어나는 운영 문제이므로 추적 로그에서 병렬 호출 수를 확인해야 합니다.


3. 강제 도구 호출을 어떻게 바꿔야 하나

강제 지정에서 자동 선택과 엄격한 스키마로 바뀌는 도구 호출 정책 인포그래픽

tool_choice는 auto로 두고 적용 조건을 명시합니다

특정 도구가 필요한 이유와 호출 조건을 사용자 지시 또는 뒤에 추가한 시스템 메시지에 적습니다. 스키마에 맞는 인자가 필요하면 도구 정의에 strict: true를 사용하고, 단지 JSON 형식을 얻기 위한 강제 호출이었다면 structured outputs로 옮기는 편이 명확합니다.

{
  "model": "claude-fable-5-1",
  "tool_choice": {"type": "auto"},
  "tools": [{
    "name": "record_summary",
    "strict": true
  }]
}

한 턴에 반드시 호출해야 하면 지시를 뒤에 붙입니다

애플리케이션이 현재 턴의 특정 도구 호출을 요구한다면 최신 사용자 턴 뒤에 시스템 메시지를 추가해 도구 이름과 필요성을 적을 수 있습니다. 기존 top-level system을 고쳐 쓰지 않으므로 앞선 접두사와 캐시를 유지할 수 있습니다.

전환 전후 오류와 스키마 준수율을 함께 봅니다

점검 항목 이전 구현 Fable 5.1 권장
도구 선택 any 또는 특정 tool auto + 명시적 조건
인자 형식 강제 호출에 의존 strict tool use
JSON 응답 도구를 형식 래퍼로 사용 structured outputs

4. thinking 블록과 대화 기록을 어떻게 보존하나

사용자, 응답, 생각 블록을 잠그고 새 지시를 뒤에 추가하는 대화 기록 원칙 인포그래픽

대화 기록은 append-only로 유지합니다

assistant 응답은 API가 돌려준 순서와 내용을 그대로 저장하고 다음 요청에 다시 보냅니다. thinking 블록도 포함하며, 이전 메시지를 요약문으로 제자리 교체하거나 턴별 알림을 삽입했다가 다음 요청에서 지우면 안 됩니다.

지시 변경은 새 시스템 메시지로 추가합니다

한 턴만 적용할 안내는 clear_at: "next_user_message"를 쓰는 turn-scoped system message로 추가할 수 있습니다. 이 기능은 beta 헤더가 필요하며, 과거 메시지를 삭제하지 않아도 다음 사용자 턴부터 렌더링과 과금에서 제외되도록 설계됐습니다.

관리형 제품은 접두사 보존을 대신 처리합니다

Claude Code, claude.ai, Claude Managed Agents, Claude Agent SDK가 대화 기록을 관리한다면 접두사를 그대로 유지합니다. 직접 Messages API 배열을 조립하는 통합만 우선 감사하면 되며, 관리형 에이전트의 구조는 Claude Managed Agents Chat SDK 구조와 보안 설계에서 더 자세히 볼 수 있습니다.


5. effort·캐시 비용을 어떻게 재조정하나

낮음부터 어려운 단계까지 effort와 백만 토큰당 0.25달러 캐시 읽기를 보여주는 인포그래픽

API 기본 effort는 high입니다

Fable 5.1의 Claude API 기본 effort는 high입니다. 공식 프롬프트 가이드는 Fable 5에서 쓰던 같은 이름의 effort가 같은 계산량을 뜻한다고 가정하지 말고 low, medium, high, xhigh, max를 자체 평가로 다시 비교하라고 권합니다.

low에서는 검색·검색증강 호출이 줄 수 있습니다

low에서는 기억으로 답하고 검색이나 retrieval 도구를 덜 부를 수 있습니다. 최신성 또는 근거 회수가 성공 조건이라면 해당 턴의 effort를 올리거나 언제 검색할지 지시문에 명시해야 합니다.

캐시 절감은 append-only 구조와 함께 계산합니다

캐시 읽기 가격은 백만 토큰당 0.25달러지만, 앞부분을 고치면 캐시 접두사도 끊깁니다. 비용 비교는 토큰 단가만 보지 말고 cache read 토큰, 새 입력 토큰, 도구 왕복 횟수를 한 실행 단위로 합산해야 합니다.


6. Claude Fable 5.1 전환 체크리스트

아이디 교체부터 평가 재실행까지 다섯 단계 전환 체크 순서 인포그래픽

1단계. 모델 아이디와 공급자별 이름을 교체합니다

Claude API, Bedrock, Google Cloud, Microsoft Foundry의 모델 아이디가 서로 같은지 먼저 확인합니다. 배포 환경별 설정 파일과 fallback 목록도 함께 검색합니다.

2단계. 도구 선택과 대화 저장 코드를 수정합니다

any·특정 tool 강제를 제거하고, assistant 응답과 thinking 블록을 byte-identical하게 보존합니다. 시스템 프롬프트와 도구 목록을 턴마다 재생성하는 코드가 있는지도 확인합니다.

3단계. 고정 평가 세트로 다시 측정합니다

  • 도구 호출 성공률과 인자 스키마 준수율
  • 검색이 필요한 질문의 retrieval 실행률
  • 독립 도구의 병렬 호출 수와 전체 턴 수
  • effort별 품질·지연 시간·실행 비용
  • 긴 대화에서 prefix mismatch 발생 여부

7. 한계·실패 조건

앞부분 수정, 도구 목록 교체, 낮은 effort 검색, 도구 직렬 호출의 실패 조건 인포그래픽

과거 대화를 수정하는 제품은 먼저 저장 구조를 바꿔야 합니다

알림을 과거 턴에 삽입하거나 오래된 도구 배열을 새 버전으로 덮어쓰는 제품은 thinking 접두사 규칙과 충돌합니다. 새 계정은 2026년 8월 31일 이후 이 검사를 강하게 적용받으며, 이전 계정도 향후 적용을 가정해 고치는 편이 안전합니다.

기능별 beta 상태와 공급자 지원을 분리해야 합니다

중간 effort 변경, turn-scoped system message, progress updates는 각각 beta 헤더와 지원 표를 확인해야 합니다. Fable 5.1 자체가 일반 제공이라는 사실이 모든 부가 기능의 안정 버전을 의미하지는 않습니다.

도구 권한과 플러그인 보안은 모델 전환과 별개입니다

모델이 더 잘 호출해도 도구 권한이 과도하면 운영 위험은 남습니다. 외부 도구 설치와 권한 범위는 Claude Code 플러그인 설치·마켓플레이스·보안 가이드처럼 별도의 공급망·권한 검토 대상으로 관리해야 합니다.


8. Q&A와 정리

강제 호출, 대화 수정, 검색 품질 질문에 따라 코드 수정, 기록 고정, effort 조정을 고르는 결정 트리

Q1. Claude Mythos 5.1은 누구나 사용할 수 있나요?

아닙니다. Mythos 5.1은 Project Glasswing의 심사된 신뢰 접근 프로그램 참여자에게만 제공됩니다.

Q2. Claude Code 사용자도 대화 저장 코드를 직접 고쳐야 하나요?

Claude Code가 대화를 관리한다면 접두사 보존을 제품이 처리합니다. 자체 API 래퍼가 메시지를 다시 조립할 때만 별도 감사를 우선하면 됩니다.

Q3. 데이터 보관 정책도 바로 바뀌었나요?

Enterprise Frontier Safeguards는 2026년 가을부터 기업 고객에게 단계적으로 제공될 예정입니다. 그전에는 자격을 갖춘 고객에게 zero data retention을 제공한다고 Anthropic이 안내했습니다.

Q4. Fable 5.1 출력에 워터마크가 있나요?

공식 변경점 문서는 Fable 5.1과 Mythos 5.1의 생성 텍스트에 Anthropic의 통계적 텍스트 워터마크가 적용된다고 설명합니다.

Q5. Fable 5.1의 지원 종료일은 언제인가요?

모델 개요에는 retirement가 2027년 9월 1일보다 이르지 않다고 표시됩니다. 실제 전환 일정은 최신 모델 수명 주기 문서를 다시 확인해야 합니다.

배포 전에는 모델 아이디, 도구 선택, 대화 불변성, effort, 평가 세트를 한 변경 묶음으로 기록하세요. 소량 트래픽에서 오류 유형과 지연을 분리해 보면 모델 문제와 통합 문제를 빠르게 가를 수 있습니다.


참고 자료

발표, 모델 개요, 마이그레이션, 프롬프트 가이드로 나뉜 공식 자료 지도 인포그래픽

공식 발표·모델 정보

마이그레이션·프롬프트 문서

반응형