Claude API에는 여러 모델이 있고, 어떤 모델을 고르느냐가 비용과 품질을 동시에 좌우합니다. 이 글은 2026년 9월 기준(9월 2일·9일 재대조) 공식 Models overview 문서를 바탕으로 현행 모델들의 스펙·가격을 비교하고, 작업 유형별 선택 기준을 정리합니다.
🟢 현행 모델 라인업 일치 · 모델 안내 · Fable 구독 안내
Fable 5·5.1 구독 안내(2026년 9월 7일 갱신): 2026년 9월 1일 출시된 Claude Fable 5.1이 현행 Fable 모델이고, Fable 5는 레거시로 전환됐습니다. 구독 조건은 두 모델이 같습니다 — Max·Team Premium 플랜은 주간 사용 한도의 50% 범위에서 포함되고, Pro·Team Standard 플랜은 사용량 크레딧(입력 100만 토큰당
현행 모델 라인업
공식 문서 기준, 현재 주력 모델은 다음과 같습니다. 모든 현행 Claude 모델은 텍스트·이미지 입력, 텍스트 출력, 다국어, 비전을 지원하며 Claude API·AWS·Bedrock·Vertex AI·Microsoft Foundry를 통해 제공됩니다.
- Claude Opus 5 (
claude-opus-5) — Anthropic의 강력한 Opus 등급 모델. 복잡한 추론과 장기 호흡의 에이전트 코딩에 적합. 가격 입력 $5 / 출력 $25 (MTok당), 컨텍스트 1M 토큰, 최대 출력 128k.effort파라미터를 지원하며 기본값은 high. - Claude Sonnet 5 (
claude-sonnet-5) — 속도와 지능의 최적 균형. 2026년 6월 30일 출시. Free·Pro 플랜의 기본 모델이며, Max·Team·Enterprise에서도 사용 가능. 가격은 $2 / $10 — 당초 2026년 8월 31일까지 인트로 가격이었으나, Anthropic이 9월 1일 예정이던 $3 / $15 인상을 철회하고 $2 / $10을 표준가로 확정(2026-09-02 공식 Pricing 문서 확인). 컨텍스트 1M, 최대 출력 128k. adaptive thinking이 기본으로 켜져 있으며, extended thinking은 지원하지 않습니다. - Claude Haiku 4.5 (
claude-haiku-4-5-20251001, aliasclaude-haiku-4-5) — 가장 빠르면서 프런티어에 근접한 지능. 가격 $1 / $5, 컨텍스트 200k, 최대 출력 64k. extended thinking을 지원합니다. - Claude Fable 5.1 (
claude-fable-5-1) — Anthropic이 널리 공개한 모델 중 가장 강력. 가장 까다로운 추론·장기 에이전트 작업용. 가격 $10 / $50, 컨텍스트 1M, 최대 출력 128k. adaptive thinking이 항상 켜져 있습니다. (2026년 6월 9일부터 일반 제공)
가격·스펙 핵심 비교
비용은 입력/출력 토큰 100만 개(MTok — 글자 100만 개 단위의 처리량 기준)당 USD로 매겨집니다. 같은 작업이라도 모델에 따라 단가가 Haiku $1/$5 → Sonnet 5 $2/$10 → Opus $5/$25 → Fable $10/$50로 차이가 큽니다. 입력 대비 출력이 비싸므로, 출력 길이를 줄이는 프롬프트 설계가 비용에 직접 영향을 줍니다.
2026년 9월 2일 업데이트: Sonnet 5의 $2/$10은 당초 2026년 8월 31일까지의 인트로 가격으로 안내됐고 9월 1일부터 $3/$15로 오를 예정이었습니다. 이 인상은 시행되지 않았습니다 — Anthropic 공식 Pricing 문서가 $2/$10을 표준가로 확정했고 예정됐던 인상은 이뤄지지 않는다고 명시했습니다. 비용 계획은 $2/$10을 기준으로 잡으면 됩니다.
- 컨텍스트 윈도우 — 한 번의 대화에서 처리할 수 있는 최대 글자 분량: Opus 5·Sonnet 5·Fable 5.1는 1M 토큰, Haiku 4.5는 200k 토큰. (단 Microsoft Foundry에서 Opus 4.8은 200k)
- 최대 출력: Opus 5·Sonnet 5·Fable 5.1는 128k, Haiku 4.5는 64k. (동기 Messages API 기준. Batch API에서는 일부 모델이 베타 헤더로 최대 300k 출력)
- thinking — 모델이 답변 전 내부적으로 추론하는 기능: Haiku 4.5는 extended thinking(예산 지정 방식) 지원. Opus 4.8·Sonnet 5·Fable 5.1는 adaptive thinking(자동 조정 방식). Sonnet 5는 extended thinking을 지원하지 않으며, Fable 5.1는 adaptive thinking이 항상 켜진 상태입니다.
- knowledge cutoff(신뢰 가능한 지식 기준일): Fable 5.1 Jun 2026, Opus 5 May 2026, Sonnet 5 Jan 2026, Haiku 4.5 Feb 2025(공식 모델 문서 2026-09-02 확인).
- 새 토크나이저: Sonnet 5는 이전 모델과 다른 토크나이저를 사용합니다. 같은 텍스트라도 토큰 수가 약 30% 더 많이 집계되므로, Sonnet 4.6 기준으로 설정해 둔 토큰 예산이나 비용 추산치를 Sonnet 5로 마이그레이션할 때는 반드시 다시 측정하세요.
작업 유형별 선택 기준
공식 문서는 "잘 모르겠으면 복잡한 작업은 Opus 5로 시작"하라고 안내합니다. 실무에서는 비용·품질 트레이드오프를 기준으로 다음처럼 잡으면 무난합니다.
- 대량·단순·저지연 작업 (분류, 짧은 응답, 실시간 챗봇) → Haiku 4.5. 가장 빠르고 저렴.
- 일상 프로덕션 기본값 (대부분의 코딩·생성·요약) → Sonnet 5. 속도·지능·비용 균형. Free·Pro 플랜에서 기본으로 제공됩니다.
- 복잡한 추론·장기 에이전트 코딩 → Opus 5. 답변 품질이 중요할 때.
- 최고난도 프런티어 작업 → Fable 5.1. 추가 비용이 정당화될 만큼 어려운 워크로드에만.
긴 문서·코드베이스를 다룬다면 1M 컨텍스트(Opus·Sonnet 5·Fable)가 유리하고, 단계별로 난이도가 달라지는 워크플로라면 단계마다 모델을 다르게 라우팅하는 것도 방법입니다.
모델 ID는 고정 스냅숏
주의할 점: 모든 Claude 모델 ID는 고정 스냅숏(pinned snapshot)입니다. ID에 날짜가 있으면(예: 20251001) 그 릴리스에 고정되고, 4.6 세대부터는 날짜 없는 형식(예: claude-sonnet-5)도 자동 갱신 포인터가 아니라 고정 스냅숏입니다. 모델 capability와 토큰 한도는 Models API로 프로그램적으로 조회할 수 있습니다(max_input_tokens, max_tokens, capabilities 반환).
정리
모델 선택은 ① 작업 난이도와 비용 허용치 파악 → ② Haiku/Sonnet 5/Opus/Fable 중 등급 선택 → ③ 컨텍스트·thinking·출력 요구로 미세조정 순서가 합리적입니다. 더 알아보려면 Claude API 모델 ID와 버전 관리, 컨텍스트 윈도우와 토큰을 함께 참고하세요.
본 글은 Anthropic 공식 문서(platform.claude.com/docs)의 공개 정보를 2026년 9월 기준으로 정리했습니다(9월 2일 가격·9월 9일 모델 ID 재대조). 모델 라인업·가격·스펙은 자주 바뀌므로 실제 선택 시 공식 Models overview·Pricing 페이지를 반드시 확인하세요. 본 사이트는 Anthropic 공식 사이트가 아닙니다.