본문으로 건너뛰기
AI 구독·도구 요금과 사용법

앤트로픽 API 모델별 단가 — 네 모델의 요율 규칙 (2026년 8월)

앤트로픽 API의 모델별 단가를 공식 요금 페이지 원문과 대조해 정리했습니다. 네 모델이 있고 요율에 규칙적인 관계가 있습니다.

이 글의 요금·조건은 2026년 8월 25일에 각 서비스 공식 페이지에서 확인한 값입니다. 이후 변경됐을 수 있습니다.

전체 단가표 (100만 토큰당 USD)

모델 입력 출력 캐시 쓰기 캐시 읽기
Fable 5 $10 $50 $12.50 $1
Opus 5 $5 $25 $6.25 $0.50
Sonnet 5 $2 $10 $2.50 $0.20
Haiku 4.5 $1 $5 $1.25 $0.10

원문 단위 표기는 “/ MTok”입니다.

표에서 읽히는 규칙 — 네 모델 전부 같다

입력 요율을 1로 놓으면 나머지가 정확히 같은 비율로 움직입니다.

항목 입력 대비 확인
출력 5배 $10→$50, $5→$25, $2→$10, $1→$5
캐시 쓰기 1.25배 $12.50, $6.25, $2.50, $1.25
캐시 읽기 0.1배 $1, $0.50, $0.20, $0.10

예외가 하나도 없습니다. 이 규칙성 덕분에 모델을 바꿔도 절감 전략은 그대로 적용됩니다.

캐시가 언제부터 이득인가 — 계산

캐시 쓰기가 입력의 1.25배이고 캐시 읽기가 0.1배이므로, N번 반복할 때를 비교하면 이렇습니다.

반복 캐시 없이(입력 1 기준) 캐시 사용 판정
1회 1.00 1.25 손해
2회 2.00 1.35 이득
10회 10.00 2.15 약 4.7배 절감
100회 100.00 11.15 약 9배 절감

2회째부터 이득이고 반복이 많을수록 9배에 수렴합니다. 조건은 캐시 유지 시간 5분입니다(원문 “reflects 5-minute TTL”). 호출을 5분 안에 이어지도록 묶으면 유지됩니다.

Sonnet 5로 계산해 본 실제 금액

입력 3,000 / 출력 2,000 토큰짜리 작업 기준입니다.

모델 입력 비용 출력 비용 건당 1,000건
Fable 5 $0.030 $0.100 $0.130 $130
Opus 5 $0.015 $0.050 $0.065 $65
Sonnet 5 $0.006 $0.020 $0.026 $26
Haiku 4.5 $0.003 $0.010 $0.013 $13

1,000건 처리에서 $130과 $13의 차이입니다. 여기에 배치 처리 50% 절감을 더하면 다시 절반이 됩니다.

요금표에 함께 적힌 조건

  • 배치 처리 50% 절감 — 즉시 응답이 필요 없는 작업에.
  • 미국 전용 추론 1.1배 — 특정 지역 실행이 필요한 경우.
  • Opus 5 fast mode 2배 — 최대 2.5배 속도.
  • Managed Agents 세션시간당 $0.08 — 표준 토큰 요율과 별도.
  • 웹 검색 — 항목이 있으며 입력 토큰은 별도 과금.

확인 범위

위 단가와 조건은 앤트로픽 공식 요금 페이지 원문과 대조했습니다. 모델 성능 순위는 적지 않습니다 — 저희가 측정한 기록이 없습니다. 요금 페이지에 적힌 성격 설명(예: Haiku 4.5 “가장 빠르고 비용 효율적”)은 허브 글에 원문 그대로 옮겨 두었습니다.

또한 구독 플랜과 API의 모델 대응은 확정하지 못했습니다. 표기 방식이 서로 달라 그대로 짝짓지 않았습니다.

자주 묻는 질문

어느 모델을 써야 하나요?

성능 순위를 매기지 않으므로 추천하지 않습니다. 가장 싼 것부터 올라가며 자기 작업으로 비교해 보시길 권합니다. 요율 규칙이 같아 비교가 쉽습니다.

캐시 5분이 짧지 않나요?

반복 호출을 몰아서 하면 유지됩니다. 확장 옵션이 별도로 있다고 표기돼 있습니다.

배치 처리는 얼마나 걸리나요?

소요 시간은 요금 페이지에 표기돼 있지 않아 적지 않습니다. API 문서를 확인하시기 바랍니다.

출력이 5배인 이유가 있나요?

요금표에 이유는 적혀 있지 않습니다. 다만 네 모델 모두 같은 비율이라 일관된 정책으로 보입니다.