#!if top = 문서명1 != null ? 문서명1 : calleeTitle != null ? (i = calleeTitle.lastIndexOf("/")) != -1 ? calleeTitle.substr(0, i) : '상위 문서' : '상위 문서'
[[파일:상위 문서 아이콘.svg|align=left&width=21.6px]] {{{#!html }}} 상위 문서: [[]]1. 개요
Claude의 여러 API 모델.2. 지원 모델
2.1. Haiku
Claude 3.5 Haiku는 Bedrock이나 구글 클라우드에서만 이용할 수 있다.| 모델 | 입력[기준] | 출력[기준] | 5분 캐시 쓰기[3] | 1시간 캐시 쓰기 | 캐시 읽기 |
| Haiku 3.5 | 0.8$ | 4$ | 1$ | 1.6$ | 0.08$ |
| Haiku 4.5 | 1$ | 5$ | 1.25$ | 2$ | 0.1$ |
2.2. Sonnet
Sonnet 4는 Bedrock이나 구글 클라우드에서만 사용할 수 있다. 또, Sonnet 5부터는 가격이 입력 2$, 출력 10%로 고정되었다.[4]| 모델 | 입력[기준] | 출력[기준] | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 읽기 |
| Sonnet 5 | 2$ | 10$ | 2.5$ | 4$ | 0.2$ |
| Sonnet 4.6 | 3$ | 15$ | 3.75$ | 6$ | 0.3$ |
| Sonnet 4.5 | 3$ | 15$ | 3.75$ | 6$ | 0.3$ |
| Sonnet 4 | 3$ | 15$ | 3.75$ | 6$ | 0.3$ |
2.3. Opus
Opus 4와 4.1은 구글 클라우드에서만 사용할 수 있으며, 이후 모델들보다 API 가격이 3배이다. Opus 5부터는 추론 기능을 끌 수 없다.| 모델 | 입력[기준] | 출력[기준] | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 읽기 |
| Opus 5 | 5$ | 25$ | 6.25$ | 10$ | 0.5$ |
| Opus 4.8 | 5$ | 25$ | 6.25$ | 10$ | 0.5$ |
| Opus 4.7 | 5$ | 25$ | 6.25$ | 10$ | 0.5$ |
| Opus 4.6 | 5$ | 25$ | 6.25$ | 10$ | 0.5$ |
| Opus 4.5 | 5$ | 25$ | 6.25$ | 10$ | 0.5$ |
| Opus 4.1 | 15$ | 75$ | 18.75$ | 30$ | 1.5$ |
| Opus 4 | 15$ | 75$ | 18.75$ | 30$ | 1.5$ |
2.4. Mythos/Fable
Mythos 5는 일반인이 사용할 수 없으며, 승인된 기업과 정부만 사용 가능하다. Fable 5는 사용 시 30일간 Anthropic에 사용 기록이 남으며, 이 기능은 해제할 수 없다.| 모델 | 입력[기준] | 출력[기준] | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 읽기 |
| Fable 5 | 10$ | 50$ | 12.5$ | 20$ | 1$ |
| Mythos 5 | 10$ | 50$ | 12.5$ | 20$ | 1$ |
Batch를 선택하면 API 가격이 절반이 되는 대신 답변 출력이 최대 24시간까지 지연될 수 있다.
3. 토큰 계산하기
토큰을 계산하는 방법은 각 회사마다 다르다.여기서 Claude에서는
Python SDK:
#!syntax python
from anthropic import Anthropic
client = Anthropic()
result = client.messages.count_tokens(
model="claude-sonnet-4-5",
messages=[
{
"role": "user",
"content": "이 문장은 토큰이 몇 개야?"
}
],
)
print(result.input_tokens)
TypeScript SDK:
#!syntax typescript
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic();
const result = await client.messages.countTokens({
model: "claude-sonnet-4-5",
messages: [
{
role: "user",
content: "이 문장은 토큰이 몇 개야?",
},
],
});
console.log(result.input_tokens);
이런 방법들이 있다. 여기서 이 방법들은 실제로 대화를 처리하진 않고, 토큰 수만 계산해서 출력해준다.
4. 모델별 기능
| 구분 | Fable 5 | Opus 4.8 | Sonnet 5 | Haiku 4.5 |
| 확장 사고 | 아니요 | 아니요 | 아니요 | 예 |
| 적응형 사고 | 예(항상 활성화) | 예 | 예 | 아니요 |
| 상대적 지연 시간 | 느림 | 보통 | 빠름 | 가장 빠름 |
| 컨텍스트 윈도우 | 100만 토큰 | 100만 토큰 | 100만 토큰 | 20만 토큰 |
| 최대 출력 | 12만 8천 토큰 | 12만 8천 토큰 | 12만 8천 토큰 | 6만 4천 토큰 |
| 지식 컷오프(신뢰 가능한 지식 단절일) | 2026년 1월 | 2026년 1월 | 2026년 1월 | 2025년 2월 |
| 학습 데이터 기준일 | 2026년 1월 | 2026년 1월 | 2026년 1월 | 2025년 7월 |