클로드 코드에 작업을 맡기고 답변을 기다리다 보면 커피 한 모금이 두 모금이 됩니다. 이때 눈에 들어오는 기능이 바로 Fast 모드입니다. 이름만 보면 당장 켜고 싶지만, 속도 버튼 옆에는 요금표도 붙어 있습니다.
공식 문서를 확인한 결과, Claude Code Fast 모드는 실제로 제공됩니다. 지원하는 Opus 모델의 출력 속도를 높이는 기능이며, 구독료와 별개로 사용 비용이 발생합니다. 사용법부터 최신 지원 모델, 과금 조건까지 차근차근 살펴보겠습니다.
클로드 코드 Fast 모드는 언제 생겼을까?
Anthropic은 2026년 2월 7일 Opus 4.6용 Fast 모드를 연구 프리뷰로 공개했습니다. 따라서 기능 자체는 이미 출시돼 있었고, 이후 지원 모델과 조건이 바뀌어 왔습니다.
현재 공식 문서에 명시된 지원 모델은 Opus 5.5, Opus 5, Opus 4.8입니다. Opus 4.6·4.7의 Fast 모드는 현재 지원하지 않으며, Sonnet과 Haiku에서도 사용할 수 없습니다.
2026년 9월 22일 발표된 Opus 5.5에도 Fast 모드가 제공됩니다. 예전 글에서 본 모델명과 가격을 그대로 적용하기보다, 사용하는 모델을 먼저 확인하는 것이 좋습니다. 기능은 여전히 연구 프리뷰 단계라 제공 조건과 가격이 바뀔 수 있습니다.
최대 2.5배 빨라진다는 말, 정확히 어떤 뜻일까?
공식 설명의 핵심은 초당 출력 토큰 수, 즉 OTPS가 최대 2.5배 높아진다는 것입니다. 토큰은 모델이 문장이나 코드를 처리하는 단위입니다.
Fast 모드는 같은 모델의 가중치와 기능을 유지하면서 더 빠른 추론 구성을 사용합니다. Anthropic은 모델의 지능과 기능이 동일하다고 설명합니다.
다만 이 수치를 전체 개발 시간에 그대로 곱하면 곤란합니다.
- 속도 개선의 중심은 답변과 코드가 생성되는 속도입니다.
- 첫 응답이 도착하기까지의 시간인 TTFT 개선을 뜻하는 수치는 아닙니다.
- 빌드, 테스트, 외부 명령 실행에 걸리는 시간은 별도로 생각해야 합니다.
예를 들어 테스트 자체가 3분 걸리는 프로젝트라면, 모델이 코드를 빨리 작성해도 테스트 실행 시간이 자동으로 줄어들지는 않습니다. 이런 작업에서는 실제 시간 절감 폭이 작을 수 있습니다.
추론 강도를 낮추는 설정과는 어떻게 다를까?
effort는 모델이 문제를 풀 때 얼마나 깊게 추론할지 조절하는 설정입니다. 낮추면 단순한 작업에서 시간과 토큰을 줄일 수 있지만, 복잡한 문제에서는 성능과의 절충이 생깁니다.
Fast 모드는 동일 모델의 출력 속도를 높이고, effort는 추론에 들이는 자원을 조절합니다. 두 설정은 함께 사용할 수 있지만, 복잡한 버그 분석이라면 추론 강도를 충분히 유지하는 편이 목적에 맞습니다.
Fast 모드 켜는 방법: /fast 명령어
Claude Code의 대화형 터미널에서 다음 명령을 입력합니다.
/fast
메뉴에서 Space로 켜기·끄기를 선택하고 Enter로 확정하면 됩니다. 활성화되면 Fast mode ON 안내가 표시되며, 다시 /fast를 실행해 상태를 확인하거나 끌 수 있습니다.
현재 모델이 Fast 모드를 지원하지 않으면 지원하는 Opus 모델로 전환됩니다.
Fast 모드를 꺼도 Opus 모델 선택은 유지됩니다. 다른 모델로 바꾸려면 /model을 사용하세요.
또한 대화형 세션에서 켠 설정은 기본적으로 다음 세션에도 유지됩니다. 매번 직접 켜도록 하려면 사용자 설정 파일 ~/.claude/settings.json에 다음 항목을 추가할 수 있습니다.
{
"fastModePerSessionOptIn": true
}
기존 설정이 있다면 파일 전체를 교체하지 말고 이 항목만 추가하면 됩니다.
Fast 모드 요금: Max 구독자도 별도 비용이 든다
Pro·Max·Team·Enterprise 사용자의 Fast 모드는 구독에 포함된 사용량과 별도로 Usage credits를 사용합니다. 구독 사용량이 남아 있어도 Fast 모드 요청은 크레딧에서 직접 차감됩니다.
“Max니까 이 정도는 포함이겠지”라고 생각했다면, 여기서 잠깐 요금표를 확인할 차례입니다.
아래는 캐시 미적용 입력과 출력의 기본 단가이며, 단위는 각각 100만 토큰당 미국 달러입니다.
| 모델 | 일반 입력 / 출력 | Fast 입력 / 출력 |
| Opus 5.5 | $4 / $20 | $8 / $40 |
| Opus 5 | $5 / $25 | $10 / $50 |
| Opus 4.8 | $5 / $25 | $10 / $50 |
현재 표의 기본 입력·출력 단가는 Fast 모드가 일반 속도의 2배입니다. 캐시 읽기·쓰기 등은 별도 요금 규칙이 적용되므로 실제 청구액은 사용 패턴에 따라 달라집니다.
단순 계산으로 Opus 5.5에서 캐시 없는 입력 10만 토큰과 출력 1만 토큰을 사용하면 일반 속도는 0.60달러, Fast 모드는 1.20달러입니다. 캐시·추가 기능 비용 등을 제외한 예시입니다.
Pro·Max 사용자는 Claude의 Settings > Usage에서 Usage credits를 활성화하고 지출을 확인할 수 있습니다. 월 지출 상한과 자동 충전 설정도 함께 확인해 두면 비용을 관리하기 편합니다.
/fast가 안 될 때 확인할 조건
사용 환경에 따라 필요한 조건이 다릅니다.
- Pro·Max: Usage credits 활성화가 필요합니다.
- Team·Enterprise: 조직의 Usage credits 설정과 Owner의 Fast 모드 활성화가 필요합니다.
- Claude Console 계정으로 사용: 유료 이용·Fast 모드 접근 권한·Console 조직의 관리자 활성화가 필요합니다. 연구 프리뷰 접근은 담당자 문의나 대기 명단을 통해 요청합니다.
Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS 경로에서는 현재 Fast 모드를 지원하지 않습니다.
또한 Fast 모드에는 일반 속도와 별도의 처리 한도가 있습니다. Claude Code에서는 이 한도에 도달하면 일반 속도와 요금으로 작업을 이어가고, 대기 시간이 지나면 Fast 모드가 다시 활성화됩니다.
어떤 작업에서 켜는 것이 좋을까?
제 추천은 사람이 답변을 기다리며 계속 수정하는 작업에 선택적으로 사용하는 것입니다. 예를 들어 오류 로그를 확인하고, 코드를 고치고, 결과를 보며 다시 요청하는 디버깅에서는 응답 대기 시간이 반복됩니다. 이 구간을 줄일 수 있다면 추가 비용을 지불할 이유가 생깁니다.
반면 밤새 맡기는 작업이나 테스트 실행 시간이 대부분을 차지하는 작업에서는, 먼저 전체 시간 중 모델 응답을 기다리는 비중이 얼마나 되는지 살펴보는 편이 좋습니다.
일반 속도와 Fast 모드는 입력 캐시를 공유하지 않습니다. 긴 대화 도중 모드를 바꾸면 캐시를 활용하지 못해 입력 비용이 늘 수 있습니다. 사용할 계획이라면 세션 시작부터 켜는 편이 비용 면에서 유리할 수 있습니다.
클로드 코드 Fast 모드는 기다리는 시간을 줄이고 싶은 개발자에게 유용한 선택지입니다. 먼저 짧은 실제 작업에서 절약한 시간과 크레딧 사용액을 비교해 보세요. 커피가 식기 전에 답변을 받는 즐거움과, 커피값보다 큰 추가 비용 사이에서 자신의 기준을 찾으면 됩니다.
참고 자료 및 공식 출처
- 최초 공개일과 출시 당시 모델은 Claude Platform 릴리스 노트의 2026년 2월 7일 항목에서 확인했습니다.
- 최신 지원 조건, 명령어, 설정 유지와 과금 방식은 Claude Code Fast 모드 공식 문서를 참고했습니다.
- 출력 속도의 의미와 API 제공 범위는 Claude API Fast 모드 문서에 명시돼 있습니다.
- Opus 5.5 발표일과 Fast 모드 제공은 Anthropic의 Opus 5.5 발표에서 확인했습니다.
- 모델별 단가와 캐시 요금은 Claude 공식 가격 문서를 기준으로 작성했습니다.
- 추론 강도 설정은 Claude Code 모델 설정 문서, 지출 상한은 유료 플랜 Usage credits 안내를 참고했습니다.
'IT > AI' 카테고리의 다른 글
| GPT-6 Sol vs Astra 비교: 가격 5배 차이, 코딩·추론 성능은 얼마나 다를까? (1) | 2026.09.24 |
|---|---|
| GPT-6 Sol vs 클로드 Opus 5.5 비교: 가격·성능·코딩, 무엇을 선택할까? (1) | 2026.09.24 |
| GPT-6 Sol·Astra vs Fable 5.1·Opus 5.5 비교: 코딩 성능과 가격 정리 (1) | 2026.09.24 |
| 클로드 코드 리셋권, 5시간·주간 한도 중 무엇을 초기화할까? Codex와 차이 정리 (2) | 2026.09.23 |
| 클로드 Opus 5.5 출시, GPT-6·제미나이와 비교한 성능·가격·변경점 총정리 (2) | 2026.09.23 |