클로드 오퍼스 5 노력 수준이 토큰 비용을 조절하는 방식
AI·바이브코딩by 코냥이 5분조회 5

클로드 오퍼스 5 노력 수준이 토큰 비용을 조절하는 방식

2026년 7월 24일 앤트로픽이 클로드 오퍼스 5를 공개했어요. 가격은 직전 오퍼스 4.8과 동일한 100만 토큰당 입력 $5·출력 $25로 동결했어요. 저는 이게 단순히 "성능이 좋아진" 소식이 아니라, AI 회사들이 기업 고객의 비싼 청구서 걱정에 정면으로 답하기 시작한 첫 신호로 읽혀요. 포천은 이 기능을 "AI 청구서에 대한 기업의 우려"에 대한 응답이라고 짚었거든요.

가장 큰 변화는 성능이 아니라 조절이에요. 사용자가 노력 수준(effort)을 골라 비용과 성능을 맞바꿀 수 있게 만들었어요. 공식 문서상 단계는 low·medium·high·xhigh·max 다섯 개이고 기본값은 high예요.

노력 수준 다이얼이 실제로 조절하는 건 뭘까요

오퍼스 5의 노력 수준은 모델이 답하기 전에 내부적으로 쓰는 추론 토큰(reasoning tokens) 양을 조절해요. 저는 이게 "생각할 시간을 얼마나 줄까"를 결정하는 다이얼이라고 봐요.

단계가 높을수록 모델은 더 많은 사고 과정을 거치고, 그만큼 출력 토큰이 늘어나요. 토큰당 과금이므로 노력 수준은 곧 비용 다이얼이 되는 셈이에요. 예를 들어 같은 작업을 low로 돌렸을 때와 max로 돌렸을 때 토큰 소비량이 2~3배 차이가 날 수 있어요.

앤트로픽은 다섯 단계를 이렇게 설명해요.

노력 수준언제 쓰면 좋나토큰 사용량속도
low단순 반복 작업, 간단한 포맷 변환가장 적음가장 빠름
medium일상 코딩, 문서 요약적음빠름
high (기본값)복잡한 코딩, 디버깅보통보통
xhigh어려운 아키텍처 결정, 멀티스텝 에이전트많음느림
max장시간 자율 에이전트, 신규 문제가장 많음가장 느림

앤트로픽 공식 문서대부분의 프로덕션 작업에서 high 또는 medium으로 충분하고, max는 "모델이 며칠 동안 자율적으로 돌아야 하는 장기 에이전트"에만 권장한다고 해요.

벤치마크 숫자보다 더 중요한 건 "같은 가격에 무엇이 바뀌었나"예요

오퍼스 5는 여러 벤치마크를 기록했어요. Frontier-Bench(에이전트 터미널 코딩)에서 43.3%(max 노력 수준 기준), OSWorld 2.0(컴퓨터 사용)에서 70.6%, AutomationBench(업무 자동화 end-to-end)에서 26.0%를 거뒀어요.

그런데 앤트로픽이 벤치마크를 발표하는 방식이 달라졌어요. 예전처럼 "이 모델은 몇 점"이라고 하나의 점수만 발표하지 않고, 노력 수준별로 "비용 대 성능 곡선"을 공개했어요. 저는 이게 "모델이 얼마나 좋은가"를 "당신이 쓸 예산 안에서 얼마나 좋은가"로 재정의하는 신호라고 봐요.

앤트로픽은 오퍼스 5가 최상위 모델 페이블 5($10/$50)에 근접한 성능을 그 절반 가격에 낸다고 설명해요. Artificial Analysis는 오퍼스 5(max)를 Intelligence Index 61점으로 1위에 올렸어요.

실전에서 노력 수준을 나눠 쓰면 비용이 얼마나 줄까요

한 분석 매체는 루틴 작업을 low/medium으로 돌리고 어려운 20%만 high로 올리면 AI 청구서를 최대 40% 줄일 수 있다고 추정했어요.

저는 이걸 사람과 일하는 방식에 빗대면 이해하기 쉽다고 봐요. 외주 개발자에게 간단한 포맷 정리를 맡길 때 최고 단가를 지불하지 않듯이, AI에게도 작업 난이도에 따라 "얼마나 깊게 생각할지"를 지정하는 거예요.

구체적으로 작업을 나누는 기준은 이래요.

low나 medium으로 충분한 작업

  • 코드 포맷 정리, 주석 추가
  • 간단한 문서 요약, 번역
  • 반복적인 데이터 정제
  • 이미 패턴이 명확한 코드 생성

high 이상이 필요한 작업

  • 새로운 아키텍처 설계
  • 복잡한 버그 원인 추적
  • 예외 케이스가 많은 로직 작성
  • 여러 파일을 넘나드는 리팩토링

클로드 코드에서는 4시간 코딩 세션을 high effort로 돌리면 약 $7~14 정도 든다고 해요. 같은 작업을 medium으로 돌리면 토큰 소비가 줄어 비용이 30~40% 떨어질 수 있어요.

노력 수준을 바꾸면서 주의할 점이 있어요

첫 번째는 프롬프트 캐시예요. 노력 수준을 중간에 바꾸면 프롬프트 캐시가 무효화된다는 점이에요. 긴 시스템 프롬프트를 반복 사용할 때 캐시 덕분에 입력 토큰 비용을 90%까지 줄일 수 있는데, 노력 수준을 바꾸는 순간 캐시가 날아가요. 그래서 한 대화 안에서 노력 수준을 여러 번 오가기보다 처음부터 적절한 수준을 골라 고정하는 게 나아요.

두 번째는 낮은 노력 수준으로 여러 번 시도하는 것과 높은 수준으로 한 번에 맞추는 것 중 어느 쪽이 더 경제적이냐예요. 대체로 한 번 제대로 생각하게 하는 게 여러 번 다시 묻는 것보다 싸고 정확하다는 게 공식 권장이에요.

AI 모델을 고르는 게 비용 관리가 되는 시대가 온 건 이미 저희가 이전 글에서 다뤘던 변화인데요. 이제 같은 모델 안에서도 작업마다 강도를 나누는 시대가 된 거예요.

클로드 코드에서 바로 써보려면 어떻게 하나요

클로드 코드(Claude Code)에서 오퍼스 5는 2026년 7월 24일 v2.1.219 버전부터 기본 모델이 됐어요. 별도 설정 없이 곧바로 쓸 수 있어요.

노력 수준을 바꾸려면 API 요청에 effort 파라미터를 넣으면 돼요. 예를 들어 파이썬에서는 이렇게 써요.

import anthropic

client = anthropic.Anthropic()
message = client.messages.create(
    model="claude-opus-5",
    max_tokens=1024,
    effort="medium",  # low, medium, high, xhigh, max
    messages=[
        {"role": "user", "content": "이 코드를 리팩토링해줘"}
    ]
)

클로드 코드 CLI에서는 설정 파일에 default_effort 옵션을 넣거나, 매 요청마다 --effort 플래그를 붙이면 돼요.

속도가 중요한 인터랙티브 작업에서는 Fast 모드($10/$50, 약 2.5배 빠름)도 쓸 수 있어요. Fast 모드는 타이트한 인터랙티브 루프에 적합하고, 노력 수준은 medium 정도로 고정하는 게 권장이에요.

1인 사업자는 이제 뭘 해보면 될까요

저는 메이커님이 지금 당장 할 수 있는 게 세 가지라고 봐요.

첫 번째는 작업 리스트 점검이에요. 일주일 동안 AI에게 맡긴 작업을 적어보세요. "간단한 반복", "중간 난이도", "어려운 판단" 세 칸으로 나눠보는 거예요. 저는 이 작업이 AI 비용 구조를 체감하는 첫걸음이라고 생각해요.

두 번째는 티어 전략 짜기예요. 간단한 건 low, 일상적인 건 medium, 정말 어려운 20%만 high 이상으로 고정해보세요. 이 전략만으로도 청구서가 30~40% 줄어들 수 있어요.

세 번째는 프롬프트 캐시를 활용하는 거예요. 같은 시스템 프롬프트를 반복 사용한다면, 노력 수준을 바꿀 때마다 캐시가 날아간다는 걸 기억하세요. 대화 시작할 때 적절한 노력 수준을 정하고 고정하는 게 더 경제적이에요.

앤트로픽은 이번 발표에서 벤치마크를 "점수"가 아니라 "비용 대 점수 곡선"으로 공개했어요. 저는 이게 AI 업계 전체가 "더 똑똑한 모델"보다 "더 제어 가능한 모델"로 방향을 틀었다는 신호라고 읽어요.

마케터를 따로 두지 않는 1인 창업가에게 AI 도구는 이미 필수인데, 이제 그 비용을 직접 조절하는 습관을 들일 수 있게 된 거예요. AI 직원이 늘어난다고 일이 줄지 않는다는 건 이미 경험으로 알고 있으니까요. 이제 똑같은 작업을 더 싸게 돌리는 법을 배울 차례예요.

한 번 더, 빠르게 짚고 갈게요

Q. 노력 수준을 매번 바꿔도 되나요?

A. 바꿀 수는 있지만, 프롬프트 캐시가 무효화돼서 오히려 비용이 늘 수 있어요. 한 대화 안에서는 노력 수준을 고정하고, 다음 대화부터 바꾸는 게 나아요.

Q. low로 돌렸다가 답이 마음에 안 들면 다시 high로 요청하는 게 경제적인가요?

A. 대체로 아니에요. 한 번 제대로 생각하게 하는 게 여러 번 다시 묻는 것보다 토큰 소비가 적고 정확해요. 앤트로픽도 공식적으로 이 방식을 권장해요.

Q. 오퍼스 5랑 페이블 5 중 뭘 써야 하나요?

A. 대부분의 작업은 오퍼스 5로 충분해요. 페이블 5는 며칠 동안 자율적으로 돌아야 하는 장기 에이전트나 최고 난이도 작업에만 권장돼요. 가격은 페이블 5가 두 배 비싸요($10/$50).

Q. 클로드 코드 말고 API로 직접 쓸 때도 노력 수준을 조절할 수 있나요?

A. 네, API 요청에 effort 파라미터를 넣으면 돼요. low, medium, high, xhigh, max 중 하나를 문자열로 전달하면 돼요.

Q. Fast 모드는 언제 쓰는 게 좋나요?

A. 실시간 인터랙티브 작업, 예를 들어 라이브 코딩이나 즉각 피드백이 필요한 디버깅에 적합해요. 가격은 두 배($10/$50)이지만 속도가 약 2.5배 빨라져요.

코워크메이커스 에디터가 직접 최근 AI 소식을 확인하고 코냥이 AI의 도움을 받아 작성한 글이에요. 공식 문서 기반으로 팩트 체크하여 가장 빠르게 소식을 전달하려고 해요.

참고 출처 (14)