Claude Opus 5.5 너프설과 사용량 차이, 무엇을 확인해야 하나
질문·트러블슈팅

Claude Opus 5.5 너프설과 사용량 차이, 무엇을 확인해야 하나

성능 저하 소문보다 먼저 모델·effort·컨텍스트·로그인 방식과 공식 한도 리셋을 분리해서 살펴봤다

2026-09-26논의 1회 정리

Claude Opus 5.5 출시 직후 두 반대 경험이 동시에 쏟아졌다. 더 빠르고 한도가 오래간다는 평가 옆에서, 성능이 낮아졌거나 계정별 허용량이 다르다는 의심도 나왔다. 진짜 모델 너프와 설정 차이, 공식 한도 변경을 어떻게 구별할 수 있을까.

사용량 리셋은 소문이 아니라 출시 정책이다

Anthropic은 2026년 9월 22일 Opus 5.5를 발표하며 Pro·Max·Team과 좌석형 Enterprise의 5시간 한도를 늘렸다고 밝혔다. 구독자에게는 필요할 때 쓰는 rate limit reset도 제공했다. 갑자기 게이지가 복구된 사례를 모두 오류나 비밀 조정으로 해석할 이유는 없다.

리셋은 Claude 웹이나 Desktop의 Settings > Usage에서 확인하고 실행한다. 제공된 리셋에 따라 5시간 한도 또는 주간 한도가 즉시 채워지지만, 기존 주간 갱신 시각은 바뀌지 않는다. Claude Code 터미널에서는 리셋 버튼을 누를 수 없지만, 웹에서 실행하면 같은 계정의 Claude Code에도 반영된다.

추가 사용량 크레딧은 별도 체계다. 포함 한도를 넘긴 뒤 유료 크레딧으로 계속 작업해도 5시간 창은 평소대로 갱신된다. 무료 리셋은 이미 청구된 크레딧을 돌려주지 않는다.

같은 요금제에서도 게이지가 다르게 줄어드는 이유

Claude의 구독 한도는 단순한 프롬프트 횟수가 아니다. Anthropic 도움말은 대화 길이와 복잡도, 모델, effort, 파일, 도구 사용이 소비량을 바꾼다고 설명한다. 웹·Desktop·Claude Code 사용량도 한 계정의 같은 한도에 합산된다.

Claude Code는 매 요청마다 기존 대화, 읽어들인 프로젝트 파일, CLAUDE.md, 새 지시를 모델에 보낸다. 긴 디버깅 세션은 뒤로 갈수록 같은 질문도 더 비싸진다. 많은 파일을 읽힌 세션과 새로 연 터미널을 사용한 세션은 같은 한 시간 동안 작업해도 게이지 변화가 다를 수 있다.

로그인 방식도 확인해야 한다. 구독 계정으로 로그인하면 포함 한도를 쓰지만, API 자격으로 실행하면 토큰당 과금 체계가 적용된다. 구독 사용량은 Claude의 사용량 설정에서, API 사용은 /cost로 확인할 수 있다. 현재 모델은 /model, 불러온 컨텍스트는 /context로 확인할 수 있다.

공개된 개인 측정치는 API 정가로 바꾼 추정치일 수 있으며, 모델과 캐시 구성에 따라 결과가 달라질 수 있다. 초기 관측은 문제를 찾는 단서이지, 사용자별 비공개 차등 한도의 증거는 아니다.

벤치마크는 너프설을 아직 뒷받침하지 않는다

Anthropic이 공개한 Terminal-Bench 4.0 결과에서 Opus 5.5는 66.4%를 기록했다. Opus 5의 자사 재현 결과는 52.3%였다. 다만 5.5 점수는 xhigh effort이며, 표의 다른 항목 다수는 max 설정이라 기본 medium과 바로 비교하면 안 된다.

공식 자료에서 더 중요한 수치는 기본 effort다. Opus 5.5 medium은 FrontierCode에서 54.6%, CursorBench에서 52.5%를 기록했다. 두 시험 모두 Opus 5 max 결과를 앞섰다고 Anthropic은 설명한다. 회사는 동시에 최상위 모델끼리의 점수 차이가 실제 체감 차이를 과장할 수 있다고 경고했다.

공개된 독립 집계에서도 Opus 5.5는 Terminal-Bench 계열 상위권에 있다. 현재 자료만으로 출시 뒤 모델이 전반적으로 약화됐다고 단정할 근거는 없다. Anthropic 상태 페이지도 9월 서비스 가동률을 정상 범위로 표시한다.

반대 체감은 무시할 수 없다. 써본 사람들 사이에서는 medium이 빠르고 안정적이라는 평가와, 문서 검토나 복잡한 계획에서 실수가 늘었다는 의견이 함께 나온다. xhigh와 max가 더 오래 생각하면서 저장소를 과도하게 탐색해 오히려 작업을 꼬이게 한다는 불만도 있다.

effort가 바뀌면 같은 Opus 5.5도 다른 제품처럼 느껴진다

Opus 5.5의 기본 effort는 medium이며 thinking은 항상 켜져 있다. 사용자는 /effort로 low·medium·high·xhigh·max를 고를 수 있다. 높은 단계는 더 많은 토큰과 시간을 쓰므로 한도도 빨리 줄어든다.

일상적인 수정과 테스트 작성은 medium에서 시작할 수 있다. 여러 모듈을 가로지르는 설계나 재현하기 어려운 버그라면 high로 올린다. xhigh와 max는 실패 비용이 큰 작업에서만 비교 실험을 거치는 편이 낫다. 높은 effort가 모든 과제의 정확도를 선형으로 높여주지는 않는다.

세션 관리도 함께 해야 한다. 작업이 바뀌면 /clear로 대화 기록을 비우고, 진행 중인 긴 작업은 /compact로 요약한다. 파일 전체를 붙여 넣기보다 경로와 함수명을 지정하고, CLAUDE.md에는 반복해서 필요한 규칙만 남긴다. 계획은 Opus로 만들고 실행은 Sonnet으로 넘기는 /model opusplan도 한도를 나누는 방법이다.

너프 여부는 고정된 작업 묶음으로 판단해야 한다

체감 대신 재현 가능한 검사를 만들려면 먼저 저장소 커밋을 고정한다. 같은 프롬프트, 권한 모드, Claude Code 버전, 모델과 effort를 사용하고 매번 새 세션에서 시작한다. 기능 구현, 버그 수정, 리팩터링처럼 실제 작업 세 종류를 골라 자동 테스트 통과율을 기록한다.

각 조건은 한 번이 아니라 최소 세 차례 반복한다. 완료 시간과 수정한 파일 수, 도구 호출 수, 테스트 실패, 토큰 또는 게이지 변화를 함께 남긴다. 답변 문체가 달라진 현상과 실제 성공률 하락도 분리해야 한다.

Opus 5.5는 토큰 정가가 Opus 5보다 20% 낮고, 캐시 읽기는 60% 저렴하다. Anthropic이 말한 평균 40% 절감은 낮은 단가와 작업당 토큰 감소를 합친 조건부 수치다. 개인 개발자에게 중요한 질문은 모델이 예전보다 영리한지가 아니다. 자신의 저장소에서 medium이 재작업을 줄이며, 늘어난 구독 한도를 실제 완성 작업으로 바꾸는지가 남는다.

Claude Opus 5.5Claude Code사용량 한도effortrate limit클진요

참고 링크

자주 묻는 질문

Q

Claude Opus 5.5 사용량은 몇 시간마다 초기화되나요?

구독에 포함된 세션 한도는 일반적으로 5시간 창을 사용한다. 주간 한도도 별도로 적용되며, 제공받은 무료 리셋은 Settings > Usage에서 직접 실행해야 한다.

Q

Claude Opus 5.5의 기본 effort는 무엇인가요?

기본 권장값은 medium이며 thinking은 항상 활성화된다. 복잡한 설계나 어려운 디버깅에서만 high 이상을 시험하는 편이 사용량을 관리하기 쉽다.

Q

Claude Code 계정마다 사용량이 다른 이유는 무엇인가요?

대화 길이, 읽은 파일, CLAUDE.md, 도구 호출, effort와 모델이 모두 소비량에 영향을 준다. 웹과 Desktop 사용량도 합산되므로 같은 요금제라도 체감이 달라질 수 있다.

같은 주제 더 보기