Claude Code 모델 조합, Opus 5.5와 Sonnet 5.5 중 무엇을 주력으로 쓸까
AI 모델·프롬프트

Claude Code 모델 조합, Opus 5.5와 Sonnet 5.5 중 무엇을 주력으로 쓸까

Opus 5.5의 느린 응답이 아쉽다면 모델을 바꿔야 할까. Sonnet 5.5와 GPT-6.1 Sol의 가격, 작업 방식, 구독 조건을 함께 따졌다.

2026-10-01논의 1회 정리

Opus 5.5가 더 오래 생각하는데 수정은 더 늘었다면 Claude Code의 주력 모델을 바꿔야 할까. Sonnet 5.5와 GPT-6.1 Sol까지 선택지에 들어온 지금은 모델 단가보다 한 작업을 끝내는 데 드는 시간과 재작업이 중요하다.

Opus 5.5가 느리다는 경험과 공식 평가는 다르다

클코단에서는 Opus 5.5를 쓸 때 답을 기다리는 시간이 길어지고 결과를 다시 손보는 경우도 늘었다는 의견이 나왔다. 체감은 무시할 수 없다. 그렇다고 모델 전반의 성능이 떨어졌다고 단정할 근거도 없다. Anthropic은 Opus 5.5를 복잡하고 열린 과제에서 판단력이 필요한 모델로 소개한다. 회사가 공개한 초기 평가 역시 이전 Opus 대비 개선에 무게를 둔다. (anthropic.com)

기다림에는 모델 이름 외의 변수도 있다. Claude Code에서는 effort 수준에 따라 모델이 답을 내기 전 쓰는 추론량이 달라진다. Anthropic 문서에 따르면 Opus 5.5와 Sonnet 5.5는 확장 사고를 끌 수 없지만 단순한 작업에는 /effort로 수준을 낮출 수 있다. 같은 모델이라도 작업 범위와 설정을 확인하지 않으면 속도 경험을 비교하기 어렵다. (code.claude.com)

써본 사람들 사이에서는 Sonnet 5.5만으로 충분하다는 반응과 까다로운 판단에서는 Opus가 낫다는 반응이 함께 나온다. 방에서 제기된 불만도 그 사이에 놓인다. 더 강한 모델을 계속 켜둔다고 작업이 더 빨리 끝나는 것은 아니다.

Sonnet을 주력으로 둘 때도 작업을 가려야 한다

Anthropic은 버그 수정처럼 범위가 분명한 일상 작업에는 Sonnet을, 지속적인 판단이 필요한 복잡한 작업에는 Opus를 권한다. 회사 발표에는 이전 Sonnet 대비 출력 속도 개선이 제시됐다. 해당 수치는 Anthropic의 비교 결과이지 모든 저장소에서 보장되는 대기시간은 아니다. (anthropic.com)

가격 차이는 분명하다. Anthropic의 기본 API 요금에는 Sonnet과 Opus 사이에 차이가 있다. 긴 세션에서 무엇이 캐시로 처리되는지에 따라 실제 청구액의 차이가 단순히 두 배가 되지는 않는다. 구독 한도와 API 청구액도 같은 지표가 아니다. (anthropic.com)

개인 개발자라면 주력을 정할 때 대표 작업 세 개면 충분하다. 범위가 작은 버그 수정, 여러 파일에 걸친 변경, 원인이 불분명한 실패를 각각 골라 같은 테스트와 완료 조건을 적는다. Sonnet으로 먼저 구현해 테스트를 통과시킨 뒤 위험한 변경의 계획이나 결과 검토에 Opus를 투입해 비교할 수 있다. 이 순서는 우열에 대한 공식 보증이 아니라 재작업을 확인하기 위한 실험 설계다. Claude Code에서는 세션 중 /model sonnet과 /model opus로 모델을 바꿀 수 있다. (code.claude.com)

모델을 섞으면 어디서 무엇이 실행되는지 확인해야 한다

방에서는 Sonnet보다 GPT-6.1 Sol을 주력으로 두고 Opus를 보완적으로 쓰자는 의견도 나왔다. 가능한 조합이지만 Sol은 Claude Code의 Sonnet 별칭이 아니다. Claude Code의 /model sonnet은 Anthropic API 사용 시 Sonnet 5.5를, /model opus는 Opus 5.5를 가리킨다. 다른 제공자를 거치면 같은 별칭이 더 오래된 버전을 선택할 수도 있다. 비교 기록에는 서비스와 실제 모델명을 함께 남겨야 한다. (code.claude.com)

Sol을 비교하려면 같은 작업 지시와 테스트를 Codex에도 건네는 편이 명료하다. 예를 들어 실패하는 테스트, 관련 파일 범위, 바꿔서는 안 되는 동작을 적고 두 도구에 각각 요청한다. 산출물에서는 통과한 테스트뿐 아니라 변경 파일, 불필요한 수정, 사람이 고친 횟수까지 확인한다. Claude Code 안에서 모델을 바꾸는 일과 Codex에서 별도 실행한 결과를 비교하는 일은 구별해야 한다.

숫자는 Sonnet 5.5와 같지만 토큰 사용량이나 작업 완료율까지 같다는 의미는 아니다. 두 회사의 발표 자료에 실린 성능 수치도 평가 조건이 달라 단일 순위표처럼 읽기 어렵다. (developers.openai.com)

월 구독료는 모델 단가와 별도로 판단해야 한다

Codex Pro 500에 대한 방의 반응은 개인이 매달 내기에는 부담스럽다는 쪽이었다. GPT-6.1 Sol을 쓰려면 반드시 Pro 500이 필요한 것은 아니다. (help.openai.com)

특히 Ultrafast를 Sol의 기본 속도와 혼동하면 지출 판단이 흐려진다. Pro 500의 월액을 Sol의 토큰 단가와 나란히 놓고 어느 쪽이 싸다고 계산할 수도 없다. 하나는 포함 사용량이 있는 구독료이고 다른 하나는 API 사용량에 따른 가격이다. (openai.com)

작은 팀에는 모델 성능보다 반복 작업의 양이 먼저 비용을 가른다. OpenAI는 Codex에서 작업의 길이, 추론 설정, 도구 사용량에 따라 한도 소모가 달라진다고 설명한다. Claude Code에서는 /usage로 사용 현황을 볼 수 있다. 두 도구를 비교할 때는 구독료와 초과 사용액을 따로 기록해야 한다. 그래야 한쪽의 포함 사용량을 다른 쪽의 API 요금과 잘못 견주지 않는다. (help.openai.com)

주력 모델은 완료된 변경으로 결정된다

Opus가 필요한 순간은 어려워 보이는 요청을 처음 받았을 때만이 아니다. Sonnet이나 Sol이 변경을 마쳤어도 테스트가 가리키지 못하는 위험이 남을 수 있다. 반대로 명확한 수정에 Opus를 계속 쓰면서 답을 기다리고 같은 검사를 반복한다면 높은 모델 등급이 작업 시간을 줄여주지 못한다.

같은 저장소의 같은 과제를 맡긴 뒤 기록할 값은 네 가지다. 첫 결과까지 걸린 시간, 테스트 통과 여부, 사람이 다시 요청한 횟수, 사용량이다. Claude Code의 /usage와 Codex의 /status는 각각 사용 현황을 확인하는 출발점이 된다. 비교가 끝난 뒤에야 방에서 나온 ‘Sol 주력·Opus 보완’이나 ‘Sonnet 주력·Opus 보완’이 자기 작업에도 맞는지 알 수 있다. 비싼 모델의 필요성은 이름보다 그 모델을 썼을 때 사라진 재작업에서 드러난다. (code.claude.com)

Claude CodeOpus 5.5Sonnet 5.5GPT-6.1 SolCodexAI 코딩 비용

참고 링크

자주 묻는 질문

Q

Claude Code에서 Opus 5.5와 Sonnet 5.5를 어떻게 바꾸나요?

세션에서 /model opus 또는 /model sonnet을 입력하면 된다. 사용 중인 제공자에 따라 별칭이 가리키는 실제 버전이 다를 수 있으므로 선택 화면에서 모델명을 확인하는 편이 정확하다.

Q

GPT-6.1 Sol을 쓰려면 Codex Pro 500이 필요한가요?

아니다. OpenAI는 GPT-6.1 Sol을 Plus를 포함한 여러 요금제에 제공한다고 안내한다. Pro 500의 차별점은 더 높은 포함 사용량과 출시 시점의 GPT-6 Astra Ultrafast 권한이다.

Q

Sonnet 5.5가 Opus 5.5보다 항상 저렴한가요?

기본 API 입력·출력 토큰 단가는 Sonnet 5.5가 절반이다. 하지만 작업별 토큰 사용량, 캐시, 재시도 횟수에 따라 완료 비용의 차이는 달라진다.

같은 주제 더 보기