Claude Code용 맥 스튜디오, M5 Max와 Ultra 선택법
질문·트러블슈팅

Claude Code용 맥 스튜디오, M5 Max와 Ultra 선택법

다중 에이전트와 로컬 LLM을 분리해 보면 128GB 메모리와 1.2TB/s 대역폭의 진짜 우선순위가 달라진다

2026-08-28논의 1회 정리

애플이 M5 Max와 M5 Ultra를 넣은 Mac Studio를 공개하면서 오래된 질문이 다시 커졌다. Claude Code 세션을 여러 개 돌릴 사람에게 128GB 메모리가 필요한가, 아니면 Ultra의 두 배 가까운 대역폭이 더 중요한가. 답은 Claude Code와 로컬 LLM을 같은 작업으로 보지 않는 데서 시작한다.

M5 Max 128GB와 M5 Ultra 96GB는 속도와 용량의 교환이다

두 구성은 실제 판매 옵션이다. 애플은 8월 25일 신형 Mac Studio를 발표했다. 9월 22일부터 배송한다. 지금은 사전 주문 단계라 두 모델을 직접 겨룬 독립 벤치마크는 아직 없다. 애플의 최대 성능 수치는 이전 세대와 특정 작업을 비교한 자사 결과다.

M5 Max 128GB 구성은 18코어 CPU와 40코어 GPU, 614GB/s 메모리 대역폭을 갖춘다. M5 Ultra 기본형은 메모리가 96GB로 작지만 30코어 CPU와 64코어 GPU, 1.2TB/s 대역폭을 제공한다. Max는 32GB를 더 담는다. Ultra는 약 1.95배 빠른 메모리 통로와 더 많은 연산 코어를 얻는다.

독립 실측 전에는 Ultra가 모든 작업에서 두 배 빠르다고 말할 수 없다.

미국 시작가는 각각 2,499달러와 5,499달러다. 다만 128GB Max는 기본형이 아니어서 시작가만 비교하면 실제 구매 차액을 알 수 없다. 한국에서는 Max 429만원, Ultra 949만원부터 시작한다. 법인 구매라면 애플 구성기에서 같은 SSD와 보증 조건으로 견적을 맞춰야 한다.

Claude Code의 답변 속도는 Mac GPU로 빨라지지 않는다

Anthropic의 현재 요구 사양은 RAM 4GB 이상과 인터넷 연결이다. Claude Code는 로컬에서 파일을 읽고 명령을 실행하지만 언어 모델 응답은 Claude 서비스가 생성한다. GPU 코어를 늘려도 모델이 생각하고 문장을 내놓는 속도나 계정 사용 한도가 늘지는 않는다.

로컬 하드웨어가 맡는 일은 따로 있다. 저장소 검색, 패키지 설치, 빌드, 테스트, Docker, 브라우저 자동화가 그 대상이다. 큰 모노레포를 여러 갈래로 컴파일하거나 테스트 서버를 동시에 띄우면 CPU와 RAM, SSD가 체감 차이를 만든다. 텍스트 수정과 가벼운 웹 작업이 대부분이면 Mac Studio의 GPU 상당 부분은 쉬게 된다.

이번 커뮤니티 논의에서는 비개발자가 여러 세션을 오래 쓸 때 상위 데스크톱이 마음을 편하게 한다는 의견이 많았다. 구매 뒤 아쉬움을 줄이는 기준으로는 이해할 수 있다. 그러나 Claude Code만 놓고 보면 고사양 GPU는 응답 품질을 사는 비용이 아니다.

로컬 LLM을 함께 돌리는 순간 선택 기준이 뒤집힌다

MLX LM은 Apple Silicon에서 모델 생성과 미세조정을 지원한다. MLX는 CPU와 GPU가 같은 물리 메모리에 접근하도록 설계됐다. 설치는 `pip install mlx-lm`, 첫 확인은 `mlx_lm.chat`로 시작한다. `--model`에 Hugging Face의 MLX 호환 모델을 넣으면 모델 파일을 받아 로컬에서 대화할 수 있다.

여기서는 메모리 용량이 입장권이다. MLX Community의 Llama 3.3 70B 4비트 파일은 39.7GB, Qwen3.5 122B-A10B 4비트는 69.6GB다. 파일 크기는 가중치 규모일 뿐 실제 실행 메모리와 같지 않다.

양자화한 가중치와 KV 캐시, macOS가 쓸 공간까지 96GB 안에 들어오지 않으면 Ultra의 빠른 대역폭도 쓸 수 없다. MLX LM 문서도 RAM에 비해 큰 모델은 느려질 수 있고 긴 문맥의 캐시는 더 많은 메모리를 쓴다고 설명한다.

반대로 원하는 모델과 문맥이 96GB에 넉넉히 들어가면 Ultra의 1.2TB/s 대역폭과 64코어 GPU가 유리할 가능성이 크다. 써본 사람들 사이에서는 큰 모델을 위해 128GB를 고르겠다는 반응과, 이미 들어가는 모델을 더 빠르게 돌리려고 Ultra를 택하겠다는 반응이 갈렸다. 출하 전 제품인 만큼 이 판단은 사양에 근거한 예상이며 실측 결론은 아니다.

다중 세션은 GPU보다 작업 디렉터리와 사용 한도가 먼저 막힌다

Anthropic은 병렬 세션마다 별도 Git worktree를 쓰는 방식을 안내한다. 예를 들어 기능 개발, 테스트 수정, 문서 작업을 각 브랜치와 디렉터리에 나누면 같은 파일을 덮어쓰는 충돌을 줄일 수 있다. 각 세션이 빌드와 테스트를 함께 돌릴 때만 로컬 CPU와 메모리 요구가 빠르게 커진다.

세션 수가 늘면 구독 한도도 함께 소모한다. Anthropic 도움말에 따르면 웹, Claude Code, IDE의 활동은 같은 계정 사용량에 합산된다. Mac Studio를 사도 이 병목은 바뀌지 않는다. 새 하드웨어보다 worktree 분리와 테스트 자원 배분이 먼저인 이유다.

VPS와 Claude Code 웹은 고정 자산 없이 병렬 작업을 늘린다

VPS에서는 Ubuntu 20.04 이상과 4GB 이상 RAM을 준비한다. 저장소를 복제한 뒤 Claude Code를 설치하면 된다. VS Code Remote-SSH로 원격 폴더를 열면 명령과 확장 기능도 서버에서 실행된다. 세션별 worktree와 `tmux`를 나누면 노트북을 닫아도 빌드와 에이전트 작업을 이어갈 수 있다.

직접 서버를 관리하기 싫다면 `claude --cloud`로 Anthropic 관리 VM에 독립 작업을 보낼 수 있다. 공식 문서는 여러 cloud 세션을 동시에 만들 수 있다고 안내한다. 다만 비밀키와 저장소 권한, 월 사용료, 네트워크 장애를 관리해야 한다. Apple Silicon 전용 빌드와 MLX 로컬 추론도 일반 VPS가 대신하지 못한다.

그래서 M5 Max 128GB와 M5 Ultra 96GB의 승자는 하나가 아니다. 96GB를 넘는 로컬 모델이 목표면 Max의 용량이 우선이다. 모델이 96GB 안에 들면서 처리 속도와 빌드 병렬성이 중요하면 Ultra가 맞다. Claude Code만 여러 개 띄우려면 Mac Studio는 AI 구독을 빠르게 만들지 않는다. 그 에이전트가 실행할 로컬 작업을 빠르게 만드는 장비다.

Claude CodeMac StudioM5 MaxM5 Ultra로컬 LLMMLXVPS

참고 링크

자주 묻는 질문

Q

Claude Code를 쓰려면 Mac Studio가 필요한가?

아니다. Anthropic 공식 요구 사양은 RAM 4GB 이상과 인터넷 연결이다. Mac Studio는 대규모 빌드·테스트나 로컬 LLM을 함께 실행할 때 의미가 커진다.

Q

로컬 LLM에는 M5 Max 128GB와 M5 Ultra 96GB 중 무엇이 좋은가?

모델 가중치와 문맥 캐시가 96GB를 넘으면 M5 Max 128GB가 필요하다. 96GB 안에 충분히 들어가면 M5 Ultra의 1.2TB/s 대역폭과 더 많은 GPU 코어가 속도에 유리할 가능성이 있다.

Q

Claude Code 여러 세션을 VPS에서 돌릴 수 있나?

가능하다. 지원되는 Linux VPS에 Claude Code를 설치하고 VS Code Remote-SSH, Git worktree, tmux를 조합할 수 있다. Claude Code 웹의 독립 cloud 세션도 대안이다.

같은 주제 더 보기