Skip to content
AI-Daily-Builder

2026-05-07 views

Anthropic, SpaceX Colossus 계약 체결 — 22만 GPU, Claude Code 레이트 리밋 해제

Anthropic이 이번 달 가동되는 22만 대 이상의 NVIDIA GPU를 갖춘 멤피스 SpaceX Colossus 1을 활용, Claude Code Pro/Max의 피크 시간대 스로틀링을 즉시 해제.

5월 6일 샌프란시스코 Code with Claude 컨퍼런스에서 발표된 대로, Anthropic은 SpaceX와 계약을 체결해 테네시주 멤피스 데이터센터 Colossus 1의 전체 용량에 접근한다. 해당 데이터센터는 22만 대 이상의 NVIDIA H100/H200/GB200 GPU를 300메가와트 이상의 전력으로 운영 중이다. Anthropic은 이번 달 안에 용량이 가동된다고 밝혔다.

즉각적 효과: 레이트 리밋 해제

직접적 하류 결과로 같은 날 Anthropic은 Pro와 Max 사용자 대상 Claude Code의 피크 시간대 스로틀링을 해제했다. Opus API 레이트 리밋도 대폭 상향됐다. 이는 Claude Code 헤비 유저로부터 가장 일관되게 제기된 불만 — 미국 영업시간 중 에이전트 세션이 작업 중간에 끊기는 문제 — 에 대응한다.

Colossus 1이란

Colossus 1은 xAI가 Grok을 훈련·서빙하는 데 사용하는 바로 그 클러스터. 2024년 약 122일 만에 구축된, 지구상 최대 규모의 단일 사이트 GPU 집결지 중 하나. 이를 활용한다는 것은 Anthropic이 이 시점에 자체 전용으로 발주할 수 있었던 그 어떤 클러스터보다도 빠르게 추론 용량을 확장한다는 의미다.

SpaceX 관계는 프론티어 AI 랩이 컴퓨트를 조달하는 방식의 변화를 반영한다: 2~3년 하이퍼스케일러 계약에 묶이는 대신 가장 빨리 배치할 수 있는 곳에서 용량을 확보. SpaceX의 운영 속도 — Colossus 1은 데이터센터 기준으로도 이례적으로 빠른 속도로 가동됐다 — 는 지금 당장 헤드룸이 필요한 랩에 현실적인 옵션이 된다.

변하지 않는 것

이 계약은 추론 용량을 위한 것이지 훈련을 위한 것이 아니다. Anthropic의 주요 훈련 인프라는 AWS와 Google Cloud에 그대로 남아 있다. Colossus 1은 서빙 레이어에 추가돼, 특히 레이트 리밋 불만이 가장 컸던 컨슈머와 API 표면을 겨냥한다.

실무자 노트

에이전트 Claude Code 세션이나 피크 시간대 무거운 Opus API 호출에서 레이트 벽에 부딪혔다면, 완화 효과는 몇 주 안에 측정 가능할 것. 실용적 테스트: 이전에는 오프 피크 시간으로 스케줄링해야 했던 병렬 멀티 에이전트 작업을 실행해 스로틀링이 여전히 발동하는지 확인. 팀이 Max나 Team/Enterprise 플랜이라면 레이트 리밋 상향이 더 관련 있는 수치 — API 예산을 재산정하기 전에 Anthropic 콘솔에서 업데이트된 리밋을 검토할 것.


출처

태그

커피