Claude Ultrathink: 숨겨진 5단계 사고 레벨 완전 정리 (2026)

대부분의 사람들은 Claude의 기본 사고 모드만 씁니다. 하지만 5단계가 있고, 레벨 1과 5의 차이는 놀라울 정도입니다. 실제 예시와 함께 완전 가이드.

Claude에는 대부분의 사용자가 잘 모르는 기능이 하나 있습니다. 공식 문서에 나와 있긴 하지만, Claude Code를 깊이 있게 다루지 않았다면 처음 접하시는 분들도 많을 거예요. 바로 extended thinking입니다. 그리고 그 최상위 레벨에는 뭔가 신비로운 느낌까지 드는 ultrathink라는 키워드가 있죠. 이 기능들이 실제로 어떤 역할을 하는지, 언제 써야 효과적이고, 어떤 경우에는 아예 통하지 않는지 꽤 깊이 파고들어 봤습니다. 제가 정리한 내용을 공유해 드립니다.

Extended Thinking이 실제로 뭔가요?

보통 Claude에게 질문하면 빠르게 답변을 받죠. 프롬프트를 읽고 답변을 생성하면 끝이기 때문입니다. 하지만 어떤 문제는 조금 더 깊은 고민이 필요하죠.

extended thinking은 Claude가 답변하기 전에 잠시 멈춰서 내부적으로 생각할 수 있도록 해주는 기능입니다. 즉각적인 답변을 내놓기보다 문제를 단계별로拆解하고, 다양한 해결책을 모색하며, 예외 상황까지 고려한 후 결과를 내놓죠. 마치 바로 답을 주는 동료와 달리, extended thinking이 켜진 Claude는 “잠깐만요, 생각해보겠습니다”라고 말하고 실제로 시간을 들여 차분히 풀어내는 과정이 추가되는 거예요. 시스템 설계나 복잡한 디버깅, 다단계 분석이 필요한 작업에서는 이 ‘생각하는 시간’이 결과의 질을 확실히 높여줍니다.

사고의 계층: “Think"에서 “Ultrathink"까지

여기서 핵심은 Claude Code(Anthropic의 CLI 기반 코딩 도구)에 내장된 ‘사고 레벨’ 키워드입니다. 각 키워드마다 Claude가 답변하기 전에 쓸 수 있는 ‘사고 예산(토큰)’이 다르게 할당되죠.

키워드사고 예산최적 용도
think~4,000 tokens일반적인 디버깅, 간단한 리팩토링
think hard / megathink~10,000 tokensAPI 설계, 데이터베이스 계획, 최적화
think harder / ultrathink~32,000 tokens아키텍처 재설계, 심각한 버그, 복잡한 마이그레이션

트리거 문구는 제법 유연합니다. 예를 들어 think about it, think deeply, think more를 입력하면 megathink 레벨이 활성화됩니다. 최고 수준의 사고가 필요하다면 think harder, think really hard, think very hard 또는 그냥 ultrathink를 사용하면 돼요.

Ultrathink를 사용할 때 뭐가 일어나요?

ultrathink를 활성화하면 Claude는 답변을 생성하기 전, 약 32,000개의 토큰을 활용해 문제를 추론합니다. 이는相当한 ‘생각할 공간’을 확보하는 것이죠. 구체적으로 어떤 일이 일어나는지 확인해 보면:

  • 여러 해결책을 비교하고 검증할 수 있어요
  • 복잡한 로직을 단계별로 차분히拆解할 수 있어요
  • 빠른 답변에서 놓치기 쉬운 예외 상황(엣지 케이스)을 잡아내요
  • 여러 파일을 동시에 수정할 때 일관된 계획서를 세우요
  • 난해한 버그를 체계적으로 추적하고 디버깅할 수 있어요

프로덕션 환경의 치명적인 버그나 “전체 시스템을 리팩토링해야 할까?” 같은 큰 그림의 질문에는 ultrathink가 ‘단순한 답변’과 ‘통찰력 있는 해법’의 차이를 만듭니다.

중요한 주의사항: Claude Code에서만 작동해요

처음에 저도 이 부분 때문에 많이 헷갈렸는데, 꼭 짚고 넘어가고 싶어요.

ultrathink나 extended thinking 키워드는 Claude Code(터미널/CLI 환경)에서만 제대로 작동합니다.

Claude.ai 웹 인터페이스에서 ultrathink를 입력해도 특별한 반응은 없습니다. 그냥 일반 텍스트로 인식될 뿐이죠. API를 사용할 때도 마찬가지입니다. 요청 파라미터에 명시적으로 사고 관련 설정을 하지 않으면, 키워드만으로는 아무것도 트리거되지 않습니다.

왜냐하면 많은 커뮤니티 팁에서 “프롬프트 끝에 ultrathink만 붙이면 된다”라고 안내하는데, 이는 Claude Code를 전제로 한 조언이기 때문입니다. 웹 챗이나 별도 설정 없이 API를 호출하는 환경에서는 이 키워드가 아무런 도움이 되지 않으니, 다른 프롬프팅 기법에 집중하셔야 해요.

각 레벨을 언제 사용할까요?

모든 작업에 ultrathink가 필요한 건 아닙니다. 오히려 무조건 높은 레벨을 쓰면 시간만 더 걸리고, 토큰 기반 과금 환경이라면 비용도 불필요하게 증가할 수 있어요. 작업의 난이도에 맞게 적절히 선택하는 게 중요한데, 제 경험을 바탕으로 정리한 가이드라인은 다음과 같아요.

“think”(4K tokens)를 사용할 때:

  • 간단한 버그 수정
  • 기본 함수 작성
  • 일반적인 코드 리팩토링
  • 명확한 답이 있는 빠른 질문

“megathink”(10K tokens)를 사용할 때:

  • API 설계 및 구조 정의
  • 데이터베이스 스키마 계획
  • 성능 최적화 작업
  • 코드 아키텍처 검토
  • 다단계 문제 해결

“ultrathink”(32K tokens)를 사용할 때:

  • 전체 시스템 아키텍처 재설계
  • 치명적인 프로덕션 버그 디버깅
  • 다중 시스템에 영향을 주는 복잡한 마이그레이션
  • 실패 시 큰 영향을 미치는 핵심 로직 수정
  • 일반적인 해결책으로 부족하고 깊은 분석이 필요한 경우

핵심은 ‘작업의 복잡도에 맞는 사고 레벨 선택’입니다. 간단한 작업에 과도한 사고를 시키면 답변이 더 정밀해지지 않고, 오히려 응답 시간만 길어질 뿐이죠.

비용의 현실

extended thinking은 무제한이나 무료가 아닙니다.

현재 Claude 요금제를 기준으로 생각해 보면:

  • 기본 사고 (~4K tokens): 작업당 약 $0.06
  • 향상된 사고 (~10K tokens): 작업당 약 $0.15
  • 최대 ultrathink (~32K tokens): 작업당 약 $0.48

개인 프로젝트 수준에서는 이 추가 비용이 크게 부담되진 않죠. 하지만 팀 단위에서 Claude Code를 자주 사용하거나 대량의 작업을 처리한다면, ultrathink를 무분별하게 적용하면 비용이 빠르게 누적될 수 있어요. 따라서 정말로 깊은 고민이 필요한 작업에만 ultrathink를 선택하고, 기본값으로 쓰지 않는 게 현명합니다.

실제로 어떻게 사용할까요?

Claude Code를 사용 중이고 extended thinking을 적용해 보고 싶다면, 다음과 같이 키워드를 배치하면 됩니다.

중간 정도 복잡도의 경우:

Think hard about how to refactor this authentication module.
Consider security implications and backward compatibility.

최대 사고를 원할 때:

Ultrathink about this architecture. We're migrating from a
monolith to microservices. I need you to identify service
boundaries, data flow, and potential failure points.

키워드는 프롬프트의 앞, 뒤, 중간 어디에 위치해도 상관없습니다. Claude Code가 프롬프트를 처리하는 단계에서 이 키워드를 자동으로 감지하고, 지정된 사고 예산을 할당해 주기 때문이죠.

Claude 4와 Interleaved Thinking은 어떤가요?

최신 Claude 4 모델은 ‘interleaved thinking(교차 사고)’ 기능을 도입했습니다. 이제 Claude는 시작 부분에서만 생각하는 것이 아니라, 도구 호출 사이사이에 중간에 멈춰서 생각할 수 있게 되었죠. 파일 읽기, 명령어 실행, 코드 적용 등 다단계 에이전트 작업에서 특히 빛을 발합니다. 모든 과정을 미리 완벽하게 계획하고 결과만 기다리는 대신, Claude는 중간 결과를 확인하며 전략을 유연하게 수정할 수 있어요. 여러 파일을 동시에 다루는 복잡한 코딩 작업에서는 이런 교차 사고가 extended thinking의 효과를 훨씬 더 높여줍니다.

결론

extended thinking은 분명 강력한 기능이지만, ‘올바른 맥락’에서만 빛을 발합니다. Claude Code로 복잡한 개발 작업을 진행한다면, 작업의 난이도에 맞춰 적절한 사고 레벨을 호출하는 방법을 익히는 것만으로도 결과물의 질을 크게 높일 수 있어요. 반복적인 작업은 think로 시작하고, 설계나 구조 검토에는 megathink를 활용하며, ultrathink는 정말 깊이 있는 분석이 필요한 핵심 문제에만 남겨두세요.

웹 인터페이스나 별도 설정 없는 API를 사용 중이라면 이 키워드는 작동하지 않으니, 명확한 프롬프트 작성과 충분한 컨텍스트 제공, 구조화된 요청에 집중하세요.

어떤 환경이든 명심하세요. ‘더 많은 사고’가 ‘더 나은 결과’를 보장하는 건 아닙니다. 작업의 성격에 맞는 도구를 선택하는 게 가장 중요합니다.

Build Real AI Skills

Step-by-step courses with quizzes and certificates for your resume