Ai Models

Claude 3.7 Sonnet과 Claude Code — 하이브리드 추론이 먼저 왔다

OpenAI가 GPT-5에서 기반 모델과 추론 모델을 합치겠다고 밝힌 지 3주, 그 하이브리드 모델을 Anthropic이 먼저 냈다. 함께 나온 것이 Claude Code다.

겹쳐 찍힌 판본들로 세대 교체를 나타낸 추상 도판
AI 생성

지난 2월 3일 OpenAI 는 GPT-5 의 청사진을 제시하면서, 앞으로 나올 GPT-5 가 기존 GPT-4 같은 기반 모델과 o1·o3 같은 추론 모델을 합치게 될 것이라고 밝혔다.

그런데 그 하이브리드 리즈닝 모델을 Anthropic 이 먼저 냈다. Claude 3.7 Sonnet 이다. 그리고 함께 에이전틱 코딩 도구인 Claude Code 가 공개됐다.

Claude 3.7 Sonnet — 즉답과 확장된 사고를 한 모델에

Claude 3.7 Sonnet 은 거의 즉시 답변을 주는 기능과, 더 깊이 단계별로 사고하는 확장 모드를 모두 지원한다. 사람이 빠른 반응과 심도 있는 고민을 함께 하는 것과 비슷한 방식이다.

사용자 제어가 세밀하다. API 로 쓸 경우 “생각하는 시간(토큰 수)” 을 미세하게 조절할 수 있다. 덕분에 속도와 비용을 절충하면서 필요한 만큼의 사고 과정을 모델에 배정할 수 있다.

실제 업무에 최적화된 성능. 특히 코딩과 프론트엔드 웹 개발에서 뛰어난 성능을 보이고, 여러 실제 작업 테스트에서도 좋은 결과를 낸다.

무료 사용자도 제한된 횟수 안에서 쓸 수 있다. 다만 확장된 사고 모드는 무료 사용자에게 제한된다.

API 는 Anthropic API, Amazon Bedrock, Google Cloud 의 Vertex AI 에서 쓸 수 있고 가격은 기존과 같다(입력 $3 / 1M 토큰, 출력 $15 / 1M 토큰).

벤치마크로는 코딩 영역의 SWE 에서 기존 모델 대비 뛰어난 성능을 보이고, 도구 상호작용을 테스트하는 TAU 벤치마크에서도 진전된 결과가 나왔다.

Claude Code — 터미널로 들어온 에이전트

Claude Code 는 Anthropic 이 처음 선보이는 명령줄 기반 에이전틱 코딩 도구다. 코드를 검색하고 읽고, 파일을 편집하고, 테스트를 돌리고, GitHub 에 커밋·푸시까지 한다. 개발자의 반복 작업을 크게 줄여 준다.

초기 테스트에서 Claude Code 는 복잡한 테스트와 디버깅, 대규모 리팩토링을 단 한 번의 실행으로 처리해 수십 분의 작업을 줄인다는 평가를 받았다.

주요 기능은 이렇다.

  • 코드베이스 전체에서 파일 편집 및 버그 수정
  • 코드의 아키텍처와 논리에 대한 질문에 답하기
  • 테스트, 린팅 및 기타 명령 실행 및 수정
  • git 기록 검색, 병합 충돌 해결, 커밋 및 PR 생성

Anthropic 의 설명은 이렇다.

저희는 제한된 연구 미리보기에서 에이전트 코딩 도구인 Claude Code 를 출시합니다. Claude Code 를 사용하면 개발자가 터미널에서 Claude 에게 상당한 엔지니어링 작업을 직접 위임할 수 있습니다. Claude Code 는 이미 저희 팀에 없어서는 안 될 존재가 되었습니다. 초기 테스트에서 Claude 는 일반적으로 45분 이상의 수동 작업이 필요한 작업을 한 번에 완료했습니다.

데모에서는 익숙하지 않은 Next.js 프로젝트를 설명하고, 새 기능을 추가하고, 테스트를 만들고, 빌드 오류를 고치고, 변경 사항을 설명하는 과정을 보여 준다.

더 보기