Ai Models

Gemini 2.5 Pro — 생각하는 모델의 등장

구글 딥마인드가 Gemini 2.5 Pro 실험 버전을 냈다. 응답 전에 스스로 추론하는 '사고 모델'로, LMArena에서 역대 최대 점수 상승과 함께 1위에 올랐다.

겹쳐 찍힌 판본들로 세대 교체를 나타낸 추상 도판
AI 생성

구글 딥마인드가 가장 지능적인 AI 모델이라며 Gemini 2.5 를 내놨다.

Gemini 2.5 는 복잡한 문제를 풀기 위해 설계된 ‘사고 모델(thinking model)’ 이다. 사람처럼 응답하기 전에 스스로 생각하고 추론하는 과정을 거친다. 덕분에 성능과 정확성이 크게 올랐다.

먼저 공개되는 Gemini 2.5 Pro 실험 버전은 여러 벤치마크에서 압도적인 성능을 보였고, 특히 인간 선호도를 재는 LMArena 리더보드에서 1위를 차지했다.

무엇이 특별한가

향상된 추론 능력. AI 에서 ‘추론’ 이란 단순히 분류하거나 예측하는 것을 넘어, 정보를 분석하고 논리적 결론을 내리며 맥락과 미묘한 차이까지 파악하는 능력이다. Gemini 2.5 는 강화학습과 연쇄적 사고 프롬프팅 같은 기존 연구를 바탕으로 한층 발전된 추론을 보여 준다.

모델 정보

  • 입력 지원 데이터 유형 — 텍스트, 이미지, 비디오, 오디오
  • 출력 지원 데이터 유형 — 텍스트
  • 입력 최대 토큰 — 100만
  • 출력 최대 토큰 — 6만 4천
  • 학습된 지식 — 2025년 1월까지
  • Tool 지원 — 함수 호출, 구조화된 출력, 검색 도구, 코드 실행

벤치마크

수학·과학 벤치마크(GPQA, AIME 2025 등)에서 최고 수준을 기록했다. Arena 리더보드에서는 1위에 올랐는데, 역대 최대 점수 상승 이다(Grok-3/GPT-4.5 대비 +40포인트).

인간 지식과 추론 능력의 한계를 재는 ‘Humanity’s Last Exam’ 에서는 도구 없이 18.8% 를 받았다.

코딩 은 2.0 대비 비약적으로 발전했다. 시각적으로 매력적인 웹 앱 제작, 에이전트 코드 애플리케이션, 코드 변환 및 편집에서 뛰어나다. 에이전트 코드 평가 표준인 SWE-Bench Verified 에서 63.8% 를 기록했다(맞춤 에이전트 설정 사용). 간단한 프롬프트 한 줄로 비디오 게임 실행 코드를 만드는 시연도 있었다.

Gemini 의 기존 장점 도 그대로다. 네이티브 멀티모달리티(텍스트·오디오·이미지·비디오·코드를 동시에 이해)와 긴 컨텍스트 창(현재 100만 토큰, 곧 200만 토큰 지원 예정)이 유지·강화됐다.

지금 써 보기

Google AI Studio 와 Gemini 앱(Gemini Advanced 사용자)에서 실험 버전을 바로 쓸 수 있다. 곧 Vertex AI 에서도 제공될 예정이다.

API 비용은 아직 정해지지 않았다. 더 높은 사용량 한도가 필요한 대규모 프로덕션용 가격 정책도 몇 주 안에 공개될 예정이다.

활용 예제

  1. 나만의 대화형 데모 만들기
  2. 나만의 공룡 게임 만들기
  3. 프랙탈 시각화
  4. 복잡한 애니메이션 적용
  5. 코드 입자 시뮬레이션

더 보기