Ai Models

Llama 3.2 — 비전과 온디바이스, 서로 다른 곳을 향한 두 갈래

메타가 Llama 3.2를 공개했다. 비전 기능을 갖춘 11B·90B와 엣지용 경량 1B·3B는 같은 릴리스에 담겼지만 향하는 곳이 다르다.

겹쳐 찍힌 판본들로 세대 교체를 나타낸 추상 도판
AI 생성

메타가 Llama 3.2 를 공개했다. 이번 릴리스에는 비전 기능을 갖춘 모델(11B, 90B)과 엣지·모바일 디바이스용 경량 텍스트 모델(1B, 3B)이 함께 들어 있다. 한 릴리스에 묶여 나왔지만 두 갈래는 서로 다른 곳을 향한다. 하나는 모델이 무엇을 볼 수 있는가 쪽으로, 다른 하나는 모델이 어디에서 돌 수 있는가 쪽으로 간다.

Llama 3.2 모델 라인업 소개 이미지

비전 모델 (11B, 90B) — 이미지를 이해한다

이미지 이해와 시각적 추론 작업을 한다. 기존 텍스트 모델 자리에 그대로 끼워 넣는 드롭인 방식이라 교체 부담이 적다. 문서 수준 이해, 이미지 캡셔닝, 시각적 위치 파악 같은 작업을 하고, Claude 3 Haiku·GPT-4o 같은 독점 모델과 비교해도 우수한 성능이 나왔다.

경량 모델 (1B, 3B) — 기기 안에서 돈다

128K 토큰 컨텍스트를 지원하며 엣지 디바이스에서 요약·지시 수행 등을 한다. 온디바이스로 돌기 때문에 개인화된 AI 애플리케이션을 만들 수 있고, 응답이 즉각적이며 프라이버시가 지켜진다. 요약·지시 수행·도구 사용에서 경쟁력 있는 성능을 낸다.

경량 모델 벤치마크 비교

Llama Stack — 배포 이야기

모델과 별개로, 여러 환경에서 Llama 를 쉽게 쓰게 해 주는 배포 도구가 함께 나왔다. 온프레미스·클라우드·엣지 어디에서든 일관된 경험을 주는 것이 목표다. AWS, Databricks 등 파트너사와 협력해 엔터프라이즈 고객을 지원하고, CLI·다국어 클라이언트·Docker 컨테이너를 제공한다.

메타는 AI 혁신을 가속화하고 더 많은 사람이 AI 를 쓸 수 있도록 오픈 접근 방식을 지키고 있다. Llama 3.2 와 함께 나온 도구·리소스로 개발자들이 안전하고 책임감 있게 AI 를 만들 수 있을 것으로 기대된다.

더 보기