구글(Google)이 Gemini 2.0을 기반으로 하는 새로운 Gemma 3를 발표했다.
구글은 12일(현지시간) 공식 블로그를 통해 Gemini 2.0 모델에 사용된 것과 동일한 연구 및 기술로 구축된 가볍고 최첨단의 오픈 모델 컬렉션인 Gemma 3을 선보인다고 밝혔다.
Gemma 3는 스마트폰과 노트북에서 워크스테이션에 이르기까지 디바이스에서 직접 빠르게 실행되도록 설계되어 개발자가 어디에서나 AI 애플리케이션을 만들 수 있으며, 다양한 크기(1B, 4B, 12B, 27B)로 제공되므로 특정 하드웨어 및 성능 요구사항에 가장 적합한 모델을 선택할 수 있다.
구글은 Gemma 3에 대해 LMArena 리더 보드의 예비 인간 선호도 평가에서 Llama-405B, DeepSeek-V3 및 o3-mini를 능가하며 이를 통해 단일 GPU 또는 TPU 호스트에 적합한 사용자 경험을 만들 수 있고, 35개 이상의 언어에 대한 기본 지원 및 140개 이상의 언어에 대한 사전 학습된 지원을 제공한다고 설명했다.
또한 이미지, 텍스트 및 짧은 비디오를 분석하는 애플리케이션을 쉽게 구축할 수 있는 고급 텍스트 및 시각적 추론 기능을 갖춘 AI 생성, 128k 토큰 컨텍스트 윈도우 제공, 함수 호출과 구조화된 출력 지원으로 AI 기반 워크플로 구축, 공식 양자화 버전 도입으로 높은 정확도를 유지하는 동시에 모델 크기와 계산 요구사항을 줄였다는 것을 특징으로 내세웠다.
구글은 개방형 모델이 신중한 위험 평가가 필요하다고 믿고 엄격한 안전 프로토콜로 낮은 위험 수준을 가지고 있으며, Gemma 3와 함께 이를 기반으로 구축된 강력한 4B 이미지 안전 검사기인 ShieldGemma 2도 출시할 거라고 밝혔다. Gemma 3 및 ShieldGemma 2는 기존 워크플로에 완벽하게 통합된다.
Gemma 3는 Google AI Studio로 브라우저에서 직접 사용하거나 API 키를 받고 Goole GenAI SDK와 함께 사용할 수 있으며, 사용자 정의를 위한 Gemma 3 모델 다운로드는 Hugging Face, Ollama 또는 Kaggle에서 제공된다. |