quickmenu
PC 뉴스 홈  

IBM, 왓슨x에서 새로운 라마 3.1 및 미스트랄 라지2 등 오픈소스 최신 모델 지원 발표

2024-08-01 10:57
편집부 press@bodnara.co.kr

IBM은 최근 메타에서 발표한 라마3.1과 미스트랄 AI에서 발표한 미스트랄 라지(Mistral Large) 2 등 최신 오픈소스 거대언어모델(LLM)을 왓슨x.ai에서 제공한다고 발표했다. 이로써 왓슨x 사용 기업들은 IBM 그래니트(Granite), 라마 3.1, 미스트랄 라지 2 등 최고 성능의 오픈소스 AI 모델을 자사의 용도와 필요에 따라 자유롭게 선택하고 맞춤화해 사용할 수 있다.

 

이번에 발표된 라마 3.1은 각각 80억 개(8B), 700억 개(70B), 4050억 개(405B)의 매개변수를 가진 사전 학습된 오픈소스 생성형 AI 모델들로 구성됐다. 특히 현재 사용 가능한 가장 크고 강력한 오픈소스 언어 모델로 평가받고 있는 라마 3.1-405B 모델은 한번에 처리할 수 있는 문맥의 길이가 토큰 8,192개에서 128,000개로 16배 늘어났으며 , 이는 약 85,000 영어 단어에 해당한다. 오픈AI의 GPT-4o와 같은 시장에서 가장 우수한 독점적 모델들과 독해력, 코드생성, 학부 수준의 지식 분야의 경쟁에서도 뒤지지 않는 성능을 보여주는 것으로 알려져 있다. 강력한 성능을 제공하는 405B 모델은 추론 및 텍스트 생성과 같은 일반적인 AI 활용 사례 외에도 AI의 사전 학습이나 미세 조정을 위한 합성 데이터 생성 및 더 작은 모델로 만드는 지식 증류와 같은 작업에도 사용할 수 있다.

1,230억 개의 매개변수를 가진 미스트랄 라지 2는 코딩과 수학 부문에서 뛰어난 성능을 발휘, 80가지가 넘는 코딩 언어를 지원하며, 오픈AI의 GPT-4o, 앤트로픽(Anthropic)의 클로드 3 오푸스, 메타 라마 3.1 405B와 같은 최첨단 모델과 동등한 수준의 성능을 제공한다. 그리고, 향상된 추론 능력을 통해 환각이나 그럴듯하게 들리는 거짓 답변들을 최소화했다.

기업에서 AI 모델을 선택할 때는 고려해야 하는 다양한 요소가 존재하기 때문에 성능이 좋은 범용 모델을 선택하는 것이 정답이 아닐 수 있다. 예를 들어, 일반적으로 매개변수의 크기가 더 크고 유능한 모델은 사용하는 데 더 많은 비용이 들고, 모델 정확도가 증가하면 속도가 느려질 수 있다. 이에 비해 크기는 작지만 특정 환경에 미세 조정된 모델의 경우, 그 환경 내에서는 크기가 큰 모델 대비 속도가 더 빠르고 비용이 획기적으로 적게 들면서도 뛰어난 성능을 낼 수 있다. 따라서, 기업의 용도에 맞는 이상적인 모델을 선택하는 것이 필요하다.

라마 3.1이나 미스트랄 라지 2, IBM 그래니트와 같은 광범위한 최신 오픈 소스 AI 모델을 제공하는 IBM 왓슨x는 고객이 용도와 목적, 가격과 성능의 최적의 균형을 가진 가장 적합한 AI 모델을 선택해 각 기업에 가장 잘 맞는 방식으로 구현해 보다 쉽게 사용할 수 있도록 지원한다.

IBM 왓슨x는 사내 서버, 퍼블릭, 프라이빗, 하이브리드 클라우드 등 기업이 선호하는 인프라 환경에서 모델을 활용할 수 있는 유연성을 제공하는 한편, AI를 활용한 비즈니스 애플리케이션을 쉽게 개발하고, 모든 데이터 소스를 관리하고, 용도에 맞는 미세 조정, 기업에서 사용하는 애플리케이션과의 통합을 위한 직관적인 업무 프로세스를 구축하는 것이 하나의 플랫폼에서 가능하도록 지원한다.

한편, 미스트랄 라지 2 모델은 기업에서 상업적으로 사용하려면 미스트랄 AI에 미스트랄 커머셜 라이선스을 요청해야 하지만, IBM 왓슨x에서는 상업적 목적으로도 자유롭게 사용할 수 있다.

닉네임 lock
비회원

보드나라 많이 본 뉴스
보드나라 많이 본 기사

보드나라 최신 기사
[08/01] 엔비디아, 마이크로소프트와 RTX 스파크 AI 에이전트로 윈도우 PC의 새 시대 개막  
[08/01] 맥스엘리트, 'P-SPOT Festa 2026' 참가, 파워서플라이 및 1stPlayer 게이밍 기어 대거 선보여  
[08/01] 플렉스데이터, 차세대 고성능 IT 인프라를 위한 'PROMISE AI Solution 세미나' 진행  
[08/01] 서버용 제온과 데스크탑 CPU의 혼용시대, LGA771/775 은박신공 [PC흥망사 18-5]  
[08/01] 마이크로닉스, 한글날 기념 WIZMAX 릿지 PRO '3만원대' 특가  
[08/01] 이엠텍, ‘AMD PARTNER ADVANCE 2026’서 SAPPHIRE ‘PhantomLink’ 국내 최초 공개  
[08/01] 커세어, ‘커쎄일’ 가을 프로모션 진행.. 인기 제품 최대 46% 할인  
[08/01] ‘승리의 여신: 니케’, 신규 스토리 이벤트 ‘LITTLE WITCH TRICK’ 업데이트  
[08/01] 넷마블 <일곱 개의 대죄: Origin>, ‘랜슬롯’ 등장..신규 스토리 ‘물의 심장’ 공개  
[08/01] 램리서치, 한국 반도체 생태계와 협력 확대..제조, 공급망 이정표 달성 및 산업 혁신 가속  
[08/01] HPE, 기업 AI 혁신 가속화할 차세대 AMD 기반 서버 발표  
[08/01] BYD코리아, 한국 진출 10주년 기념 고객 참여 이벤트 ‘씨라이언 6 DM-i 전국 연비 챌린지’ 진행  
[08/01] 셰에라자드, 파이널 헤드폰 DX10000 CL Collector's Edition 국내 정식 출시  
[08/01] AI로 케이스 냉각 효율 계산, 쿨링팬 배치 차이에 CPU 공급 공기 온도 13℃ 하락  
[08/01] 삼성 갤럭시 스마트태그3, 아이폰은 되지만 안드로이드폰은 갤럭시만 지원  
[08/01] 델 테크놀로지스, 엔비디아 RTX 스파크 탑재한 첫 XPS 신제품 ‘델 XPS 16 크리에이터 에디션’ 공개  
[08/01] 오픈AI, GPT-6를 챗GPT 전반으로 확대…‘인텔리전트 UI’로 질문에 맞는 UI 실시간 생성  
[08/01] 마블 라이벌즈 어벤져스 연계 이벤트 공개. 시즌 10 후반전 10월 9일 시작  
[08/01] 구글, AI 컨텐츠 검증기 신스ID 글로벌 오픈  
[08/01] '160mm 듀얼팬으로 강력한 냉각' 마이크로닉스, WIZMAX 릿지 MAX 출시  
로그인 | 이 페이지의 PC버전
Copyright NexGen Research Corp. 2010