OpenAI에서 코딩 작업에 최적화된 새로운 GPT 모델을 발표했다.
OpenAI는 14일(현지시간) API에 코딩, 지지사항 준수, 긴 맥락(컨텍스트)에 대한 주요 개선 사항을 특징으로 하는 3가지 새로운 모델인 GPT-4.1, GPT-4.1 mini, GPT-4.1 nano가 추가되었다고 밝혔다.
이 모델들은 코딩 및 교육 수행 측면에서 큰 향상을 보이며 전반적으로 GPT-4o 및 GPT-4o mini보다 우수한 성능을 발휘한다. 또한 최대 100만 개의 컨텍스트 토큰을 지원하는 더 큰 컨텍스트 창을 제공하며, 향상된 장문 컨텍스트 이해력으로 해당 컨텍스트를 더욱 효과적으로 활용할 수 있다.
OpenAI에 따르면 GPT-4.1은 코딩 성능에서 SWE-bench Verifiled에서 54.6%의 점수를 받아 기존 GPT-4o(21.4%), GPT-4.5(26.6%)보다 향상되었으며, 지시 이행 능력을 측정하는 Scale의 MultiChallenge 벤치마크에서도 GPT-4.1은 38.8% 점수를 기록하여 GPT-4.o(10.5%)보다 향상된 성능을 보였다. 또한 멀티모달 긴 맥락 이해(multimodal long context understanding) 벤치마크인 Video-MME에서 GPT-4.1은 자막 없는 긴 문장 부문에서 72.0% 점수를 기록하며 GPT-4.o(6.7%) 대비 큰 점수 향상을 기록했다.
OpenAI는 GPT-4.1 모델을 제품군을 더 저렴한 비용으로 탁월한 성능을 제공하도록 최적화하여 GPT-4.1 mini와 같은 소형 모델에서도 상당한 도약을 이뤘으며, 낮은 지연 시간이 요구되는 작업의 경우 GPT-4.1 nano는 가장 빠르고 저렴한 모델이라고 설명했다.
다만 GPT-4.1은 API를 통해서만 제공되며 ChatGPT에서는 이제 GPT-4o을 사용하기 시작해 향후 릴리즈에서 더 많은 기능을 통합할 예정이라고 한다.
그 밖에 GPT-4.1이 훨씬 낮은 비용과 지연 시간으로 여러 주요 기능에서 개선되거나 유사한 성능을 제공하기 때문에 API에서 GPT-4.5 Preview의 지원을 중단할 예정이며, 개발자들이 전환할 시간을 주기 위해 GPT-4.5 Preview는 3개월 후인 2025년 7월 14일에 종료할 거라고 밝혔다.
GPT-4.1, GPT-4.1 mini, GPT-4.1 nano는 현재 모든 개발자에게 제공되며, OpenAI는 추론 시스템의 효율성 개선을 통해 GPT-4.1 시리즈의 가격을 더 낮출 수 있었다고 전했다. GPT-4.1은 중간 쿼리의 경우 GPT-4o보다 26% 저렴하며, GPT-4.1 nano는 역대 가장 저렴하고 빠른 모델이다. 동일한 컨텍스트를 반복적으로 전달하는 쿼리의 경우 즉시 캐싱 할인률을 기존 50%에서 75%로 상향 조정하며, 토큰당 표준 비용 외에 추가 비용 없이 긴 컨텍스트 요청을 제공한다.
보다 자세한 내용은 OpenAI 홈페이지(https://openai.com/index/gpt-4-1)에서 확인할 수 있다. |