195 읽음
오픈AI GPT-6 솔·루나 출시, 성능 개선 및 비용 절감
씨넷코리아
0
오픈AI가 23일 GPT-6 아스트라에 이어 ‘GPT-6 솔’과 ‘GPT-6 루나’를 출시했다고 밝혔다. 두 모델은 업무 복잡도와 요구되는 속도, 비용에 따라 GPT-6 제품군을 선택할 수 있도록 설계됐다.

GPT-6 솔과 루나는 GPT-6 아스트라와 유사한 방식으로 학습했으며 전문 업무와 사실 정확성, 코딩, 컴퓨터 사용, 정렬 등에서 각각 GPT-5.6 솔과 루나보다 성능을 개선했다.

GPT-6 아스트라가 높은 수준의 성능이 필요한 복잡한 업무를 겨냥한다면 솔과 루나는 상대적으로 빠른 속도와 비용 효율에 초점을 맞췄다.

실제 업무 환경을 평가하는 ‘AutomationBench’에서 GPT-6 솔은 xhigh 추론 수준 기준 33.2%를 기록했다. GPT-6 아스트라의 low 추론 수준 점수인 30.3%보다 높은 결과다.

GPT-6 루나는 high 추론 수준에서 GPT-5.6 루나보다 5.4%포인트 높은 점수를 기록했으며 작업당 비용은 58% 낮았다고 오픈AI는 밝혔다.

사실 정확성도 개선했다. 오픈AI가 이전 모델의 사실 오류가 지적된 비식별화 챗GPT 대화를 이용해 평가한 결과 GPT-6 솔의 오류는 GPT-5.6 솔의 약 절반 수준으로 나타났다.

GPT-6 루나는 높은 추론 수준에서 GPT-5.6 솔과 비슷한 수준의 정확성을 약 100분의 1 비용으로 기록했다. 다만 해당 평가는 오류 가능성이 높은 대화를 선별해 진행한 것으로 일반적인 사용 환경의 오류율을 의미하지는 않는다.

코딩 작업에서도 개선이 이뤄졌다. 내부 평가에서 모델이 자신이 수행한 코딩 작업을 사실과 다르게 설명한 비율은 GPT-6 솔이 1.3%, GPT-6 루나는 2.8%로 나타났다. GPT-5.6 솔은 10.4%, GPT-5.6 루나는 9.5%였다.

프롬프트 캐싱 기능도 강화했다. 반복적으로 사용하는 입력 문맥을 재사용해 응답 시간과 처리 비용을 낮추며 캐시된 입력 토큰에는 90% 할인된 가격을 적용한다.

GPT-6 솔과 루나는 ChatGPT Work와 Codex에서 Plus, Pro, Business, Enterprise, Edu 이용자에게 제공된다. Free와 Go 이용자는 데스크톱 앱에서 GPT-6 루나를 사용할 수 있으며 일반 Chat에는 아직 적용되지 않았다.

API에서는 각각 gpt-6-sol, gpt-6-luna로 제공된다. GPT-6 솔은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러이며 GPT-6 루나는 입력 100만 토큰당 0.10달러, 출력 100만 토큰당 0.50달러다. 두 모델 모두 GPT-5.6 솔·루나의 프로모션 가격보다 50% 낮다.
0 / 300