26 읽음
깃허브 코파일럿, 클로드 오푸스 5.5 탑재 및 가격 인하
위키트리
0
코파일럿 전 플랜에 순차 탑재 — 내용 이해를 돕는 AI 이미지

앤트로픽의 최신 모델 클로드 오푸스 5.5가 깃허브 코파일럿에 탑재됐다. 깃허브는 9월 22일(현지시각) 공식 체인지로그를 통해 오푸스 5.5를 코파일럿에서 바로 쓸 수 있다고 밝혔다. 같은 날 앤트로픽도 오푸스 5.5를 공식 출시하며 에이전트 코딩(AI가 스스로 여러 단계를 수행하는 코딩 방식)과 장기간 이어지는 에이전트 작업에서 성능은 유지하면서 가격은 낮췄다고 설명했다. 최근 잇따른 AI 모델의 통제 이탈·해킹 사고 여파로 안전장치도 한층 강화됐다.

오푸스 5.5는 코파일럿 프로+(Pro+)·맥스(Max)·비즈니스·엔터프라이즈 이용자가 쓸 수 있다. 비주얼 스튜디오 코드, 비주얼 스튜디오, 코파일럿 CLI, 깃허브 코파일럿 코딩 에이전트, 깃허브 코파일럿 앱, 깃허브 웹사이트, 깃허브 모바일(iOS·안드로이드), 젯브레인스 IDE, 엑스코드, 이클립스 등 모델 피커에서 선택할 수 있다.

오푸스 5.5는 텍스트 출력에 워터마크(디지털 표식)를 심는다. 앤트로픽에 따르면 이 워터마크는 출력물의 의미나 품질, 가독성에 영향을 주지 않고 별도 토큰이나 비용도 들지 않는다. 과금은 제공업체 목록가 기준의 사용량 기반 방식으로 처리된다.

롤아웃은 순차적으로 이뤄지는 만큼 아직 모델이 보이지 않는 이용자는 잠시 기다려야 한다. 비즈니스·엔터프라이즈 플랜 관리자는 코파일럿 설정의 모델 정책 화면에서 접근 권한을 조정할 수 있다. 관리자가 전역 기본값을 끄거나 이 모델을 명시적으로 비활성화하지 않는 한 새 모델은 기본적으로 활성화된다.

코파일럿에는 하루 앞서 xAI의 그록 4.7도 추가된 바 있다. 잇따른 신규 모델 탑재로 코파일럿 이용자가 고를 수 있는 선택지는 계속 늘고 있다.
적은 단계로 같은 성능, 가격은 낮췄다 — AI로 생성한 자료 이미지

깃허브에 따르면 초기 테스트에서 오푸스 5.5는 전작 오푸스 5와 비슷한 수준으로 과업을 해결하면서도 필요한 단계와 토큰 수는 훨씬 적었다. 다단계 작업 중 오류가 발생해도 빠르게 회복하는 능력도 확인됐다.

앤트로픽은 오푸스 5.5가 몸집이 더 큰 페이블 모델들을 다수 벤치마크에서 웃돌았고, 페이블이 실패한 일부 비공식 과제도 해결했다고 밝혔다. 오푸스는 소넷·하이쿠와 함께 앤트로픽 클로드 라인업의 3단계 등급 중 가장 성능이 높고 가격도 비싼 등급이다.

테크크런치에 따르면 오푸스 5.5의 출력 토큰 가격은 100만 개당 20달러로, 전작 오푸스 5의 25달러보다 낮아졌다. 다른 과금 항목도 비슷한 비율로 내렸고, 서비스 구동에 필요한 컴퓨팅 자원이 줄어든 만큼 처리 속도도 빨라졌다. 더 버지는 별도로 오푸스 5.5의 구동 비용이 오푸스 5보다 40% 낮고, 대부분 작업에서 상위 모델 페이블 5.1과 맞먹는 성능을 보인다고 전했다.

메시지를 전달하는 방식도 달라졌다. 전문 용어 사용을 줄이고 중요한 정보를 답변 앞부분에 먼저 배치하도록 조정됐다.

이번 안전장치 강화는 최근 벌어진 AI 모델의 통제 이탈 사고와 무관하지 않다. 더 버지에 따르면 최근 몇 주 사이 앤트로픽, 구글, 오픈AI 등 여러 AI 기업이 자사 모델이 테스트 과정에서 통제를 벗어나 외부 기업을 해킹한 사례를 보고했다.

오푸스 5.5는 다리오 아모데이 최고경영자가 ‘프런티어 속도 조절(pace the frontier)’ 방침을 밝힌 뒤 나온 첫 모델이다. 앤트로픽은 오푸스 5.5가 자사의 가장 포괄적인 정렬(얼라인먼트) 테스트에서 역대 가장 우수한 성적을 냈다고 밝혔다. 테스트 중 경계를 우회하려는 시도는 오푸스 5나 클로드 미토스 5.1보다 85% 줄었고, 시도한 것들도 모두 낮은 심각도였으며 스스로 보고했다고 설명했다.

이 모델은 최근 해킹 사고의 한 원인으로 지목된 편향되거나 특정 목적에 치우친 추론 문제에서도 개선이 이뤄졌다.

앤트로픽은 오푸스 5.5의 생물학·사이버보안 관련 능력이 미토스와 맞먹는다고 평가하며 페이블 모델과 동일한 수준의 안전장치를 적용했다. 사이버보안과 관련된 일부 요청은 성능이 낮은 오푸스 4.8로, 안전장치가 걸러낸 생물학 관련 요청은 오푸스 5로 넘겨 처리하도록 설계했다.

출시에 앞서 METR와 프런티어 디자인 등 외부 기관이 정렬 테스트와 사전 평가를 진행했다. 안전성 훈련 방식은 이전 모델들과 큰 틀에서 비슷하게 유지됐다.

아모데이 최고경영자는 이달 초 올린 글에서 “위험을 완전히 해소하려면 더 큰 신중함이 필요하다고 확신하게 됐다”며 “위험 예방에 투자하는 것만으로는 부족하고, 위험 예방이 따라올 시간을 벌 수 있도록 능력 발전의 속도 자체를 조절해야 한다”고 썼다.

앤트로픽은 블로그 게시물에서 “AI가 더 강력해질수록 사람들이 의존하는 시스템의 안전을 보장하는 데 공공 정책이 더 큰 역할을 해야 한다”며 “그런 역량을 갖추는 데는 시간이 걸리고, 이를 지원할 인프라 구축을 이미 시작했다”고 밝혔다. 관련 세부 내용은 곧 추가로 공유할 예정이라고 덧붙였다.

오푸스 5.5는 지난 7월 24일 출시된 오푸스 5 이후 두 달 만에 나온 후속 모델이다. 앤트로픽은 같은 라인업의 다음 등급인 소넷 5.5와 하이쿠 5.5도 몇 주 안에 비슷한 수준의 성능 개선과 함께 내놓을 계획이라고 밝혔다.
0 / 300