워크·코덱스 우선…일반 채팅은 미개방

오픈AI가 22일(현지시간) GPT-6 솔과 루나를 공개하고 GPT-5.6 프로모션 대비 API 가격을 절반으로 낮췄다.

공식 발표에 따르면 절감은 캐시·추론 효율 개선에서 나왔고, 회사는 그 절감분을 이용자 가격에 반영했다. 솔은 유료 플랜의 워크·코덱스와 API에 먼저 풀리고, 일반 채팅에는 아직 없다.

API 입력·출력 가격 절반 인하

오픈AI 발표문에 따르면 솔의 API 가격은 입력 100만 토큰당 2달러, 출력 10달러다. GPT-5.6 솔 프로모션가 4달러·20달러의 절반이다. 루나는 입력 0.10달러, 출력 0.50달러로 각각 0.20달러·1.20달러에서 내려왔다. 플래그십 아스트라 API는 입력 10달러, 출력 50달러로 그대로다.

오픈AI에 따르면 캐시된 입력 토큰 읽기에는 90% 할인이 붙는다. 개발자는 캐시 접두어가 끝나는 지점을 명시해 재사용 구간을 고를 수 있고, 추론 강도와 도구 사용 여부를 바꿔도 앞선 맥락 캐시는 유지된다. 깃허브가 최근 수개월간 오픈AI 모델로 보낸 수십억 건 요청에서는, 새로 처리해야 하는 프롬프트 토큰 비중이 절반 넘게 줄었다.

같은 날 아마존 웹서비스는 베드록에서 두 모델의 일반 제공을 알렸다. 컨텍스트 길이는 최대 100만 토큰이다.

캐싱과 추론을 개선해 이 모델들을 더 낮은 비용에 제공할 수 있게 됐고, 그 절감분을 이용자와 고객에게 바로 넘긴다.

— 오픈AI, 공식 발표 9월 22일 · “Improvements in caching and inference let us serve these models at lower cost, and we’re passing those savings directly on to users and customers”

오픈AI 발표문에 따르면 내부 연구자 중위 토큰 사용은 API 가격 기준 하루 600달러를 넘고, 상위 10%는 7000달러를 넘는다. 코딩 에이전트가 더 길고 무거운 작업을 맡을수록 지속 사용 비용이 더 중요해진다는 문구가 가격표 옆에 실렸다. 사용 한도를 높이면서 단가를 낮춰 반복 시도를 넓힌다는 설명도 같이 나왔다.


솔은 코딩, 루나는 대량 처리

이달 초 나온 GPT-6 아스트라 아래에 솔과 루나가 붙는다. 솔은 복잡한 코딩·업무용이고, 루나는 요약·추출·분류·라우팅 같은 대량 작업용이다. 회사는 솔과 루나를 아스트라와 비슷한 방식으로 학습했다. 아스트라는 가장 까다로운 작업용으로 남는다.

내부 사실성 평가에서 GPT-6 솔은 전작보다 실수를 약 절반만 낸다.

— 오픈AI, 공식 발표 9월 22일 · “GPT-6 Sol makes about half as many mistakes as its predecessor, approaching Astra-level reliability at much lower cost”

오픈AI 발표문에 따르면 루나는 높은 추론 설정에서 GPT-5.6 솔에 맞먹으면서 비용은 약 100분의 1이다. 정렬 평가에서도 솔·루나는 GPT-5.6보다 나은 점수를 냈고, 코딩 작업에 대한 오해의 성 주장 비율이 줄었다. 전체 수치는 시스템 카드에 실려 있다.

발표문 기준으로 AutomationBench에서 솔(xhigh)은 과제당 0.27달러에 33.2%를 기록했다. 같은 표에서 클로드 오퍼스 5(max)는 26.9%였고, 과제당 비용은 솔의 11.1배였다. 높은 설정 루나는 전작보다 5.4%포인트 올랐고, 과제당 비용은 58% 낮아졌다. Agents’ Last Exam에서 솔(max)은 56.4%로, 오퍼스 5 최고점보다 과제당 비용이 60% 낮았다.

발표문에 따르면 DeepSWE v1.1에서 솔(max)은 68.8%로 클로드 페이블 5(xhigh) 69.9%에 1.1%포인트 차였다. 과제당 비용은 약 80% 낮았다. 루나(max)는 66.6%로, 오퍼스 5·페이블 5 중간 설정과 비슷하면서 과제당 비용은 각각 93%, 96% 낮았다. OSWorld 2.0 오프라인에서 솔(xhigh)은 60.5%로 오퍼스 5 중간 설정 60.3%와 비슷했고, 과제당 비용은 약 80% 낮았다. 경쟁 모델 점수는 공개 보고서에서 가져왔고, 페이블 5.1 수치가 없을 때는 페이블 5로 대체했다는 주석이 붙었다.


워크·코덱스부터 단계 개방

Plus·Pro·Business·Enterprise·Edu 이용자는 당일부터 ChatGPT Work와 Codex에서 솔·루나를 쓸 수 있다. Free·Go는 데스크톱 앱에서 루나만 시험한다. API 식별자는 gpt-6-sol과 gpt-6-luna다.

서비스 안정을 위해 ChatGPT 쪽 개방은 하루 동안 단계적으로 이어진다. Work나 Codex에 바로 안 보이면 나중에 다시 확인하라는 안내가 붙었다.

테크크런치에 따르면 같은 날 약 90분 앞서 앤스로픽이 클로드 오퍼스 5.5를 내놓으며 실행 비용을 약 40% 낮췄다. 두 발표는 같은 오후에 겹쳤다.

일반 Chat에 솔·루나가 언제 전면 개방될지는 정해지지 않았다.


#언어모델#AI 경제#에이전트