- 오픈AI가 새 모델 Sol을 내놨어요. 값은 최상위 모델 Astra의 5분의 1이에요.
- 코딩 시험에서는 Astra와 같은 점수를 냈고, 컴퓨터 조작 시험에서는 2.1점 차이였어요.
- 다만 숫자는 전부 오픈AI가 직접 잰 것이고, 과학 연구 같은 일은 여전히 Astra가 앞서요.
안녕하세요, 제시예요. 요즘 쓰는 AI 서비스의 월 요금이나 사용량 제한이 왜 그렇게 정해지는지 궁금했던 적 있으세요? 그 뒤에는 서비스 회사가 AI 모델에 내는 값이 있어요. 지난 9월 29일, 오픈AI가 그 값을 크게 흔드는 모델을 하나 내놨어요.
무엇이 나왔나요
이름은 GPT-6.1 Sol이에요. 오픈AI에는 지금 모델이 두 줄로 있어요. 가장 크고 비싼 쪽이 Astra이고, 가볍고 싼 쪽이 Sol이에요.
이번에 나온 건 싼 쪽의 새 버전이에요. 그런데 값은 그대로 두고 실력만 비싼 쪽 가까이 끌어올렸다는 게 핵심이에요. 오픈AI가 자기 개발자 행사인 데브데이에서 발표했어요.
오픈AI가 이 모델을 겨냥한 일은 세 가지예요. 코드를 짜는 일, 사람 대신 컴퓨터 화면을 눌러 가며 일하는 것, 그리고 긴 업무 문서를 읽고 정리하는 일이에요.
값은 5분의 1, 실력은 얼마나 가까운가요
AI 모델의 값은 토큰 단위로 매겨요. 토큰은 AI가 글을 읽고 쓸 때 쓰는 글자 조각이에요. 마트에서 쌀을 킬로그램으로 사듯, AI는 토큰 100만 개 단위로 값을 매겨요.
| GPT-6.1 Sol | GPT-6 Astra | |
|---|---|---|
| 읽기(입력) 100만 토큰 | 2달러 | 10달러 |
| 쓰기(출력) 100만 토큰 | 10달러 | 50달러 |
| 한 번에 읽을 수 있는 양 | 약 105만 토큰 | — |
읽기도 쓰기도 정확히 5분의 1이에요. 그럼 실력은 얼마나 떨어질까요?
오픈AI가 공개한 시험 결과를 보면 꽤 가까워요. 실제 소프트웨어 문제를 고치는 코딩 시험에서는 Astra와 같은 점수를 냈어요. 컴퓨터 화면을 조작해 일을 끝내는 시험에서는 2.1점 뒤졌는데, 한 문제를 푸는 데 든 돈은 Astra의 7분의 1 정도였어요.
틀린 말을 하는 비율도 줄었어요. 바로 전 버전의 Sol은 사실을 묻는 시험에서 11.4%를 틀렸는데, 이번 버전은 7.7%로 내려왔어요.
시험별 수치와 세부 요금 더 보기
코딩 시험은 DeepSWE v1.1, 컴퓨터 조작 시험은 OSWorld 2.0이에요. 코딩 시험에서는 바로 전 버전 Sol보다 6.4%포인트 올랐어요. 사실 정확도 시험에서 Astra와의 차이는 1.9%포인트예요. 도구 47개를 이어 쓰는 업무 자동화 시험(AutomationBench)에서는 앤트로픽의 Claude Opus 5.5보다 2.2점 높았고, 비용은 3분의 1 정도였다고 오픈AI는 밝혔어요. 요금에는 예외도 있어요. 한 번에 27만 2천 토큰이 넘는 긴 글을 넣으면 읽기 값이 두 배, 쓰기 값이 1.5배가 돼요. 급하지 않은 일을 몰아서 맡기는 방식은 절반 값이고, 더 빨리 답하는 방식은 두 배예요.
같은 앞부분을 다시 읽으면 95% 할인이에요
값에서 하나 더 볼 것이 있어요. AI 서비스는 같은 내용을 여러 번 읽혀요. 회사 규정집을 앞에 붙여 두고 질문만 바꿔 가며 묻는 식이에요.
이렇게 이미 읽은 앞부분을 다시 읽을 때는 따로 값을 매겨요. 도서관 책을 매번 새로 빌리지 않고 책상에 펼쳐 둔 채 다시 보는 것과 비슷해요.
이번 Sol은 그 값이 100만 토큰에 0.1달러예요. 보통 읽기 값의 5%만 내면 된다는 뜻이에요. 같은 자료를 붙들고 오래 일하는 AI 비서일수록 이 할인이 크게 작용해요.
그래도 큰 모델이 필요한 자리는 있어요
여기서 조심할 점이 두 가지 있어요.
첫째, 위 숫자는 전부 오픈AI가 직접 잰 것이에요. 다른 곳에서 같은 결과가 나오는지는 아직 시간이 더 필요해요.
둘째, 모든 일에서 Astra를 따라잡은 건 아니에요. 과학 연구처럼 깊게 따져야 하는 일에서는 Astra가 여전히 앞선다고 오픈AI도 밝혔어요. 비유하자면 동네 병원에서 대부분은 해결되지만, 어려운 수술은 큰 병원으로 가야 하는 것과 같아요.
그리고 무료 이용자는 아직 못 써요. 챗GPT에서는 Plus·Pro 같은 유료 요금제와 기업·교육용 요금제의 업무용 화면, 그리고 코딩 도구 Codex에서만 열렸어요.
나에게는 뭐가 바뀌나요
직접 API를 쓰지 않아도 영향은 있어요. 우리가 쓰는 많은 AI 앱이 뒤에서 이런 모델을 빌려 쓰거든요. 같은 일을 5분의 1 값에 할 수 있으면, 앱 회사는 사용량 제한을 넉넉하게 풀 여유가 생겨요.
AI를 업무에 붙이려는 분이라면 순서를 바꿔 볼 만해요. 처음부터 가장 비싼 모델을 고르지 말고, 싼 모델로 먼저 돌려 보는 거예요. 결과가 모자란 일만 큰 모델로 넘기면 돼요.
출처: GPT-6.1 Sol 발표 내용·요금·시험 결과는 오픈AI 발표(2026-09-29)와 이를 정리한 DataCamp·PC Tech Vault 보도(2026-09-30). 시험 결과는 모두 오픈AI 자체 측정치.
