안녕하세요, NOVA AI 팀입니다.
2026년 9월 30일부터 웹 시험지 변환과 데스크톱 앱의 문제 풀이·해설 모델을 GPT 6.1 Sol로 바꿨습니다. 2026년 9월 23일부터 쓰던 GPT 6 Sol의 후속 모델입니다. 앱을 다시 설치하거나 설정을 바꾸지 않아도, 해설을 만들 때 새 모델이 적용됩니다.

어디에 적용되나요
해설을 작성하는 경로만 바뀝니다. 문제를 한글로 옮기는 타이핑과 변형 문제 출제는 기존 모델을 유지합니다.
| 작업 | 모델 | 이번 변경 |
|---|---|---|
| 웹 시험지 변환의 문제 풀이·해설 | GPT 6.1 Sol | GPT 6 Sol에서 교체 |
| 데스크톱 앱의 문제 풀이·해설 | GPT 6.1 Sol | GPT 6 Sol에서 교체 |
| 문제 타이핑 | Gemini 3.8 Flash | 유지 |
| 변형 문제 출제 | GPT-6 Astra | 유지 |
문제 타이핑의 적용 범위는 Gemini 3.8 Flash 타이핑 모델 업그레이드 안내에, 직전 해설 모델은 시험지 한글 변환과 GPT 6 Sol 적용 안내에 정리되어 있습니다.
GPT 6.1 Sol은 어떤 모델인가요
아래 내용은 OpenAI가 2026년 9월 29일 공개한 GPT-6.1 Sol 소개를 기준으로 정리했습니다. 평가 수치는 OpenAI의 연구 환경 또는 API에서 측정한 값이며, 실제 ChatGPT 응답과는 시스템 프롬프트·도구·추론 강도에 따라 다를 수 있습니다. 다른 회사 모델의 점수는 공개된 보고서를 인용한 것입니다.
GPT 6.1 Sol은 GPT 6 Sol의 업그레이드입니다. OpenAI는 이 모델이 에이전트 기반 코딩, 컴퓨터 사용, 전문 업무에서 높은 성능을 내고, 고난도 작업에서는 최상위 모델인 GPT 6 Astra에 더 가까워졌다고 소개합니다. 표준 입력·출력 토큰의 API 가격은 Astra의 5분의 1입니다. 종합 역량에서는 GPT 6 Astra가 여전히 OpenAI의 최상위 프런티어 모델이고, GPT 6.1 Sol은 중요한 작업을 더 자주 돌리거나 대규모로 운영할 때의 성능과 비용 균형점으로 제시됩니다.
OpenAI는 GPT 6.1 Sol을 현재 이용 가능한 모델 가운데 성능 대비 비용 효율이 가장 높은 모델로 설명합니다. 캐시된 입력은 표준 입력 가격보다 95% 낮은 100만 토큰당 0.10달러입니다. 같은 맥락을 반복해서 넣는 작업의 API 비용을 줄이기 위한 가격입니다.
해설에서 기대하는 변화
NOVA AI의 해설은 문항의 조건과 그림·표를 읽고, 풀이 단계를 나눈 뒤, 학생이 읽을 문장으로 정리하는 작업입니다. OpenAI가 공개한 개선 가운데 이 흐름과 맞닿는 부분은 다음입니다.
- 복잡한 문서 이해: 표, 차트, 도표, 작은 글씨가 있는 PDF로 전문 질문을 푸는 GDP.pdf 평가에서, GPT 6.1 Sol은 시험한 추론 설정 전반에서 폴백을 쓰는 Opus 5.5보다 높은 점수를 기록했고 작업당 비용은 절반 미만이었습니다. GPT 6 Astra의 성능에는 근접하면서 작업당 비용은 약 5분의 1이었습니다.
- 여러 단계의 업무 절차: 영업, 마케팅, 운영, 지원, 재무, 인사 도구 47개로 끝까지 절차를 수행하는지 보는 AutomationBench에서, 중간 추론 강도의 GPT 6.1 Sol은 Opus 5.5보다 2.2%포인트 높고 비용은 약 3분의 1이었습니다. 같은 설정의 GPT 6 Sol보다는 4.8%포인트 높습니다.
- 화면을 보고 처리하는 작업: 긴 컴퓨터 사용 과제를 보는 OSWorld 2.0 오프라인 세트에서, 최대 추론 강도의 GPT 6.1 Sol은 GPT 6 Sol보다 7%포인트 높고 비용은 절반 미만이었습니다. Astra와의 점수 차이는 2.1%포인트이고, 작업당 비용은 약 7분의 1입니다.
- 코드와 계산이 필요한 과학 작업: 데이터 분석, 시뮬레이션, 모델 피팅을 포함하는 Terminal-Bench Science 0.1에서, 최대 추론 강도의 GPT 6.1 Sol은 GPT 6 Sol 점수의 2배를 넘기면서 작업당 비용은 절반 미만이었습니다. 평균 작업당 비용은 5.47달러로, Opus 5.5의 23.21달러, Astra의 23.80달러보다 75% 이상 낮습니다. 같은 평가의 최고 점수는 여전히 Astra의 68.1%이므로, 가장 어려운 과학 연구 작업에는 Astra가 더 적합하다고 OpenAI는 안내합니다.
- 실제 코드베이스 작업: 장기 소프트웨어 엔지니어링 과제인 DeepSWE v1.1에서 GPT 6.1 Sol은 약 5분의 1 비용으로 GPT 6 Astra와 대등한 성능을 보였고, 더 낮은 추론 강도와 비용으로 GPT 6 Sol의 최고 점수보다 6.4%포인트 높았습니다.
사실 정확성과 지시 준수
사실 오류가 섞이기 쉬운 고난도 프롬프트에서, 추론 강도를 매우 높음으로 둔 GPT 6.1 Sol의 사실 오류율은 4.1%입니다. GPT 6 Sol은 4.5%, GPT 6 Astra는 4.0%였고, 작업당 비용은 Astra보다 약 83% 낮습니다. 이 평가는 사용자가 이전 모델의 오류를 신고한 대화를 비식별화해 일부러 어렵게 고른 것으로, 평소 사용의 오류율을 뜻하지는 않습니다.
정렬 평가에서도 GPT 6.1 Sol은 GPT 6 Sol보다 나아져 GPT 6 Astra에 더 가까워졌다고 OpenAI는 설명합니다. 자신의 한계를 더 분명히 알리고, 사용자의 의도와 안전 제약을 더 안정적으로 따른다는 취지입니다. 검색 도구가 동작하지 않을 때 추측 대신 문제를 알리는 평가의 실패율은 GPT 6.1 Sol 2.8%, GPT 6 Sol 4.9%, GPT 6 Astra 1.5%입니다. 이 수치 역시 실패를 유도하도록 고른 과제이며 일반적인 사용을 대표하지 않습니다. GPT 6 Astra, GPT 6 Sol과 같이 자동 안전 검토를 우회하려는 시도는 관찰되지 않았습니다.
API 가격과 NOVA AI 토큰
OpenAI API에서 모델 ID는 gpt-6.1-sol입니다. 표준 API 가격은 입력 100만 토큰당 2달러, 캐시된 입력 100만 토큰당 0.10달러, 출력 100만 토큰당 10달러입니다. ChatGPT Work와 Codex에서는 Plus, Pro, Business, Enterprise, Edu 사용자에게 제공되며, 소개문 기준으로 Chat에는 아직 들어오지 않았습니다.
OpenAI는 같은 날 GPT 6 Astra보다 최대 8배 빠른 Ultrafast 변형도 함께 공개했습니다. NOVA AI 해설은 그 변형이 아니라 표준 gpt-6.1-sol을 사용합니다.
선생님 계정에서 차감되는 해설 토큰 배율은 이전과 같습니다. 입력 ×1.2, 출력 ×6입니다. API 목록 가격이 낮아졌다는 사실만으로 사용 토큰이 자동으로 줄어들지는 않습니다.
이용 방법
- 웹에서는 시험지 변환하기에서 해설이 포함된 변환을 진행하면 됩니다.
- 데스크톱 앱에서도 기존과 같이 문제 풀이·해설을 실행하면 됩니다. 앱이 이전 이름인 GPT 6 Sol 또는 GPT 5.6 Sol을 보내도 GPT 6.1 Sol로 맞춰 처리합니다.
- 모델 선택 화면을 따로 바꾸지 않아도 해설의 기본 모델은 GPT 6.1 Sol입니다.
해설 문장, 조건 해석, 수식 정리에서 고치고 싶은 부분이 있으면 앱의 피드백으로 알려 주세요. 실제 시험지에서 나온 사례를 보고 계속 다듬겠습니다. 감사합니다.
