핵심 내용

OpenAI는 9월 29일 GPT-6 Sol의 업그레이드 모델인 GPT-6.1 Sol을 공개했다. 표준 API 가격은 입력 100만 토큰당 2달러, 캐시 입력 0.10달러, 출력 10달러다. OpenAI는 GPT-6.1 Sol이 agentic coding, computer use, professional work에서 GPT-6 Astra에 근접하면서 Astra의 표준 입력·출력 토큰 가격의 약 5분의 1이라고 설명했다. GPT-6.1 Sol은 Plus, Pro, Business, Enterprise, Edu 사용자의 ChatGPT Work와 Codex에 순차 제공되며, API에서는 gpt-6.1-sol로 사용할 수 있다. 일반 ChatGPT 대화에는 아직 제공되지 않는다.

OpenAI 자체 평가에서 DeepSWE 1.1에서는 Astra와 비슷한 결과를 대략 5분의 1 비용으로 냈고, OSWorld 2.0 오프라인 세트에서는 최대 reasoning effort에서 Astra와 2.1%포인트 차이이면서 작업당 비용은 약 7분의 1이었다. Terminal-Bench Science 0.1에서는 최대 effort 기준 평균 작업당 비용이 5.47달러로, Opus 5.5의 23.21달러와 Astra의 23.80달러보다 낮았다. 다만 OpenAI가 직접 측정한 벤더 평가이므로 실제 제품에서 동일한 비용·성능 비율이 보장되는 것은 아니다.

같은 날 DevDay 2026에서는 모델 자체뿐 아니라 장기 Agent 제품군도 확대됐다. OpenAI는 장기간 지속되는 업무를 맡는 dots, 클라우드에서 계속 실행할 수 있는 Codex Cloud, 기업용 Codex Security Cloud, 컴퓨터 사용 기능을 포함하는 Agents API, 협업·플러그인 확장 등을 발표했다. OpenAI의 기업용 릴리스 노트에서도 Codex Cloud가 각 task를 별도 격리 workspace에서 실행하고 사용자의 컴퓨터가 꺼져 있어도 계속 작업할 수 있다고 설명한다.

배경

프런티어 모델 경쟁의 중심이 최고 benchmark 하나에서 실제 업무를 끝내는 비용과 시간으로 이동하고 있다. 코딩·리서치·컴퓨터 사용 Agent는 한 번의 요청 안에서도 여러 차례 모델 호출, 긴 context, tool call을 사용하므로 토큰 단가만으로 실제 원가를 판단하기 어렵다. 작업 완료율과 재시도 횟수, cache hit rate, 사람 수정시간까지 합쳐야 실제 경제성을 볼 수 있다.

산업·시장에 미치는 영향

GPT-6.1 Sol처럼 중간 가격대 모델이 최고급 모델과의 격차를 좁히면 기업의 기본 라우팅 구조가 달라질 수 있다. 대부분의 업무는 Sol 계층에서 처리하고, 실패하거나 특히 어려운 과학·고위험 reasoning만 Astra급 모델로 올리는 구조가 더 현실적이 된다.

또 Codex Cloud와 dots 같은 장기 실행형 Agent가 제품화되면서 모델 API 업체가 단순 inference 제공자를 넘어 workspace, sandbox, 권한, 연결도구, 감사로그를 포함하는 Agent 실행 플랫폼으로 확장하고 있다.

실무에서 바로 활용할 수 있는 시사점

기존 GPT-6 Sol이나 Astra를 사용 중이라면 동일한 실제 task set으로 GPT-6.1 Sol을 shadow test하고 완료업무당 총비용, tool-call 실패율, 재시도 횟수, 사람 수정시간을 비교하는 것이 좋다. Agent 환경에서는 모델 선택과 별도로 task별 격리 workspace, 최소 권한, 네트워크 egress, 비용상한을 관리해야 한다.

출처

OpenAI — GPT-6.1 Sol
OpenAI — DevDay 2026 Recap
OpenAI Help — ChatGPT Work and Codex
GeekNews — 최신 글