핵심 내용
OpenAI는 9월 29일 GPT-6 Sol의 후속 모델인 GPT-6.1 Sol을 공개했다. 표준 API 가격은 입력 100만 토큰당 2달러, 캐시 입력 0.10달러, 출력 10달러로 GPT-6 Sol과 같은 가격대이며, OpenAI는 GPT-6 Astra의 표준 입력·출력 가격 대비 약 5분의 1 수준이라고 설명했다. GPT-6.1 Sol은 현재 API에서 gpt-6.1-sol로 제공되고 Plus, Pro, Business, Enterprise, Edu 사용자는 ChatGPT Work와 Codex에서 이용할 수 있지만 일반 ChatGPT Chat에는 아직 제공되지 않는다.
OpenAI 자체 평가에서 GPT-6.1 Sol은 DeepSWE 1.1의 장기 소프트웨어 엔지니어링 작업에서 GPT-6 Astra에 근접한 성능을 약 5분의 1 비용으로 보였고, OSWorld 2.0 오프라인 세트에서는 최대 추론 강도 기준 Astra와 2.1%포인트 차이를 보이면서 작업당 비용은 약 7분의 1이었다. Terminal-Bench Science 0.1에서는 평균 작업당 비용 5.47달러로 Opus 5.5의 23.21달러, Astra의 23.80달러보다 낮았다. 다만 이 수치는 OpenAI의 연구환경과 설정에서 측정된 벤더 평가이며 실제 서비스별 성능·비용은 달라질 수 있다.
같은 날 DevDay 2026에서는 모델 하나보다 넓은 Agent 제품군도 함께 공개됐다. 상시 업무를 맡는 Dots, 클라우드에서 실행되는 Codex, 다중 작업을 관리하는 새 Codex CLI, 전체 저장소를 지속 점검하는 Codex Security Cloud, 유한한 선택지에 대해 판단을 반환하는 Decisions API, 컴퓨터 사용이 추가된 Agents API, AWS 안에서 실행되는 Bedrock Managed Agents, ChatGPT 플러그인 확장과 MCP Events 기반 자동화 등이 발표됐다. OpenAI는 GPT-6 Astra Ultrafast도 출시해 Codex에서 최대 약 300 tokens/s, 기존 대비 최대 8배 수준의 생성속도를 제공한다고 밝혔다. GPT-6.1 Sol Ultrafast는 곧 제공될 예정이다.
배경
프런티어 모델 경쟁은 최고 benchmark 점수 하나보다 장시간 Agent를 얼마나 자주, 얼마나 싸고 빠르게 실행할 수 있는지로 이동하고 있다. 코딩·리서치·컴퓨터 사용 Agent는 한 번의 작업에서 긴 컨텍스트와 반복 tool call을 사용하므로 모델의 절대 성능보다 작업 완료율, cache 재사용, latency, 실패 후 재시도 비용이 실제 경제성을 좌우한다.
DevDay 발표도 이 흐름을 반영한다. OpenAI는 단일 모델 API를 제공하는 회사에서 Agent runtime, cloud execution, 보안검사, 이벤트 자동화, 플러그인, 협업공간까지 제공하는 실행 플랫폼으로 확장하고 있다.
산업·시장에 미치는 영향
GPT-6.1 Sol처럼 중간 가격대 모델이 Astra와의 성능 격차를 줄이면 기업이 모든 복잡한 작업을 최고가 모델로 보내야 할 이유가 줄어든다. 일반 작업은 Sol 계층에 배치하고 가장 어려운 과학·연구·고위험 업무만 Astra로 올리는 multi-tier routing이 더 경제적이 될 수 있다.
또 Agents API와 Bedrock Managed Agents의 결합은 모델 공급자와 클라우드 사업자의 경계도 흐린다. 기업 입장에서는 특정 모델의 성능뿐 아니라 실행환경, 권한, 연결도구, 감사로그, 데이터 보존정책을 한꺼번에 비교해야 한다.
실무에서 바로 활용할 수 있는 시사점
기존 GPT-6 Sol workload가 있다면 동일한 실제 task set으로 GPT-6.1 Sol을 shadow test하는 것이 좋다. 비교지표는 benchmark보다 완료업무당 총비용, tool-call 실패율, 평균 재시도 횟수, 사람 수정시간, cache hit rate가 유용하다. Astra를 기본값으로 쓰는 서비스도 6.1 Sol을 1차 모델로 두고 실패하거나 confidence가 낮은 작업만 Astra로 승격하는 방식을 검토할 가치가 있다.
Agent를 제품에 붙이는 경우에는 모델 선택과 별도로 실행 identity, tool permission, 네트워크 egress, human approval, 장기 작업의 비용상한을 명시적으로 관리해야 한다.
출처
OpenAI — GPT-6.1 Sol OpenAI — DevDay 2026 Recap GeekNews — 최신 글