OpenAI, GPT-6 Sol·Luna 출시: 토큰 단가 50% 인하와 105만 컨텍스트 지원

OpenAI가 플래그십 Astra에 이어 중형 모델 GPT-6 Sol과 초경량 Luna를 출시했습니다. GPT-5.6 대비 API 비용을 50% 절감하고 105만 토큰 컨텍스트와 배치 할인을 전격 지원합니다.

tau · 2026년 9월 23일

#OpenAI #GPT-6 #GPT-6 Sol #GPT-6 Luna #LLM #API

OpenAI, GPT-6 Sol·Luna 출시: 토큰 단가 50% 인하와 105만 컨텍스트 지원

OpenAI가 2026년 9월 22일, 차세대 플래그십 파운데이션 모델인 GPT-6 Astra에 이어 중형 모델 'GPT-6 Sol'과 초경량 모델 'GPT-6 Luna'를 공식 발표하고 API 및 ChatGPT 서비스에 정식 출시했습니다. 이번 릴리즈는 직전 세대인 GPT-5.6의 프로모션 요율과 비교해도 토큰 단가를 50% 전격 인하하여, 대규모 트래픽을 처리하는 엔터프라이즈 워크플로우와 독립 개발자의 상용 배포 비용 장벽을 크게 낮추었습니다.

OpenAI GPT-6 Sol과 GPT-6 Luna 공식 출시 브랜딩 그래픽 및 모델 라인업 구조도

이미지 출처: OpenAI

이번 출시는 최상위 추론 성능을 상징하는 Astra 중심의 단일 플래그십 전략에서 벗어나, 프로덕션 환경의 실무 개발자와 에이전트 시스템이 요구하는 경제성과 처리 속도를 정밀하게 조준한 라인업 분기입니다.

토큰 단가 50% 인하: GPT-6 Sol과 Luna의 가격 정책 및 스펙 비교

GPT-6 Sol과 Luna의 가장 직접적인 변화는 대규모 API 호출에 따른 인프라 비용 절감입니다. 이전 세대 모델인 GPT-5.6의 프로모션 요율 대비 50% 인하된 가격 체계가 확정되었습니다.

  • GPT-6 Sol 가격 책정: 입력 100만 토큰당 2.00달러, 출력 100만 토큰당 10.00달러입니다. 기존 GPT-5.6의 100만 토큰당 입력 4.00달러 및 출력 20.00달러와 비교하면 정확히 절반 수준입니다.
  • GPT-6 Luna 가격 책정: 입력 100만 토큰당 0.10달러, 출력 100만 토큰당 0.50달러로 책정되었습니다. 이전 세대 경량 티어 요율(입력 0.20달러, 출력 1.20달러) 대비 대폭 낮아져 대량 텍스트 파이프라인의 경제성을 극대화했습니다.
  • 배치 API(Batch API) 50% 추가 할인: 즉각적인 실시간 응답이 필요하지 않은 비동기 데이터 처리 워크로드에는 기본 단가에서 추가로 50%가 감면되는 배치 API 정책이 동일하게 적용됩니다.
  • 105만(1.05M) 토큰 컨텍스트 윈도우: 두 모델 모두 1,050,000 토큰에 달하는 대용량 컨텍스트 창을 기본 지원합니다. 대형 코드베이스 분석, 법률·금융 장문 문서 검색, 수십 건의 대화 세션 기록을 단일 프롬프트에서 누락 없이 수용할 수 있습니다.
  • 프롬프트 캐싱 자동 적중: 반복 참조되는 시스템 프롬프트, 도구 스키마, 문서 인덱스는 개선된 추론 엔진에 의해 자동으로 캐싱 적중되어 지연 시간과 추가 비용을 절감합니다.

기존 대형 모델들이 긴 컨텍스트 지원 시 높은 입출력 단가로 인해 실무 도입에 제약이 따랐던 반면, Sol과 Luna는 100만 토큰급 컨텍스트와 인하된 단가를 결합해 대규모 문서 파이프라인의 실효성을 확보했습니다.

에이전트 코딩과 초경량 라우팅: 두 모델의 워크로드 분담

OpenAI는 Sol과 Luna를 각각 뚜렷하게 구별되는 두 가지 엔지니어링 영역에 최적화했습니다.

GPT-6 Sol: 일상 코딩과 멀티스텝 에이전트

GPT-6 Sol은 일상적인 소프트웨어 개발 작업과 여러 단계를 거치는 멀티스텝 자율 에이전트, 그리고 복잡한 비즈니스 코어 로직을 전담합니다.

OpenAI 내부 평가에 따르면 Sol은 직전 세대 모델 대비 에이전트 워크플로우 수행 시의 오류율이 절반 수준으로 감소했다고 밝혔습니다. 복잡한 API 도구 호출(Tool Calling)과 긴 컨텍스트가 유지되는 리팩토링 과정에서 프롬프트 이탈 현상이 줄어든 점이 특징입니다. 다만 Artificial Analysis 등 독립 벤치마크 평가 그룹에 따르면, 순수 추론 지능 점수는 기존 GPT-5.6 수준과 유사하게 측정되었습니다. 따라서 Sol의 핵심 가치는 미지의 고난도 수학적 발견보다는 정형화된 실무 태스크에서의 높은 실행 안정성과 비용 효율성에 있습니다.

GPT-6 Luna: 고속 라우팅과 대량 데이터 전처리

GPT-6 Luna는 극단적인 반응 속도와 대량 동시 요청 처리가 필수적인 프런트 도어 레이어에 초점을 맞춥니다.

  • 사용자 요청의 의도 분류 및 적절한 하위 모델·도구로의 동적 라우팅
  • 대규모 비정형 문서에서의 정형 JSON 메타데이터 추출
  • 실시간 콘텐츠 검열, 텍스트 필터링 및 토큰 최적화 프리프로세싱

입력 0.10달러 수준의 극저가 요율 덕분에 시스템 아키텍트는 비용 부담 없이 전체 사용자 인입 트래픽 전면에 Luna를 배치하여 사전 필터링 및 오케스트레이션을 구성할 수 있습니다.

개발자 API 및 ChatGPT 배포 채널

GPT-6 Sol과 Luna는 9월 22일 발표와 동시에 복수의 엔드포인트와 파트너 플랫폼을 통해 즉각 공급됩니다.

  • OpenAI API: 개발자는 공식 엔드포인트에서 모델 식별자 gpt-6-solgpt-6-luna를 지정하여 즉시 애플리케이션에 통합할 수 있습니다.
  • ChatGPT 서비스: 유료 구독 플랜(Plus, Pro, Business, Enterprise, Edu) 및 업무용 ChatGPT Work 환경과 개발자 하네스 Codex에서 두 모델이 즉시 활성화됩니다.
  • 데스크톱 앱 무료·Go 티어: 무료 사용자 및 신규 Go 티어 사용자의 경우, 데스크톱 전용 애플리케이션을 통해 GPT-6 Luna 기반의 빠른 응답을 경험할 수 있습니다.
  • 클라우드 및 개발 도구 생태계: Microsoft Azure 기반의 Foundry 서비스와 GitHub Copilot 환경에서도 릴리즈 당일부터 두 모델을 선택할 수 있도록 배포가 완료되었습니다.

최상위 복잡 추론에는 GPT-6 Astra를, 일상적인 엔지니어링 및 에이전트 운영에는 GPT-6 Sol을, 트래픽 라우팅과 경량 배치 전처리에는 GPT-6 Luna를 조합하는 계층화된 AI 아키텍처 구성이 표준으로 자리잡을 전망입니다.

출처