OpenAI, GPT-6 Sol·Luna 공개... API 가격 50% 인하, AutomationBench서 Claude Opus 5 앞서
- OpenAI가 GPT-6 Astra 다음으로 GPT-6 Sol과 GPT-6 Luna를 공개하고 API 가격을 GPT-5.6 프로모션 가격 대비 50% 인하함. Sol은 입력 $4→$2, 출력 $20→$10이고 Luna는 입력 $0.20→$0.10, 출력 $1.20→$0.50 (100만 토큰당)
- AutomationBench 1.0.6에서 GPT-6 Sol(xhigh effort)이 33.2%로 Claude Opus 5(max)의 26.9%를 이기고 작업당 비용은 $0.27로 Opus 5의 9% 수준임
- Agents' Last Exam V1에서 GPT-6 Sol(max effort)이 56.4%로 Claude Opus 5의 평가 내 최고 점수를 넘어서며 작업당 비용은 60% 낮음
- OpenAI 내부 사실성 평가(사용자가 오류를 플래그한 비식별 대화 기반)에서 GPT-6 Sol이 전작 대비 오류를 약 절반으로 줄여 Astra급 신뢰도에 근접함
- GPT-6 Luna는 high effort에서 GPT-5.6 Luna보다 5.4%p 개선되고 작업당 비용은 58% 감소함. 같은 평가에서 Opus 5에 폴백하는 Claude Fable 5.1의 데이터포인트는 폴백 비용이 빠져 실제 비용을 과소 보고함
Hacker News opinions
주요 플레이어들 전부 가격을 내려주는 흐름이 좋음.
그건 Qwen4 발표 때문 아님?
이거 Anthropic 오늘 릴리스에 맞춘 것 같은데 안 그럼 이상하지.
오히려 반대임. OpenAI가 이미 지난주 화요일 출시를 예고했었고, Altman도 트위터에서 말하다가 이번 주로 밀린 거라 Anthropic이 맞춘 쪽일 듯. 근데 둘 다 우연이라 봄.
5.6 가격 대비 50% 인하가 꽤 괜찮음. Luna가 입력 $0.10/M, 출력 $0.50/M이면 진짜 미친 수준인데, Azure나 AWS 지원 여부가 글에 없음. 나중에 뜨겠지만 안 뜨면 좀 이상할 듯.
API 가격 인하가 구독 플랜 한도에도 반영될까? 아는 사람?
난 5.6 Sol을 그냥 더 다듬어줬으면 좋겠음. 6 Sol이 Astra랑 비슷하면 별로일 것 같아서.
비용 대비 지능 잘 뽑아낸 일상용 모델 쪽으로 점점 가는 느낌이 듦.
Opus 5.5가 더 낫지 않나? 둘 점수 붙여봐 주실 분?
그건 직접 경쟁 상대가 아님. 6 Sol이 50%나 싸니까.
이 가격이면 Claude를 어떻게 쓰는지 모르겠음. 모델 품질이랑 가격 양쪽 다 OpenAI 팀이 대단함. 근데 이 숫자가 실제 원가를 반영한 게 아닐 수 있고, OpenAI는 수익성과는 거리가 멀음. 리더 자리를 놓쳤으니 되찾으려고 밀어붙이는 걸 수도.
배치 처리는 여전히 50% 추가 할인이라 GPT-6 Sol 출력이 $5, Luna 출력이 $0.25임.
나 이미 Sol High로 사이드 프로젝트 3개 24/7 돌려도 쿼터가 안 닳았음. 이번 인하가 좋은 건 맞지만, 갑자기 사이드 프로젝트를 더 시작하진 않을 듯. 한 6~12개월 뒤엔 $200에서 $20로 내려도 될 것 같긴 함.
토큰당 가격 비교는 이젠 별로 의미가 없음. 토크나이저 바뀌고 생각 토큰 생겨서 작업당 비용(cost/task)이 맞는 척도임.
Claude Code랑 Codex 둘 다 써봤는데 가격이랑 별개로 Codex가 사용량을 훨씬 빨리 태웠음. 지능은 Claude랑 비슷한데, 나는 결국 Claude로 돌아옴. 플랜 한도가 늘어난다면 이야기가 달라지지만.
Astra는 하루 운전용으로 쓰기엔 한도가 너무 빨리 닳고 코드도 하우스 스타일 무시하고 이상하게 씀. 오케스트레이션은 오히려 Fable이 훨씬 잘하고, 나는 Fable로 설계하고 Opus 서브에이전트 띄우는 방식이 결과가 제일 좋았음.
1M 토큰 컨텍스트가 변수임. 입력 272K 넘어서면 Codex Sol이 Opus랑 거의 같은 가격이고 Astra도 Fable 수준이 됨.
가격만 보면 Claude를 왜 쓰냐고 하는데, Claude는 아직 $200/월 20x 플랜이 있음. OpenAI는 9월 11일 이후로 이게 복귀 ETA도 없이 묶여 있어서 나도 $100/월로 내렸다가 사용량이 급증했는데 업그레이드가 안 됨.
Grok이 $2 / $6으로 대충 상위권 제품을 내고 있어서 OpenAI가 모델이 살짝 밀리더라도 가격으로 시장을 먹는 계산일 수 있음.
6 Sol이 DeepSwe에서 5.6 Sol보다 낮게 나온 거 아님? 이상한데.
Terra는 아예 안 나오고, 근데 원래 Sol이 Terra 자리를 먹은 건가? Astra 최상위, Luna 최저가, Sol 중간이면 Terra랑 같은 위치인데.
Astra를 오케스트레이터로 두고 Sol을 구현자로 쓰는 게 최적인 것 같음. Fable + Opus 조합이랑 같은 패턴.
그 패턴 난 별로임. Astra는 오케스트레이션 결정을 너무 못해서 Sol 둘 다 맡기는 중. 반대로 Sol이 오케스트레이터, Astra가 플래너로 쓰면 잘 돌아감.