AI 모델 고르기가 비용 관리가 된 날
2026년 7월 9일 오픈AI가 GPT-5.6 계열을 일반 공개했어요. 6월 말 미국 정부 요청으로 제한적으로만 풀렸다가 이날 전면 확대됐고요. 한 모델이 아니라 세 개입니다 — Sol(주력), Terra(중간), Luna(저가).
저는 이걸 친절이 아니라 계산을 넘긴 것으로 봐요. 예전엔 AI 회사가 "이게 최고입니다" 하나만 팔았는데, 이제는 등급 선택 = 원가 관리가 됐고 그 판단을 사용자가 떠안았거든요.
API 가격은 최상위와 최하위가 정확히 25배 차이예요
출시 당시 API 100만 토큰 기준 가격은 Sol이 입력 $5·출력 $30, Terra가 $2.50·$15, Luna가 $1·$6이었어요. 그런데 7월 30일 오픈AI가 Luna를 80% 인하($0.20/$1.20)하고 Terra를 20% 인하($2/$12)했고, Sol만 $5/$30으로 그대로 뒀어요.
현재 기준 입력은 Sol $5 대 Luna $0.20으로 25배, 출력은 $30 대 $1.20으로 25배 차이가 나요. 같은 작업을 Luna로 돌리면 Sol 대비 비용이 25분의 1로 떨어지는 거예요.
Terra는 그 중간이에요. 오픈AI는 Terra를 "GPT-5.5급 성능을 절반 가격에"라고 소개했어요. 대규모 운영 환경에서 가장 비싼 모델의 부담 없이 신뢰할 만한 결과를 얻고 싶을 때 쓰라는 거예요.
세 등급이 나온 이유는 같은 날 ChatGPT Work가 함께 나왔거든요
같은 7월 9일 ChatGPT Work도 나왔어요. GPT-5.6 기반 에이전트로 연결된 앱·파일에서 맥락을 모아 문서·스프레드시트·보고서를 끝까지 만들어내고, Pro·Enterprise·Edu에 배포됐어요.
모델 선택이 개발자만의 문제가 아니라 일반 업무 사용자의 비용 문제가 된 시점이에요. Work가 한 번에 여러 시간씩 돌 수 있으니, 어떤 등급을 쓰느냐에 따라 같은 작업도 비용이 크게 갈라지거든요. 그래서 오픈AI는 "Sol은 복잡한 코딩·보안 연구, Terra는 고객 지원·내부 도구·문서 분석, Luna는 요약·초안·일상 자동화"라고 용도를 나눠 제시했어요.
성능 벤치마크는 Sol이 앞이지만, 비용-성능 비로 보면 Luna가 뒤집어버렸어요
오픈AI가 실제 근거로 든 건 Artificial Analysis Coding Agent Index예요. max reasoning을 켠 Sol이 80점으로 앤트로픽 Fable 5보다 2.8점 높으면서, 출력 토큰은 절반 미만(54% 적음), 소요 시간도 절반 미만(57% 짧음), 비용은 약 3분의 1 수준이라고 밝혔어요. (즉, 앤트로픽 Fable 5 대비 약 3분의 2 더 저렴한 셈이에요.)
하지만 BuildFastWithAI 리뷰에서는 Luna가 Terminal-Bench에서 82% 점수를 받으면서도 입력 토큰당 $1에 불과하다는 점을 강조했어요. "그 한 숫자가 이번 분기 모든 AI 빌더의 가격-성능 계산을 다시 쓴다"고요. 성능만 보면 Sol이 우수하지만, 월간 비용으로 환산하면 Luna의 가성비가 상황을 바꾼 셈이에요.
메이커님의 선택 기준 — 작업 복잡도로 등급을 나눈다
ChatGPT Projects로 고객 응대·콘텐츠·리서치를 묶어 쓰던 방식이 이제 등급 선택까지 고려해야 하는 구조로 바뀐 거예요. 기본 원칙은 "싼 모델로 시작해서 막힐 때만 올린다"예요.
요약·분류·초안 작성 같은 단순 반복 작업은 Luna로, 고객 지원이나 내부 문서 분석처럼 일정한 품질이 필요한 업무는 Terra로, 복잡한 코딩이나 멀티 에이전트 추론이 필요한 작업만 Sol로 돌리는 거죠. 혼자 일하는 사람이 정말 쓰는 AI 도구를 고를 때 봤던 기준이 이제 "모델 등급"으로도 적용돼요. 작업 복잡도와 예산을 같이 봐야 하거든요.
ChatGPT Work는 한 번에 여러 시간씩 돌 수 있으니, 등급 선택이 월간 비용에 직접 영향을 줘요. 예를 들어 경쟁사 분석 보고서를 만드는 데 Work가 3시간 돌았다면, Sol로 돌렸을 때와 Luna로 돌렸을 때 비용이 25배 차이 날 수 있어요.
실행 단계에서 섞어 쓸 수 있어요
등급이 갈라졌어도 ChatGPT가 카피 써줘도 사람 손이 꼭 가는 3가지는 그대로예요. AI가 초안을 빨리 뽑아줄 수는 있지만, 브랜드 톤·맥락·미묘한 뉘앙스는 여전히 사람이 다듬어야 하거든요.
차이가 있다면 이제는 "어느 등급이 이 작업에 맞는지"를 먼저 판단해야 한다는 거예요. 초안은 Luna로 빠르게 뽑고, 최종 다듬기만 Terra나 Sol로 한 번 더 돌리는 식으로 섞어 쓸 수도 있어요. 한 번의 작업을 여러 등급으로 나눠 처리하면서 전체 비용은 줄이는 전략이 가능해진 거죠.
등급을 고르는 건 이제 메이커님의 원가 관리가 됐어요
예전엔 AI 회사가 "이게 최선입니다"라고 하나만 줬어요. 사용자는 그냥 쓰거나 안 쓰거나 둘 중 하나였고요.
지금은 달라요. 세 등급 중 어떤 걸 고를지, 언제 올리고 내릴지를 사용자가 판단해야 해요. 그게 곧 원가 관리거든요.
ChatGPT Work처럼 몇 시간씩 돌 수 있는 에이전트가 나오면서, 등급 선택이 월간 지출에 직접 영향을 주는 구조가 됐어요. 메이커님이 스스로 "이 작업은 Luna로 충분한가, Terra가 필요한가"를 매번 따져야 하는 거죠.
세 등급으로 쪼갠 건 선택지를 넓혀준 게 아니라, 계산을 넘긴 거예요.
한 번 더, 빠르게 짚고 갈게요
Q. Luna로 돌렸을 때와 Sol로 돌렸을 때 결과물이 다른가요?
A. 단순 작업이면 거의 같지만, 복잡한 추론이나 멀티 에이전트 작업에서는 Sol이 훨씬 정확해요. 오픈AI가 Sol을 "복잡한 코딩·보안 연구"용으로 소개한 이유가 그거예요. 요약이나 분류 같은 작업은 Luna로도 충분하고요.
Q. ChatGPT Work는 어느 등급을 쓰나요?
A. Work는 GPT-5.6 기반이라 Sol·Terra·Luna를 다 쓸 수 있어요. Free, Go 플랜 사용자는 Terra에, Plus, Pro, Business, Enterprise 플랜 사용자는 Sol·Terra·Luna 모두에 접근할 수 있어요. 다만 사용자가 ChatGPT Work 내에서 직접 모델 등급을 고르는 옵션은 없으며, 작업 복잡도에 따라 자동으로 가장 적합한 모델이 배정되는 방식으로 작동하는 것으로 보여요. 초기에는 Pro·Enterprise·Edu에 배포되었고, Plus·Business는 며칠 뒤 순차 배포되었어요.
Q. 세 등급을 섞어 쓸 수 있나요?
A. API를 쓴다면 작업마다 다른 등급을 지정할 수 있어요. 예를 들어 초안은 Luna로 뽑고, 최종 다듬기는 Terra로 한 번 더 돌리는 식으로요. ChatGPT 구독 요금제는 따로 등급을 고르는 게 아니라 플랜에 따라 쓸 수 있는 모델이 정해져 있어요.
Q. 7월 30일 가격 인하가 어느 정도 영향인가요?
A. Luna가 80% 내려서 출시 때 $1/$6이던 게 지금은 $0.20/$1.20이에요. 단순 작업을 대량으로 돌려야 하는 팀이라면 이 인하폭이 월간 비용에 엄청난 차이를 만들어요. Terra도 20% 내려서 $2.50/$15에서 $2/$12로 떨어졌고요.
Q. 그럼 이제 무조건 Luna만 쓰면 되는 거 아닌가요?
A. 단순 작업이면 맞아요. 하지만 복잡한 추론이나 멀티 에이전트 작업에서는 Luna가 막히거나 오류를 낼 수 있어요. 그럴 땐 Terra나 Sol로 올려야 하고요. 결국 작업 복잡도와 예산을 매번 따져서 고르는 게 메이커님의 새 루틴이 됐어요.
코워크메이커스 에디터가 직접 최근 AI 소식을 확인하고 코냥이 AI의 도움을 받아 작성한 글이에요. 공식 문서 기반으로 팩트 체크하여 가장 빠르게 소식을 전달하려고 해요.



