GPT-6 Sol·Luna·Astra 선택법: 작업과 통과 기준으로 비교하기

GPT-6 모델을 고를 평가 출발점을 정리하고 동일한 토큰 수로 API 비용을 계산합니다. 공식 용도 설명과 성능 실측을 구분하며 빈 평가표를 제공합니다.

밝은 카드 위 스텐실 판의 검은 선 그림과 기하학 무늬, 영문 기사 제목이 있는 표지.

범위가 명확한 대량 작업은 Luna, 일상적인 코드·일반 작업은 Sol, 복잡한 작업은 Astra부터 평가할 수 있습니다. 이는 공식 용도에 따른 평가 출발점이며 자신의 작업에서 검증된 성능 순위는 아닙니다.

2026년 9월 23일 Sol·Luna 발표Astra 문서를 확인했습니다. 유료 세 모델 비교 실험을 수행하지 않았으므로 정확도, 속도나 완료율의 승자를 주장하지 않습니다.

작업의 통과 조건으로 난이도 나누기

작업 특성먼저 평가할 후보확인할 결과
출력 범위가 명확한 대량 분류·추출Luna필드 정확성, 예외, 재시도 비용
일상 코드 수정, 문서, 여러 단계의 업무Soldiff, 테스트, 도구 사용, 수동 수정
제약이 복잡하게 얽히고 실패 비용이 높은 작업Astra전체 목표, 놓친 조건, 총비용

하나의 작업 흐름에서 저렴한 모델이 입력을 정리하고 다른 모델이 어려운 사례를 처리하도록 평가할 수도 있습니다. 다만 전환 규칙은 자신의 데이터로 검증해야 합니다. 실패 원인이 프롬프트, 도구나 컨텍스트라면 더 비싼 모델로 바꾸는 것만으로 해결되지 않을 수 있습니다.

직접 API 단가 비교

OpenAI 요금의 Standard, 입력 272K 이하 기준입니다. 단위는 텍스트 100만 토큰당 미국 달러입니다.

모델일반 입력읽기쓰기출력
Luna0.100.010.1250.50
Sol20.202.5010
Astra10112.5050

이는 Ofox 견적이나 ChatGPT 메시지 한도가 아닙니다. 입력이 272K를 넘으면 요청 전체의 입력·캐시 단가는 두 배, 출력은 1.5배가 됩니다. 다른 처리 모드와 적용 가능한 추가 비용도 따로 확인해야 합니다.

캐시 없이 일반 입력 20,000, 출력 5,000토큰으로 고정하면 Luna 0.0045달러, Sol 0.09달러, Astra 0.45달러입니다. CSV계산기에 이 예시가 있습니다.

같은 수량의 산술 비교이지 모델이 실제로 같은 토큰을 쓰거나 같은 품질을 낸다는 증거가 아닙니다. 도구, 재시도와 수동 수정 비용은 포함하지 않았습니다.

출력을 보기 전에 평가표 작성하기

빈 검증 기록표에 입력, 허용 작업과 성공 조건을 씁니다. 코드 작업은 시작 commit, 의존성과 테스트 명령을 고정하고 추출 작업은 정답과 예외 기록을 준비합니다.

정확한 모델 ID, 공급자, 엔드포인트, 추론 설정, 도구 권한, 캐시 사용량, 실패와 수동 수정을 남기세요. 모델마다 합리적인 설정이 다를 수 있지만 차이를 공개해야 합니다. 추론 단계의 이름이 같다고 계산량이 같다고 볼 수는 없습니다.

가장 좋은 답변만 골라 평가하지 말고 버린 시도와 끝내지 못한 작업도 포함합니다. 제공하는 표는 모델 점수가 없는 빈 양식이므로 완료된 벤치마크로 취급하면 안 됩니다.

실패와 상위 모델 전환 비용도 고려하기

Luna 결과를 사람이 자주 고쳐야 한다면 낮은 토큰 단가가 가장 싼 작업 비용은 아닐 수 있습니다. 반대로 기계적으로 통과 여부를 판단할 수 있는 단순 작업에 처음부터 최고가 모델이 필요하다고 단정할 수도 없습니다. 두 경우 모두 실제 기록으로 판단합니다.

필드 누락, 테스트 실패나 제약 위반처럼 전환 조건을 미리 정의하고 전환 후 추가 비용을 남기는 방법이 있습니다. 높은 가격이 정답을 보증하지 않고, 한 번의 성공이 모든 작업에 적합하다는 근거도 아닙니다.

연결 조건부터 고정하기

Sol·Luna 이용 가이드, Luna Batch 비용, Responses 이전에서 조건을 확인할 수 있습니다. 도구 연결이 잘못돼 발생한 실패를 모델 능력의 차이로 비교하지 않는 것이 중요합니다.

공식 용도 설명은 후보를 좁히는 근거입니다. 최종 선택에는 반복 가능한 실제 작업, 통과 결과, 전체 비용과 사람의 시간을 사용하세요.

자주 묻는 질문

Sol이 모든 코드 작업에서 Astra보다 적합한가요?
그렇게 단정할 수 없습니다. 일상 작업의 평가 출발점이 될 수 있지만 복잡한 작업도 같은 통과 조건으로 확인해야 합니다.
비용 예시는 모델 실측인가요?
아니요. 입력과 출력을 고정하고 단가 차이만 보여 주는 계산입니다.
이름만 보고 모델을 자동 배정해도 되나요?
작업과 전환 조건을 먼저 정의하고 실제 결과로 검증해야 합니다. 공식 용도는 성공률 보장이 아닙니다.