본문으로 건너뛰기
AI 구독·도구 요금과 사용법

오픈AI 모델 고르기 — 아래에서 올라가는 순서 (2026년 8월)

오픈AI API에는 같은 세대 안에서도 여러 모델이 있고, 요율이 20배까지 차이 납니다. 무조건 제일 좋은 것을 쓰면 요금이 20배가 되고, 무조건 싼 것을 쓰면 결과가 안 나옵니다.

이 글은 작업 종류별로 어느 모델부터 시험할지를 정리합니다.

이 글의 요금·조건은 2026년 8월 25일에 각 서비스 공식 페이지에서 확인한 값입니다. 이후 변경됐을 수 있습니다.

요율 차이를 먼저 봅니다

모델 입력(100만 토큰) 출력(100만 토큰) luna 대비
gpt-5.6-sol $4.00 $20.00 약 17~20배
gpt-5.6-terra $2.00 $12.00 약 10배
gpt-5.6-luna $0.20 $1.20 기준

이 배수가 이 글의 핵심입니다. 같은 작업을 luna로 처리할 수 있다면 요금이 17분의 1이 됩니다.

고르는 순서: 위에서 내려오지 말고 아래에서 올라간다

흔한 실수는 가장 좋은 모델로 시작해서 계속 그것만 쓰는 것입니다. 반대로 하시길 권합니다.

  1. 가장 싼 모델로 먼저 해 봅니다. 결과가 쓸 만하면 거기서 끝입니다.
  2. 안 되면 무엇이 안 되는지 적습니다. “형식을 안 지킨다”, “긴 문서에서 놓친다”처럼 구체적으로.
  3. 한 단계만 올립니다. 바로 최상위로 가지 말고 중간 모델에서 해결되는지 봅니다.
  4. 비싼 모델이 꼭 필요한 부분만 남깁니다. 전체를 올리는 대신 그 단계만 올립니다.

작업 종류별 출발점

가벼운 모델로 충분한 경우가 많은 작업

  • 분류·태깅 — 정해진 범주 중 하나를 고르는 작업
  • 형식 변환 — 표를 목록으로, 목록을 문장으로 바꾸는 작업
  • 추출 — 문서에서 날짜·이름·금액 같은 항목을 뽑는 작업
  • 1차 요약 — 긴 문서를 일단 줄여 두는 작업

이런 작업은 정답의 폭이 좁습니다. 모델이 창의적일 필요가 없어 가벼운 모델로도 결과가 크게 다르지 않은 경우가 많습니다.

상위 모델을 검토할 만한 작업

  • 여러 단계를 스스로 밟아야 하는 작업 — 조건을 따져 가며 판단이 이어지는 경우
  • 긴 문서 전체를 놓고 앞뒤를 연결해야 하는 작업
  • 미묘한 뉘앙스가 결과를 가르는 작업 — 번역의 어조, 카피의 결
  • 정확도가 곧 비용인 작업 — 틀리면 사람이 다시 확인해야 하는 경우

마지막 항목이 판단의 핵심입니다. 모델 요금보다 사람이 고치는 시간이 비싸다면 상위 모델이 결과적으로 쌉니다.

두 모델을 섞는 방법

실전에서 가장 효과가 큰 방식은 단계를 나누는 것입니다.

예를 들어 긴 문서 100건에서 특정 정보를 찾아 보고서를 쓰는 작업이라면:

  • 1단계 — luna로 100건을 훑어 관련 있는 문서만 골라냅니다. 입력이 아무리 많아도 $0.20 요율입니다.
  • 2단계 — 걸러진 몇 건만 sol에 넘겨 정밀하게 처리합니다.

전부 sol로 처리하는 것과 비교하면 1단계에서 처리량의 대부분이 20분의 1 요율로 소화됩니다. 긴 컨텍스트 요율까지 감안하면 차이는 더 벌어집니다.

이 글이 성능을 비교하지 않는 이유

확인 범위

오퍼코드는 모델별 성능 순위를 적지 않습니다. 저희가 동일 조건에서 여러 모델을 시험한 측정 기록이 없기 때문입니다.
위 분류는 요율 구조에서 도출한 판단 순서이지 성능 측정 결과가 아닙니다. “어느 모델이 더 똑똑한가”는 작업마다 다르고, 확인하지 않은 순위를 적으면 독자가 그것으로 선택하게 됩니다.
가장 정확한 방법은 자기 작업으로 직접 비교해 보는 것입니다. 같은 입력을 두 모델에 넣고 결과를 보시면 됩니다. 시험 비용은 대체로 적습니다.

자주 묻는 질문

싼 모델로 시작하면 결과가 나쁘지 않나요?

작업에 따라 다릅니다. 분류나 추출처럼 정답 폭이 좁은 작업은 차이가 작은 경우가 많습니다. 실제로 해 보고 판단하시는 것이 확실합니다.

모델을 바꾸면 코드를 많이 고쳐야 하나요?

대체로 모델 이름만 바꾸면 됩니다. 그래서 비교 시험의 비용이 낮습니다.

긴 컨텍스트에서도 배수가 같나요?

긴 컨텍스트는 요율이 별도이며 대체로 입력이 2배입니다. 모델 간 배수 자체는 비슷하게 유지됩니다.

출력이 비싼데 어떻게 줄이나요?

답변 길이를 지시하는 것이 가장 즉효입니다. 출력 요율이 입력의 5~6배이므로 효과가 큽니다.