[태그:] AI API 가격

  • Grok 4.6 API 가격, 20만 토큰 넘으면 얼마? 4.5와 실제 비용 비교

    Grok 4.6 API 가격, 20만 토큰 넘으면 얼마? 4.5와 실제 비용 비교

    Grok 4.6 API 가격에서 가장 먼저 확인할 숫자는 입력 100만 토큰당 2달러, 캐시 입력 0.50달러, 출력 6달러​입니다. 하지만 긴 문서나 대규모 코드베이스를 넣는다면 이 숫자만 보고 비용을 계산하면 안 됩니다.

    Grok 4.6은 프롬프트가 200,000토큰에 도달하는 순간 장문 컨텍스트 요금​이 적용됩니다. 장문 구간에서는 입력 4달러, 캐시 입력 1달러, 출력 12달러로 각각 두 배가 됩니다. 더 중요한 점은 20만 토큰을 초과한 부분에만 추가 요금을 붙이는 방식이 아니라, 해당 요청 전체 토큰에 장문 단가를 적용한다는 것입니다.

    따라서 19만9천 토큰과 20만 토큰 요청은 프롬프트 길이가 1천 토큰밖에 차이 나지 않더라도 실제 청구액에는 상당한 차이가 생길 수 있습니다.

    Grok 4.6 API 가격표

    SpaceXAI가 2026년 8월 12일 공개한 Grok 4.6은 500K 토큰 컨텍스트를 지원합니다. 공식 API 가격표는 다음과 같습니다.

    구분200K 미만 프롬프트200K 이상 프롬프트
    입력 100만 토큰$2.00$4.00
    캐시 입력 100만 토큰$0.50$1.00
    출력 100만 토큰$6.00$12.00
    최대 컨텍스트500K500K
    요금 적용 방식일반 요율요청 전체에 장문 요율

    여기서 기준은 최종 출력량이 아니라 프롬프트 토큰 수입니다. 공식 가격 문서에는 장문 가격 기준을 ≥ 200k tokens로 표시하고 있으며, 장문 임계값에 도달하면 요청의 모든 토큰에 장문 요율이 청구된다고 설명합니다.

    199K와 200K 요청은 실제 얼마가 달라질까

    출력이 10,000토큰 발생한다고 가정해 보겠습니다. 캐시는 사용하지 않는 단순 예시입니다.

    프롬프트 199K + 출력 10K

    입력 비용:

    0.199 × $2 = $0.398

    출력 비용:

    0.010 × $6 = $0.060

    총액은 약 $0.458입니다.

    프롬프트 200K + 출력 10K

    200K부터는 장문 요율을 적용합니다.

    입력 비용:

    0.200 × $4 = $0.800

    출력 비용:

    0.010 × $12 = $0.120

    총액은 약 $0.920입니다.

    요청 예시입력 비용출력 비용합계
    199K 입력 + 10K 출력$0.398$0.060$0.458
    200K 입력 + 10K 출력$0.800$0.120$0.920

    프롬프트가 1,000토큰 늘었을 뿐인데 이 예에서는 요청 비용이 약 두 배가 됩니다. 이유는 200K 이후에 추가된 1,000토큰만 비싸지는 것이 아니라 요청 전체가 장문 가격 구간으로 넘어가기 때문입니다.

    실제 사용에서는 시스템 프롬프트, 대화 이력, 검색 결과, 도구 반환값 등이 함께 프롬프트 토큰에 포함될 수 있으므로 애플리케이션 화면에서 보이는 원문 길이만으로 임계값을 판단하면 오차가 생길 수 있습니다.

    250K라면 비용은 어떻게 계산할까

    250K 입력과 10K 출력을 한 번 호출한다고 가정하면 이미 200K 임계값을 넘었으므로 장문 요율을 적용합니다.

    • 입력: 0.25 × $4 = $1.00
    • 출력: 0.01 × $12 = $0.12
    • 합계: $1.12

    같은 비율의 요청을 1,000번 처리하면 단순 토큰 비용만 약 $1,120입니다.

    API를 장기간 운영한다면 모델의 ‘100만 토큰당 가격’만 비교하기보다 평균 프롬프트가 200K를 넘는 비율을 먼저 측정하는 편이 비용 예측에 유용합니다.

    캐시를 쓰면 얼마나 달라질까

    Grok 4.6의 캐시 입력은 일반 구간에서 100만 토큰당 $0.50입니다. 동일한 대규모 컨텍스트가 반복되는 워크로드라면 일반 입력 가격 $2보다 낮기 때문에 비용을 줄일 수 있습니다. 200K 이상 장문 구간에서는 캐시 입력도 $1로 두 배가 됩니다.

    예를 들어 총 199K 프롬프트 중 150K가 캐시되고 나머지 49K만 일반 입력으로 처리되며 출력이 10K라고 가정하면:

    • 캐시 입력 150K: 0.15 × $0.50 = $0.075
    • 일반 입력 49K: 0.049 × $2 = $0.098
    • 출력 10K: 0.01 × $6 = $0.060
    • 합계: 약 $0.233

    그러나 총 프롬프트가 200K가 되면 장문 요율이 적용됩니다. 예를 들어 150K 캐시 + 50K 일반 입력 + 10K 출력이라면:

    • 캐시 입력: 0.15 × $1 = $0.15
    • 일반 입력: 0.05 × $4 = $0.20
    • 출력: 0.01 × $12 = $0.12
    • 합계: 약 $0.47

    캐시를 사용하더라도 200K 임계값 자체가 없어지는 것은 아닙니다.

    Grok 4.6과 Grok 4.5 가격 차이

    Grok 4.6으로 바꿀 때 의외로 놓치기 쉬운 부분이 캐시 가격입니다.

    공식 가격표 기준으로 Grok 4.5와 Grok 4.6의 기본 입력·출력 가격은 같습니다. 두 모델 모두 일반 컨텍스트에서는 입력 $2, 출력 $6이며 200K 이상에서는 $4와 $12가 적용됩니다. 다만 캐시 입력 가격은 Grok 4.6이 더 높습니다.

    항목Grok 4.5Grok 4.6
    일반 입력 / 1M$2.00$2.00
    일반 캐시 / 1M$0.30$0.50
    일반 출력 / 1M$6.00$6.00
    200K+ 입력 / 1M$4.00$4.00
    200K+ 캐시 / 1M$0.60$1.00
    200K+ 출력 / 1M$12.00$12.00
    컨텍스트500K500K

    따라서 캐시 입력 비중이 매우 높은 서비스는 “4.6의 기본 가격이 4.5와 같다”는 설명만 보고 곧바로 교체하면 실제 비용 구조가 달라질 수 있습니다.

    Artificial Analysis도 Grok 4.6의 헤드라인 입력·출력 가격은 Grok 4.5와 동일하지만, 캐시 가격은 4.5의 $0.30에서 4.6의 $0.50으로 올랐다고 분석했습니다.

    그렇다면 Grok 4.5에서 4.6으로 바꿀 만할까

    가격만 놓고 보면 모든 사용자에게 같은 답이 나오지는 않습니다.

    SpaceXAI는 Grok 4.6을 장시간 지속되는 에이전트 작업, 코딩, 지식 업무 등에 초점을 맞춰 개발했다고 설명했습니다. 공개 벤치마크에서는 Artificial Analysis Intelligence Index가 Grok 4.5의 56에서 Grok 4.6의 61로 상승했습니다.

    독립 평가기관 Artificial Analysis 자체 평가에서도 4.6은 Intelligence Index 61점을 기록했고, 4.5보다 5점 상승했다고 보고했습니다. 동시에 실제 평가 과정의 비용과 토큰 효율을 함께 비교해야 한다고 분석합니다.

    따라서 다음처럼 나눠 보는 편이 현실적입니다.

    사용 패턴판단 포인트
    짧은 일반 질의가 대부분4.5와 4.6의 입력·출력 기본 단가는 동일
    복잡한 코딩·에이전트 업무4.6 성능 향상을 테스트할 가치가 큼
    캐시 입력 비중이 매우 높음4.6의 높은 캐시 단가를 반드시 비교
    프롬프트가 자주 200K 근처까지 증가장문 요금 진입 빈도를 먼저 측정
    300K~500K 대규모 컨텍스트 사용기본 가격보다 장문 단가를 기준으로 예산 계산

    특히 기존 시스템에서 평균 프롬프트가 180K~210K 사이를 오간다면 모델 교체 전에 실제 로그를 확인하는 것이 좋습니다. 200K 경계를 얼마나 자주 넘는지에 따라 단순 가격표로 예상한 비용과 실제 청구 구조가 크게 달라질 수 있기 때문입니다.

    Grok 4.6 비용을 줄이려면 확인할 5가지

    API 운영 전에는 다음 항목부터 점검하면 됩니다.

    1. 평균 프롬프트 토큰 수
      평균뿐 아니라 90·95·99백분위에서 200K를 넘는지 확인합니다.
    2. 대화 이력을 무조건 누적하고 있는지
      오래된 메시지를 계속 붙이면 실제 사용자 입력은 짧아도 전체 프롬프트가 장문 구간으로 넘어갈 수 있습니다.
    3. 반복되는 컨텍스트의 캐시 활용 가능 여부
      동일한 시스템 지침이나 대규모 자료를 반복 전송한다면 캐시 비용을 별도로 계산합니다.
    4. 불필요한 검색·도구 결과가 쌓이는지
      에이전트 워크플로에서는 여러 단계의 결과가 누적돼 프롬프트가 빠르게 커질 수 있습니다.
    5. 요청당 비용보다 성공 작업당 비용을 비교하는지
      더 비싼 한 번의 요청이 재시도 횟수를 줄인다면 전체 업무 비용은 오히려 줄 수 있습니다. 모델 변경 테스트에서는 호출 한 건 가격과 함께 작업 완료율·반복 호출 횟수도 기록하는 편이 좋습니다.
    Grok 4.6 API 가격과 20만 토큰 장문 컨텍스트 비용 차이를 표현한 AI 서버 일러스트
    Grok 4.6 API 가격과 20만 토큰 장문 컨텍스트 비용 차이를 표현한 AI 서버 일러스트

    성능 숫자도 가격과 함께 봐야 한다

    Grok 4.6은 출시 직후 Artificial Analysis Intelligence Index에서 61점을 기록했습니다. 독립 평가에서는 Grok 4.5보다 5점 높은 결과가 확인됐고, 장기 에이전트형 지식 업무에서도 경쟁력이 있다는 평가가 나왔습니다.

    다만 벤치마크 점수가 높다고 해서 모든 서비스에서 비용 대비 성능이 자동으로 좋아지는 것은 아닙니다. Artificial Analysis 측정에서는 Grok 4.6이 초당 약 65.5개의 출력 토큰을 생성했으며, 평가 대상 같은 가격대 모델 가운데 속도는 평균보다 다소 낮은 편으로 측정됐습니다.

    결국 API 선택에서는 세 가지를 따로 봐야 합니다.

    모델 성능, 실제 토큰 사용량, 작업 완료까지 필요한 호출 횟수​입니다.

    핵심 요약

    Grok 4.6 API 가격은 일반적인 짧은 프롬프트라면 입력 $2, 캐시 $0.50, 출력 $6/100만 토큰입니다. 하지만 200K 토큰부터는 각각 $4, $1, $12로 바뀌며 요청 전체에 장문 요율이 적용​됩니다.

    따라서 20만 토큰 전후의 대규모 문서 분석이나 코딩 에이전트를 운영한다면 “100만 입력 토큰당 2달러”만 기억해서는 정확한 비용을 계산하기 어렵습니다.

    Grok 4.5에서 4.6으로 교체하려는 경우에는 입력·출력 기본 가격은 같지만 캐시 가격이 $0.30→$0.50으로 상승했다는 점도 함께 확인해야 합니다. 반대로 복잡한 에이전트 업무에서 4.6의 향상된 성능이 재시도와 작업 단계를 줄인다면 토큰당 단가만으로는 실제 비용 효과를 판단하기 어렵습니다.

    FAQ

    Grok 4.6 API는 20만 토큰을 초과한 부분만 비싸지나요?

    아닙니다. 공식 가격 문서는 프롬프트가 200K 장문 컨텍스트 임계값에 도달하면 해당 요청의 모든 토큰에 장문 요율을 적용한다고 명시합니다.

    정확히 200,000토큰도 장문 가격인가요?

    네. 현재 공식 가격표는 장문 컨텍스트를 200K 이상(≥ 200k)​으로 정의합니다.

    Grok 4.6의 최대 컨텍스트는 얼마인가요?

    현재 API 문서 기준 500K 토큰입니다. 텍스트와 이미지 입력을 지원하고 출력은 텍스트입니다.

    Grok 4.5와 Grok 4.6의 기본 API 가격은 다른가요?

    일반 입력과 출력 가격은 둘 다 각각 $2와 $6/100만 토큰으로 같습니다. 다만 캐시 입력은 Grok 4.5가 $0.30, Grok 4.6이 $0.50으로 다릅니다. 장문 구간 캐시도 각각 $0.60과 $1입니다.

    Grok 4.6이 무조건 Grok 4.5보다 비용 효율적인가요?

    그렇게 단정할 수 없습니다. 독립 벤치마크에서는 성능 향상이 확인됐지만 실제 비용은 프롬프트 길이, 캐시 비율, 출력량, 재시도 횟수, 작업 종류에 따라 달라집니다. 특히 캐시 비중이 높은 시스템에서는 4.6의 캐시 단가 상승을 함께 계산해야 합니다.

    출처 및 참고자료

    1. SpaceXAI — Pricing, 2026-08-14 확인. Grok 4.6의 200K 장문 임계값과 일반·장문 입력/캐시/출력 가격을 확인한 공식 자료.
    2. SpaceXAI — Release Notes: Grok 4.6, 2026-08-12. API 제공 상태, 500K 컨텍스트 및 가격 구조를 확인한 공식 자료.
    3. SpaceXAI — Introducing Grok 4.6, 2026-08-12. 출시 시점과 모델 목적, 공식 벤치마크 및 API 제공 내용을 확인한 발표 자료.
    4. Artificial Analysis — Grok 4.6 Benchmarks and Analysis, 2026-08-12. Grok 4.5 대비 성능, 가격 및 캐시 가격 차이를 확인한 독립 평가.
    5. Artificial Analysis — Grok 4.6 Model Analysis, 2026-08-14 확인. 성능·속도·컨텍스트·가격 측정치를 확인한 독립 모델 평가.
    6. MarketWatch — SpaceX’s stock is getting a Grok-fueled boost, 2026-08-12. 출시 시점과 독립 평가 결과를 교차 확인한 보도.