[태그:] AI 에이전트

  • 제미나이 3.7 플래시 가격·사용법 총정리, 3.6과 무엇이 달라졌나

    제미나이 3.7 플래시 가격·사용법 총정리, 3.6과 무엇이 달라졌나

    구글은 2026년 8월 13일(미국 현지시간) Gemini 3.7 Flash를 정식 출시(GA) 했습니다. 한국 공식 블로그 발표일은 8월 14일입니다. 개발자는 Google AI Studio와 Gemini API에서 바로 사용할 수 있고, Gemini Spark에는 Google AI Pro·Ultra 구독자를 대상으로 3.7 Flash가 적용됩니다.

    가격부터 보면 조금 주의할 부분이 있습니다. Gemini API 무료 티어에서는 3.7 Flash의 입력·출력 토큰 비용이 무료이고, 유료 티어는 2026년 12월 31일까지 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러입니다. 2027년 1월 1일부터는 각각 1.50달러와 7.50달러로 올라갑니다.

    그리고 가장 헷갈리기 쉬운 부분이 하나 있습니다.

    현재 3.7 Flash가 3.6 Flash보다 API 단가가 더 싼 것은 아닙니다. 구글이 3.7 출시 프로모션 단가를 기존 3.6 Flash에도 동일하게 적용했기 때문에 2026년 말까지 두 모델의 현재 공식 단가는 같습니다. 차이는 가격보다는 코딩·에이전트·웹 개발 성능에 있습니다.

    제미나이 3.7 플래시 핵심만 먼저 보기

    항목2026년 8월 14일 기준
    정식 출시2026년 8월 13일 미국 현지시간
    모델 IDgemini-3.7-flash
    무료 사용Gemini API 무료 티어 지원
    유료 API 입력 가격100만 토큰당 $0.75, 2026년 12월 31일까지
    유료 API 출력 가격100만 토큰당 $3.75, 2026년 12월 31일까지
    2027년 입력 가격100만 토큰당 $1.50
    2027년 출력 가격100만 토큰당 $7.50
    입력 컨텍스트최대 1,048,576 토큰
    최대 출력65,536 토큰
    주요 입력텍스트·이미지·영상·오디오·PDF
    출력텍스트
    주요 용도코딩, AI 에이전트, 업무 자동화, 복잡한 멀티스텝 작업
    AI Studio사용 가능
    Gemini API사용 가능
    Gemini SparkPro·Ultra 구독자에게 적용

    모델 사양과 배포 경로는 Google AI for Developers와 Google DeepMind의 공식 모델 카드에서 확인할 수 있습니다.

    제미나이 3.7 플래시 가격은 얼마인가

    Gemini API 무료 티어

    개발자가 테스트하거나 소규모 프로젝트를 시작하는 경우 Google AI Studio와 Gemini API의 무료 티어를 이용할 수 있습니다. 3.7 Flash 가격표에는 무료 티어의 입력·출력이 모두 무료로 표시돼 있습니다. 다만 무료 티어는 모델 접근 범위와 사용량 제한이 존재하므로 실제 호출 한도는 자신의 프로젝트에서 확인하는 것이 안전합니다.

    Gemini API 유료 티어

    구분2026년 12월 31일까지2027년 1월 1일부터
    입력 100만 토큰$0.75$1.50
    출력 100만 토큰$3.75$7.50
    Batch 입력 100만 토큰$0.375$0.75
    Batch 출력 100만 토큰$1.875$3.75

    표준 API 외에도 Batch와 Flex 요금제가 제공되며, Batch·Flex는 일반 Standard보다 낮은 단가가 적용됩니다. 공식 가격표는 서비스별 조건이 바뀔 수 있으므로 실제 운영 비용을 계산할 때는 최신 Gemini Developer API 가격표를 다시 확인해야 합니다.

    3.6 Flash와 현재 가격은 같다

    3.7 Flash 발표 당시에는 이전 3.6 Flash의 기존 가격과 비교해 상당히 저렴해졌다는 보도가 많았습니다. Reuters도 출시 단가를 3.6 Flash의 기존 가격 대비 절반 수준이라고 설명했습니다.

    하지만 구글은 동시에 새 프로모션 가격을 3.6 Flash에도 적용했습니다. 따라서 지금 모델을 새로 선택하는 개발자라면 단순히 “3.7이 더 싸니까 바꾼다”기보다는 성능과 호환성을 기준으로 판단하는 편이 맞습니다.

    제미나이 3.7 플래시 사용법

    사용 목적에 따라 가장 쉬운 방법이 다릅니다.

    사용 목적추천 경로특징
    모델을 직접 테스트Google AI Studio별도 앱 개발 없이 프롬프트 테스트
    프로그램·서비스 개발Gemini API앱·웹·자동화 서비스에 모델 연결
    개인용 AI 에이전트Gemini SparkGoogle AI Pro·Ultra 구독자 대상
    기업용 AI 구축Gemini Enterprise 계열기업 워크플로우와 에이전트 구축
    에이전트 개발Antigravity 등복잡한 개발·에이전트 작업

    Google DeepMind는 3.7 Flash의 공식 배포 경로로 Gemini App의 Spark, Gemini Enterprise App, Gemini Enterprise Agent Platform, Google AI Studio, Gemini API, Google Antigravity를 명시하고 있습니다.

    방법 1. Google AI Studio에서 사용하기

    가장 간단한 개발자용 체험 방법입니다.

    1. Google AI Studio에 접속합니다.
    2. Google 계정으로 로그인합니다.
    3. 사용할 모델에서 Gemini 3.7 Flash를 선택합니다.
    4. 텍스트나 파일을 입력해 결과를 테스트합니다.
    5. 실제 애플리케이션에 연결하려면 Gemini API용 프로젝트와 키를 준비합니다.

    공식 모델 페이지에는 3.7 Flash를 AI Studio에서 바로 시험할 수 있는 경로가 제공됩니다.

    방법 2. Gemini API에서 사용하기

    개발 환경에서는 모델 ID를 다음과 같이 사용합니다.

    gemini-3.7-flash

    Google의 공식 Quickstart에서도 Python·JavaScript·REST 요청 모두 이 모델 ID를 사용합니다. 3.7 Flash는 이미 GA 상태이므로 단순한 프리뷰 모델이 아니라 프로덕션용으로 사용할 수 있는 정식 모델입니다.

    방법 3. Gemini Spark에서 사용하기

    일반 소비자 입장에서는 이 부분을 구분해야 합니다.

    구글이 이번 발표에서 명시한 Gemini 앱 측 3.7 Flash 적용 대상은 Gemini Spark입니다. Spark는 Google AI Pro 및 Ultra 구독자에게 제공되는 개인용 AI 에이전트이며, 3.7 Flash 적용으로 Google Workspace 도구 사용과 복잡한 여러 단계 업무의 정확도를 개선했다고 구글은 설명합니다.

    따라서 “일반 Gemini 채팅 화면에서 모든 사용자가 3.7 Flash를 직접 모델로 선택할 수 있다”는 의미로 해석하면 안 됩니다. 개발자는 AI Studio/API, 개인용 에이전트 이용자는 Spark처럼 사용 경로를 나눠서 보는 것이 정확합니다.

    제미나이 3.7 플래시와 3.6 플래시 차이

    3.7 Flash는 완전히 별개의 계열이 아니라 Gemini 3.6 Flash를 기반으로 개선한 모델입니다. Google DeepMind 모델 카드에도 3.7 Flash가 3.6 Flash를 기반으로 만들어졌다고 명시돼 있습니다.

    주요 차이 비교

    비교 항목Gemini 3.6 FlashGemini 3.7 Flash
    기반이전 Flash 세대3.6 Flash 기반 개선
    컨텍스트약 100만 토큰약 100만 토큰
    주요 변화효율·코딩·멀티모달 개선코딩·에이전트·웹 개발·업무 자동화 추가 개선
    FrontierCode 1.134.4%43.6%
    DeepSWE v1.148.6%65.3%
    Web/Code ArenaElo 1,538Elo 1,588
    AutomationBench17.0%30.4%
    GDP.pdf22.0%34.0%
    현재 Standard API 가격$0.75 / $3.75$0.75 / $3.75

    위 벤치마크는 Google DeepMind가 공개한 평가 결과이므로 실제 사용 환경의 성능과 동일하다고 단정할 수는 없습니다. 다만 코딩·장기 소프트웨어 작업·업무 자동화 관련 여러 평가에서 3.7이 3.6보다 높은 수치를 기록한 것은 일관적입니다.

    독립 평가기관 Artificial Analysis에서도 high reasoning 설정 기준 3.7 Flash의 Intelligence Index는 56, 3.6 Flash는 52로 평가됐습니다. 3.7 Flash의 측정 출력 속도는 초당 약 340토큰으로 나타났습니다.

    연합뉴스도 Artificial Analysis 자료를 인용해 3.7 Flash의 빠른 출력 속도와 가격 경쟁력을 보도하면서, 동시에 종합 지능 성능에서는 최상위 모델과 차이가 있다는 점을 짚었습니다.

    즉 3.7 Flash는 “무조건 최고 성능 모델”이라기보다 빠른 속도와 비교적 낮은 비용을 유지하면서 코딩·에이전트 성능을 끌어올린 실무형 모델에 가깝습니다.

    노트북에서 AI 모델과 API를 활용해 코딩 작업을 진행하는 개발 환경을 표현한 이미지
    노트북에서 AI 모델과 API를 활용해 코딩 작업을 진행하는 개발 환경을 표현한 이미지

    3.7 Flash에서 달라진 기능

    코딩과 디버깅

    구글은 3.7 Flash가 디버깅, 이슈 해결, 실제 실행 가능한 코드 생성에서 3.6보다 개선됐다고 설명합니다. 특히 여러 단계의 수정과 재시도가 필요한 에이전트형 코딩 환경을 주요 적용 분야로 제시했습니다.

    웹 개발

    스크린샷이나 디자인 시스템을 참고해 웹 인터페이스를 구현하는 작업도 개선 대상으로 강조됐습니다. Google의 WebDev 계열 평가에서도 3.7 Flash가 3.6보다 높은 점수를 기록했습니다.

    복잡한 업무 자동화

    업무 문서를 읽고 여러 도구를 연결해 단계적으로 처리하는 에이전트 작업 역시 핵심 개선 영역입니다. Google은 AutomationBench에서 3.7 Flash가 30.4%, 3.6 Flash가 17.0%를 기록했다고 밝혔습니다.

    멀티모달 입력

    3.7 Flash는 텍스트뿐 아니라 이미지·비디오·오디오·PDF를 입력으로 받을 수 있습니다. 최대 입력 컨텍스트는 1,048,576토큰, 최대 출력은 65,536토큰입니다. 출력 형식 자체는 텍스트입니다.

    Thinking Level

    3.7 Flash에서는 low, medium, high 세 단계의 thinking level을 지원하며 기본값은 medium입니다. 3.6 Flash에서 사용할 수 있었던 minimal을 3.7 Flash에 지정하면 오류가 발생한다는 점도 마이그레이션할 때 확인해야 합니다.

    3.6에서 3.7로 바꾸는 것이 좋은 경우

    다음에 해당한다면 3.7을 먼저 테스트할 이유가 있습니다.

    • 코드 생성이나 버그 수정 비중이 높다.
    • AI 에이전트가 여러 단계의 작업을 연속 수행한다.
    • 웹 UI·프론트엔드 생성 작업이 많다.
    • PDF나 복잡한 업무 문서를 처리한다.
    • 3.6에서 반복적인 재시도나 도구 호출 실패가 비용을 늘리고 있다.
    • 현재 동일한 프로모션 단가라면 더 새 모델을 검증해 보고 싶다.

    반대로 단순 분류·요약처럼 성능 요구가 낮은 대량 작업에서는 Flash-Lite 계열을 포함해 더 저렴한 모델과 비교할 필요가 있습니다. 3.7이 모든 작업에서 가장 경제적이라는 의미는 아닙니다. Google도 별도의 고처리량·저비용 모델로 Flash-Lite 계열을 제공하고 있습니다.

    지금 확인할 체크리스트

    • 단순 체험이라면 AI Studio에서 먼저 테스트한다.
    • API 무료 티어와 유료 티어를 혼동하지 않는다.
    • 유료 API 프로모션 가격 종료일이 2026년 12월 31일임을 확인한다.
    • 2027년부터 입력·출력 가격이 각각 두 배로 바뀌는 점을 비용 계획에 반영한다.
    • 3.6과 현재 API 가격이 동일하다는 점을 확인한다.
    • 3.6에서 이전한다면 minimal thinking 설정 사용 여부를 확인한다.
    • 실제 업무 데이터로 3.6과 3.7의 품질·지연시간·토큰 사용량을 직접 비교한다.

    FAQ

    제미나이 3.7 플래시는 무료인가요?

    Gemini API에는 무료 티어가 있습니다. 공식 가격표에서 3.7 Flash의 무료 티어 입력·출력은 무료로 표시됩니다. 다만 무료 티어에는 사용량과 기능 제한이 있으므로 실제 프로젝트의 할당량을 확인해야 합니다.

    제미나이 3.7 플래시 API 가격은 얼마인가요?

    2026년 12월 31일까지 Standard 유료 티어 기준으로 입력 100만 토큰당 0.75달러, 출력 100만 토큰당 3.75달러입니다. 2027년 1월 1일부터 각각 1.50달러와 7.50달러가 적용됩니다.

    3.7 Flash가 3.6 Flash보다 더 저렴한가요?

    현재는 아닙니다. 구글이 3.7 Flash의 출시 프로모션 단가를 3.6 Flash에도 동일하게 적용했기 때문에 2026년 말까지 공식 Standard 단가는 같습니다.

    제미나이 3.7 플래시는 어디에서 사용할 수 있나요?

    개발자는 Google AI Studio와 Gemini API에서 사용할 수 있습니다. 공식 모델 카드에는 Gemini App의 Spark, Gemini Enterprise 계열, AI Studio, Gemini API, Antigravity 등이 배포 경로로 명시돼 있습니다.

    3.6 Flash에서 바로 바꿔도 되나요?

    API 모델 ID를 gemini-3.7-flash로 변경해 테스트할 수 있지만, 프로덕션 환경에서는 먼저 회귀 테스트를 하는 편이 좋습니다. 특히 3.7은 minimal thinking level을 지원하지 않으므로 3.6에서 해당 설정을 사용했다면 수정이 필요합니다.

    출처 및 참고자료

    1. Google Korea Blog, 「제미나이 3.7 플래시를 소개합니다」, 2026-08-14
      https://blog.google/intl/ko-kr/company-news/technology/introducing-gemini-3-7-flash-kr/
    2. Google AI for Developers, 「Gemini 3.7 Flash」, 2026-08-13 업데이트
      https://ai.google.dev/gemini-api/docs/models/gemini-3.7-flash
    3. Google AI for Developers, 「Gemini Developer API pricing」, 2026-08-14 확인
      https://ai.google.dev/gemini-api/docs/pricing
    4. Google DeepMind, 「Gemini 3.7 Flash – Model Card」, 2026-08-13
      https://deepmind.google/models/model-cards/gemini-3-7-flash/
    5. Reuters, 「Google unveils Gemini 3.7 Flash AI model for coding, agent workflows」, 2026-08-13
      https://www.reuters.com/business/google-unveils-gemini-37-flash-ai-model-coding-agent-workflows-2026-08-13/
    6. Artificial Analysis, 「Gemini 3.7 Flash – Intelligence, Performance & Price Analysis」, 2026-08-13 평가 확인
      https://artificialanalysis.ai/models/gemini-3-7-flash
    7. 연합뉴스, 「또 경량 AI만 내놓은 구글…최상위모델 지연에 그록에도 밀려」, 2026-08-14
      https://www.yna.co.kr/view/AKR20260814027300091