Gemini 3.8 Flash 출시: 성능과 가격, 무료로 쓸 수 있나
gemini

Gemini 3.8 Flash 출시: 성능과 가격, 무료로 쓸 수 있나

· 16 min read · Habni

Gemini 3.8 Flash(제미나이 3.8 플래시)가 2026년 9월 2일에 나왔습니다. Flash는 가장 높은 등급인 Pro 아래에서 어려운 문제보다는 많은 일을 저렴하고 빠르게 처리하는 실무용 모델로 알려져 있습니다. 이번 3.8은 3주 전에 나온 3.7 Flash를 다듬은 후속이고, 구글로서는 6주 사이 세 번째 Flash 출시입니다.

이번 발표가 눈길을 끈 이유는 가성비 실무용으로 알려진 이 Flash 등급이 훨씬 비싼 최상위 모델들을 여러 시험에서 따라잡았기 때문입니다. 가격은 3.7과 똑같이 두고 성능만 올렸으니, 3.7을 쓰던 사람에게는 같은 값에 더 나은 모델이 생긴 셈입니다.

다만 공식 성적표를 끝까지 읽으면 그림이 조금 달라집니다. 크게 이긴 시험이 있는가 하면 절반에도 못 미친 시험이 있어서, 어느 줄을 보느냐에 따라 평가가 뒤집힙니다. 발표 제목만 보고 갈아타기 전에 확인할 것이 남아 있다는 뜻입니다.

이 글에서는 2026년 9월 기준으로 Gemini의 등급 체계부터 성능과 가격, 무료 이용 조건까지 차례로 확인하고, 마지막에 3.7에서 실제로 바꿀 만한지 판단해 보겠습니다.

Gemini 3.8 Flash

구글이 3.7 Flash를 다듬어 내놓은 범용 AI 모델입니다. 긴 코딩 작업과 여러 단계를 거치는 자동화, 복잡한 분석을 낮은 비용으로 처리하도록 만들어졌습니다.

제미나이 등급 정리: 가장 똑똑한 Pro, 실속형 Flash

구글의 공식 모델 목록은 Gemini를 세 등급으로 나눕니다. 깊은 추론이 필요한 복잡한 작업은 가장 똑똑한 Pro가, 응답 속도와 처리량이 중요한 일은 가격 대비 성능이 가장 좋은 Flash가, 그보다 단순한 처리는 더 싸고 가벼운 Flash-Lite가 맡습니다.

성능 계단은 Pro, Flash, Flash-Lite 순서입니다
성능Pro깊은 추론, 복잡한 작업최신 3.1Flash많은 일을 싸고 빠르게최신 3.8Flash-Lite가장 싸고 가벼움

번호를 읽을 때는 한 가지만 주의하면 됩니다. Flash는 3.8까지 나왔지만 2026년 9월 3일 기준 목록의 최신 Pro는 Gemini 3.1 Pro입니다. 두 등급은 번호를 따로 매기기 때문에 숫자가 크다고 더 높은 등급이 아닙니다. 3.8 Flash는 3.1 Pro보다 나중에 나온 모델일 뿐, 더 똑똑한 모델은 아닙니다. 참고로 2026년 9월 4일 기준 3.1 Pro에는 아직 Preview 딱지가 붙어 있고 3.8 Flash는 정식(Stable) 상태입니다.

3.8 Flash 성능 향상: 코딩과 에이전트 작업

구글 공식 발표가 내세운 개선점은 셋입니다. 소프트웨어 작업, 여러 단계를 거치는 에이전트 작업, 복잡한 지식 업무가 3.7보다 좋아졌습니다. 공식 모델 카드가 확인해 주는 대로 새 계열이 아니라 3.7의 개선판입니다.

기본 사양은 이렇습니다. 모델 ID는 gemini-3.8-flash이고, 한 번에 100만 토큰을 입력받아 최대 6만 4천 토큰을 출력합니다. 텍스트 외에 이미지와 오디오, 비디오도 넣을 수 있어서 긴 문서를 통째로 읽히거나 화면 녹화와 음성을 같이 분석시키는 것도 가능합니다.

지식의 기준일은 2026년 3월입니다. 다만 모델 카드에는 분야에 따라 2025년 1월까지의 지식에 머물 수 있다는 단서가 붙어 있으니, 최신 정보가 중요한 질문에는 검색 결과나 자료를 함께 주는 편이 좋습니다. 답변에 들일 작업량을 조절하는 effort 설정도 그대로 지원합니다.

같은 발표에 실린 보안 특화 모델 Gemini 3.8 Flash Cyber는 쓸 수 있는 사람이 완전히 달라서 뒤에서 따로 다루겠습니다.

가격은 3.7 그대로, API 무료 티어 있음

Gemini API 가격 페이지에는 3.8 Flash와 3.7 Flash가 같은 단가로 올라 있습니다. 성능을 올리면서 토큰당 가격은 그대로 둔 것입니다.

기간입력출력
2026년 12월 31일까지$0.75 / 100만 토큰$3.75 / 100만 토큰
2027년 1월 1일부터$1.50 / 100만 토큰$7.50 / 100만 토큰

Gemini API에는 무료 등급도 있습니다. 2026년 9월 3일 기준으로 입력과 출력이 모두 무료이고, 생각하는 데 쓴 토큰까지 출력에 포함해 무료입니다. 물론 무료 등급에는 분당 요청 수와 분당 토큰 수, 하루 요청 수 한도가 걸립니다. 정확한 숫자는 로그인한 계정의 AI Studio 요금 한도 화면에서 볼 수 있으니, 반복 호출이 많은 자동화를 무료 등급으로 돌릴 계획이라면 이 한도부터 확인해 두는 편이 안전합니다. 또 하나, 가격 페이지에 따르면 무료 등급에서는 프롬프트와 응답이 구글의 제품 개선에 쓰일 수 있고 유료 등급은 그렇지 않습니다. 고객 자료처럼 민감한 내용을 다룬다면 무료 등급에 올리기 전에 이 조건부터 따져야 합니다.

한 가지 짚어 둘 것은 단가가 같아도 청구액은 달라질 수 있다는 점입니다. 공식 자료에 따르면 3.8 Flash는 복잡한 작업에서 추론 단계를 더 거치고 도구도 더 자주 호출합니다. 높은 effort에서는 그만큼 토큰을 더 씁니다. 그래서 가격표가 아니라 작업당 실제 토큰 소모를 재 봐야 하고, 단순한 작업이라면 낮은 effort로도 충분한지 먼저 확인하는 것이 좋습니다.

작업마다 체감이 다릅니다: 이기는 시험과 지는 시험

공식 모델 카드에는 Terminal-bench라는 시험이 두 버전으로 실려 있습니다. 이름이 같아서 같은 시험처럼 보이지만 결과는 정반대입니다.

공식 벤치마크3.8 Flash3.7 FlashOpus 5Sonnet 5GPT-5.6 SolGPT-5.6 Terra
Terminal-bench 2.189.4%85.8%89.1%80.4%88.8%87.4%
Terminal-bench 4.019.1%11.2%51.8%12.4%37.3%23.6%

위 표에서 2.1 줄만 보면 3.8 Flash가 Claude Opus 5(클로드 오퍼스 5)를 근소하게 앞섭니다. 이 줄만 떼어 오면 「Flash가 Opus를 이겼다」는 기사 제목이 됩니다. 그런데 4.0 줄에서는 반대로 Opus 5가 약 2.7배 앞섭니다.

왜 이런 일이 생기냐면 채점 방식이 다르기 때문입니다. 평가 방법론 문서에 따르면 2.1은 모든 모델에게 같은 도구를 주고 재는 시험이고, 4.0은 모델마다 가장 잘 나온 설정의 점수를 모은 시험입니다. 이름이 같아도 사실상 다른 시험입니다. 구글이 숨긴 것도 아니고 두 줄을 같은 표에 나란히 공개했으니, 읽는 쪽이 어느 줄을 보고 있는지만 확인하면 됩니다.

나머지 시험들도 마찬가지로 이기는 쪽과 지는 쪽이 갈립니다. 자세한 수치는 아래 표에 있고, 같은 줄 안에서 모델끼리만 비교하면 됩니다. 가격 두 줄은 낮을수록, 나머지는 높을수록 좋습니다.

항목3.8 Flash3.7 FlashOpus 5GPT-5.6 Sol
도입 입력가 ($/100만 토큰)0.750.755.004.00
도입 출력가 ($/100만 토큰)3.753.7525.0020.00
DeepSWE v1.173.765.374.072.7
GDPVal-AA v2 (Elo)1545148218241710
Vals Finance Agent v261.459.058.653.8
Harvey's Legal Agent10.08.86.72.5
GDP.PDF35.034.037.040.0
CharXiv Reasoning86.284.583.785.8
LVBench87.885.475.482.1
HLE-Verified54.953.654.454.5
OSWorld-2.059.050.675.462.6
BioMysteryBench(쉬운 문제)88.887.190.179.5
BioMysteryBench(어려운 문제)56.543.549.444.7
LABBench286.282.184.282.1

표를 한 줄로 요약하면 이렇습니다. 코딩과 차트, 긴 영상에서는 7분의 1 가격으로 최상위 모델과 대등하거나 더 낫고, 컴퓨터 화면 조작과 폭넓은 지식 업무에서는 Opus 5가 여전히 크게 앞섭니다.

조금만 풀면, 긴 코딩 작업(DeepSWE)은 3.7보다 크게 올라 Opus 5와 사실상 같은 점수가 됐고 차트 읽기와 긴 영상 이해는 비교 대상 가운데 가장 높습니다. 다만 긴 영상(LVBench) 줄은 모델마다 측정 조건이 같게 표시돼 있지 않아 참고로만 보는 편이 좋습니다. 지는 쪽에서는 화면 조작(OSWorld)과 지식 업무(GDPVal)의 간격이 크고, 전문 PDF 읽기는 3.7에서 거의 늘지 않았습니다. 값에 비해 잘하는 모델인 것은 맞지만, 모든 작업에서 앞서는 모델은 아닙니다.

반응: 성능에는 호평, 교체 속도에는 우려

출시 직후 반응은 뜨거웠습니다. 2026년 9월 3일 기준 Hacker News(해외 개발자 커뮤니티)의 출시 소식 글에는 추천 1,058점에 댓글 598개가 달렸고, 레딧의 Gemini 게시판에서는 벤치마크 정리 글이 추천 275개를 받았습니다. 실시간 게시판이라 수치는 보는 시점마다 다르고, 아래 내용은 사용자들의 의견이지 공식 검증이 아닙니다.

호평의 중심은 「실속형 등급에서 이 점수가 나왔다」는 놀라움이었습니다. 레딧에서는 3.8 Flash가 사실상 상위 등급 Pro에 견줄 만하다는 글이 추천 112개를 받았고, 그 아래에 타입스크립트 작업에서 넉 달 전 3.1 Pro가 냈던 오류를 3.8 Flash가 쉽게 고쳤다는 후기가 달렸습니다. 직접 써 보니 3.7보다 훨씬 유능하게 느껴진다는 반응도 이어졌습니다.

회의적인 쪽은 실사용 경험을 근거로 들었습니다. 1시간 45분짜리 회의 녹음을 중간에 잘라먹고 전사를 거부했다는 후기, 긴 보고서나 계산처럼 무거운 추론은 못 버틴다는 지적, 번역은 오히려 3.1 Pro보다 못하다는 비교가 나왔습니다. Hacker News에서도 토큰이 많이 드는 코딩에서는 Claude나 GPT-5.6 Sol만큼 나오지 않아 프롬프트를 더 줘야 했다는 후기가 나왔습니다. 벤치마크 자체를 향한 의심도 있었습니다. Terminal-bench 4.0의 낙폭을 두고 「벤치마크에 맞춰 훈련한 모델 아니냐」는 댓글이 여럿 달렸고, 「4.0은 이전 판이 거의 풀려서 더 어렵게 만든 시험」이라는 반론이 붙었습니다. 앞 절에서 본 두 시험의 갈림을 커뮤니티도 그대로 짚고 있는 셈입니다.

한국 스레드(Threads)에서도 온도차가 보였습니다. Gemini 앱이 현재 모델을 3.8 Flash라고 답하는 화면과 함께 적용 소식을 전한 글이 올라온 한편, 조회 3만이 넘은 부정 후기에는 「매 버전 하는 거짓말」이라는 댓글과 함께 발표 점수와 체감의 간극을 꼬집는 반응이 모였습니다.

교체 속도를 걱정하는 반응도 있었습니다. 6주에 세 번이면 팀이 도입을 검토하기도 전에 다음 버전이 나온다는 것입니다. 다만 쓰던 모델이 바로 사라지지는 않습니다. 2026년 9월 3일 기준 3.5 Flash와 3.6 Flash가 여전히 Stable 상태이고, 지원이 끝난 것은 2.0 계열과 Preview 딱지가 붙어 있던 모델들뿐입니다. 발표문도 계산 비용이 중요하면 3.7 Flash를 계속 써도 된다고 적었습니다. 주의할 쪽은 오히려 Antigravity 같은 도구입니다. API의 모델은 남아도 도구의 선택 목록은 더 빨리 바뀌기 때문에, 자동화가 걸려 있다면 내가 어느 쪽에 의존하는지 구분해 둘 필요가 있습니다.

이용 조건: 앱은 Pro와 Ultra 구독, API는 무료 등급도

공식 발표와 모델 카드가 밝힌 이용 경로를 한 표로 모으면 이렇습니다.

용도이용 경로
일반 사용 (Google AI Pro 또는 Ultra 구독자)Gemini 앱, Google 검색 AI Mode, Google Sheets
개발과 제작Google AI Studio, Gemini API, Antigravity(안티그래비티), Android Studio, Stitch
기업Gemini Enterprise Agent Platform

표에서 주의할 곳은 첫 줄입니다. 우리가 평소에 쓰는 Gemini 앱과 Google 검색의 AI Mode(검색 결과에 AI가 답을 정리해 주는 기능), Google Sheets에서 3.8 Flash를 쓰려면 세 경로 모두 Google AI Pro 또는 Ultra 구독이 필요합니다. 무료로 쓰는 길은 앞에서 본 개발자용 API 무료 등급 쪽입니다. 한국 계정에 언제 보일지는 자료에 나오지 않으니 실제 노출 여부는 각 서비스 화면에서 확인하면 됩니다.

모델 카드는 약점도 함께 적어 뒀습니다. 없는 사실을 지어낼 수 있고, 가끔 느려지거나 응답이 끊기며, 탈옥(jailbreak)을 막는 능력도 아직 손보는 중입니다. 오래 걸리는 자동화에 넣기 전에 작은 작업으로 먼저 돌려 보라는 신호로 읽으면 됩니다.

Cyber 버전은 일반 사용자용이 아닙니다

이름 때문에 3.8 Flash의 보안 강화판으로 오해하기 쉽지만, Gemini 3.8 Flash Cyber는 아예 다른 사람들을 위한 모델입니다. 정부 기관과 주요 기반시설 운영자, 소프트웨어 유지보수자를 대상으로 하는 Fairwind Program 참가자만 쓸 수 있고, 개인 사용자는 대부분 해당하지 않습니다. 가격도 공개되지 않았습니다.

성능은 취약점을 찾고 고치는 일에 몰려 있습니다. 공식 발표에 따르면 20개 프로그래밍 언어의 실제 취약점 발견 평가에서 성공률 70%를 넘겼고, 자동 패치를 재는 CWE-Bench에서는 한 번에 통과한 비율이 47.2%로 최상위 모델의 47.8%에 거의 붙었습니다. Chrome(크롬) 보안팀은 최고 상용 모델보다 올바른 패치를 2.6배 더 만들었다고 밝혔고, 보안 회사 Wiz는 취약점을 찾아내는 비율이 7.5%에서 9.7% 높으면서 비용은 2.3배에서 5.2배 낮았다고 전했습니다.

왜 이렇게 막아 뒀을까요. 일반 3.8 Flash에는 화학과 생물, 방사능, 핵(CBRN) 무기와 사이버 공격 악용을 막는 안전장치가 들어가는데, Cyber는 보안 작업을 깊게 할 수 있도록 그 장치를 일부 풀었습니다. 취약점을 잘 찾는 능력은 그대로 공격에도 쓸 수 있는 능력입니다. 그래서 믿을 수 있는 방어자에게만 여는 것입니다.

한편 두 모델 모두 프롬프트 인젝션을 막는 능력이 Gray Swan 평가에서 크게 올랐습니다. 프롬프트 인젝션은 외부 문서나 웹페이지에 숨겨 둔 지시가 원래 명령을 밀어내는 공격으로, 에이전트가 파일과 웹을 읽으며 오래 일할수록 노출이 커지는 위험입니다.

저라면: 3.7 쓰던 작업부터 3.8로 시험합니다

저라면 새 작업에는 3.7보다 3.8 Flash를 먼저 시험하겠습니다. API 단가가 같은데 코딩과 차트, 긴 영상, 전문가 추론의 성적이 올랐으니, 이미 3.7을 쓰고 있다면 같은 비용으로 더 나은 결과가 나오는지 바로 확인할 수 있기 때문입니다.

그렇다고 모든 작업을 한꺼번에 바꾸지는 않겠습니다. 컴퓨터 화면을 조작하는 일과 폭넓은 에이전트 작업에서는 Opus 5가 크게 앞선다는 공식 수치가 있습니다. 중요한 자동화라면 대표 작업 하나를 골라 같은 입력, 같은 effort, 같은 도구로 두 모델에 맡겨 보고 성공 여부와 토큰 소모를 비교한 뒤에 옮기는 것이 맞습니다.

반대로 전문 PDF를 주로 읽힌다면 서두를 이유가 없습니다. 3.7에서 거의 오르지 않았고 GPT-5.6 Sol이 더 높습니다. 무료로 시작하려는 분도 순서는 같습니다. API 무료 등급에서 내 자료로 짧게 돌려 보고, 결과가 맞으면 범위를 넓히면 됩니다. 결국 발표의 승패가 아니라 내 일에서의 성공률과 토큰 소모, 그리고 안 끊기는지로 고르는 것입니다.

30초 요약
  • Flash는 Pro 아래 등급입니다. 값이 싸고 빠른 대신 어려운 추론은 Pro가 낫습니다. 번호는 따로 매기므로 3.8 Flash가 3.1 Pro보다 위가 아닙니다.
  • 가격은 3.7과 같고 Gemini API에는 무료 등급이 있습니다. 다만 소비자용 앱은 Google AI Pro나 Ultra 구독이 필요합니다.
  • Terminal-bench 2.1에서는 3.8 Flash가 Opus 5보다 높지만 4.0에서는 Opus 5가 약 2.7배입니다. 채점 조건이 달라서입니다.
  • 코딩과 차트, 긴 영상에서는 값에 비해 강하고 컴퓨터 조작과 지식 업무 전반에서는 Opus 5가 앞섭니다.
  • Cyber 버전은 Fairwind Program 참가자만 씁니다. 일반 사용자는 3.8 Flash를 보면 됩니다.

자주 묻는 질문

Gemini 3.8 Flash를 무료로 쓸 수 있나요?

이용 경로에 따라 다릅니다. 가장 많이 쓰는 소비자용 Gemini 앱, Google 검색 AI Mode, Google Sheets에서는 3.8 Flash를 쓰려면 Google AI Pro 또는 Ultra 구독이 필요해 무료가 아닙니다. 반면 개발자용 Gemini API에는 무료 티어가 있어 2026년 9월 3일 기준 입력과 출력이 무료이고 출력에는 생각하는 데 쓴 토큰도 포함됩니다. API 무료 등급도 분당과 일일 요청 수 제한이 모델과 등급마다 다르게 걸려 있어 정확한 한도는 로그인한 계정의 AI Studio 화면에서 확인해야 합니다.

제미나이 플래시와 프로는 뭐가 다른가요?

공식 모델 목록은 Flash를 응답이 빠르고 처리량이 많은 작업에서 가격 대비 성능이 가장 좋은 등급으로, Pro를 깊은 추론이 필요한 복잡한 작업용 상위 등급으로 설명합니다. 주의할 점은 번호입니다. 2026년 9월 3일 기준 목록에 있는 최신 Pro는 Gemini 3.1 Pro이고 Flash는 3.8까지 나왔습니다. 번호가 크다고 상위 등급은 아닙니다.

Gemini 3.7 Flash에서 갈아탈 만한가요?

같은 API 가격에 코딩과 여러 에이전트 평가가 올랐으므로 새 작업에서는 시험할 만합니다. 다만 전문 PDF 점수는 거의 그대로이고 높은 effort에서는 토큰을 더 쓸 수 있으니 대표 작업으로 먼저 비교하는 편이 좋습니다.

Gemini 3.8 Flash는 어디서 쓸 수 있나요?

Gemini 앱, Google 검색 AI Mode, Google Sheets는 Google AI Pro 또는 Ultra 구독자 대상으로 제공됩니다. 개발자용으로는 Google AI Studio, Gemini API, Antigravity, Android Studio, Stitch가 있고 기업은 Gemini Enterprise Agent Platform에서 씁니다.

Sources (11)펼쳐서 전체 출처 보기
#Gemini 3.8 Flash#제미나이 3.8#제미나이 플래시#제미나이 플래시 프로 차이#Gemini 3.8 Flash 가격#Gemini 3.8 Flash 성능#제미나이 무료#Gemini API

Related Posts