
gemini-3.8-flashGemini 3.8 Flash는 Google이 2026년 9월 2일에 공개한 Flash 모델입니다. APIMODELS에서는 입력 100만 토큰당 $0.450, 출력 $2.250으로 Google 자체 가격($0.75 / $3.75)보다 40% 저렴합니다. 게다가 그 가격은 도입 가격이라 2027년 1월 1일부터 공식가가 $1.50 / $7.50으로 오르고, 그때 격차는 70%까지 벌어집니다. Google은 이 세대를 가장 어려운 추론이 아니라 코딩과 에이전트에 맞춰 조정했다고 분명히 밝혔고 공개 성적도 그 방향입니다. DeepSWE v1.1 1위, Terminal-Bench 2.1 89.4%, 그리고 HLE-Verified(54.9% 대 54.4%), Vals Finance Agent v2(61.4% 대 58.6%), Harvey's Legal Agent(10.0% 대 6.7%) 세 항목에서 Claude Opus 5를 앞섰습니다. 컨텍스트는 100만 토큰, 출력은 최대 64K이고 입력은 텍스트·이미지·오디오·비디오·PDF를 받으며 지식 컷오프는 2026년 3월입니다. 미리 알아둘 실측 기반 단점이 두 가지 있습니다. 첫째, 이 세대는 이전보다 확연히 더 많이 «생각»하고 사고 토큰은 출력 요금으로 과금됩니다. 저희 프로브에서는 두 단어짜리 답을 내는 데 사고 토큰 83개를 썼습니다. 둘째, Artificial Analysis가 측정한 첫 토큰까지의 시간이 약 13.3초로 전체 중앙값 2.99초보다 훨씬 깁니다. 그래서 배치 처리와 장시간 에이전트 실행에는 맞지만 대화형 채팅에는 맞지 않습니다. 짧은 요청에서 가격과 지연이 결정적이라면 Gemini 3.1 Flash Lite($0.375 / $2.25)가 낫습니다. 캐시 입력은 100만 토큰당 $0.172이며 실패한 요청은 과금되지 않습니다.
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Gemini 3.8 Flash은(는) Google의 대규모 언어 모델 API입니다. Gemini 3.8 Flash는 Google이 2026년 9월 2일에 공개한 Flash 모델입니다. APIMODELS에서는 입력 100만 토큰당 $0.450, 출력 $2.250으로 Google 자체 가격($0.75 / $3.75)보다 40% 저렴합니다. 게다가 그 가격은 도입 가격이라 2027년 1월 1일부터 공식가가 $1.50 / $7.50으로 오르고, 그때 격차는 70%까지 벌어집니다. Google은 이 세대를 가장 어려운 추론이 아니라 코딩과 에이전트에 맞춰 조정했다고 분명히 밝혔고 공개 성적도 그 방향입니다. DeepSWE v1.1 1위, Terminal-Bench 2.1 89.4%, 그리고 HLE-Verified(54.9% 대 54.4%), Vals Finance Agent v2(61.4% 대 58.6%), Harvey's Legal Agent(10.0% 대 6.7%) 세 항목에서 Claude Opus 5를 앞섰습니다. 컨텍스트는 100만 토큰, 출력은 최대 64K이고 입력은 텍스트·이미지·오디오·비디오·PDF를 받으며 지식 컷오프는 2026년 3월입니다. 미리 알아둘 실측 기반 단점이 두 가지 있습니다. 첫째, 이 세대는 이전보다 확연히 더 많이 «생각»하고 사고 토큰은 출력 요금으로 과금됩니다. 저희 프로브에서는 두 단어짜리 답을 내는 데 사고 토큰 83개를 썼습니다. 둘째, Artificial Analysis가 측정한 첫 토큰까지의 시간이 약 13.3초로 전체 중앙값 2.99초보다 훨씬 깁니다. 그래서 배치 처리와 장시간 에이전트 실행에는 맞지만 대화형 채팅에는 맞지 않습니다. 짧은 요청에서 가격과 지연이 결정적이라면 Gemini 3.1 Flash Lite($0.375 / $2.25)가 낫습니다. 캐시 입력은 100만 토큰당 $0.172이며 실패한 요청은 과금되지 않습니다. APIMODELS 플랫폼을 거치면 통합 API와 투명한 종량 과금으로 이 모델을 호출할 수 있습니다. 현재 가격: Input: $0.450, Output: $2.250 per 1M tokens.
문의에 자동으로 답하는 대화 시스템을 만들어 응대 효율을 높입니다.
기사와 이메일, 광고 카피 같은 글을 자동으로 써서 작업량을 줄입니다.
코드 작성과 디버깅, 리뷰를 도와 개발 속도를 올립니다.
비정형 데이터를 읽어내 핵심을 뽑고 요약 리포트로 정리합니다.
Gemini 3.8 Flash은(는) APIMODELS를 통해 Input: $0.450, Output: $2.250 per 1M tokens에 이용할 수 있습니다. 과금은 종량제라서 생성한 만큼만 냅니다.
APIMODELS에 가입해 API 키를 받고 통합 엔드포인트를 호출하면 됩니다. cURL / Python / Node.js 예제를 담은 상세 문서를 제공합니다.
APIMODELS는 같은 Gemini 3.8 Flash을(를) 집약 플랫폼을 통해 제공합니다. API 인터페이스가 통합되어 있어 공급자마다 계정을 만들 필요가 없고, 키 하나로 모든 모델에 닿습니다.
입력 100만 토큰당 $0.450, 출력 $2.250으로 Google 자체 가격($0.75 / $3.75)보다 40% 저렴합니다. Google의 그 가격은 도입 가격이라 2027년 1월 1일부터 공식가가 $1.50 / $7.50이 되고 격차는 70%까지 벌어집니다. 캐시 입력은 100만 토큰당 $0.172입니다. 사용한 만큼만 내고 구독이나 최소 충전이 없으며 실패한 요청은 과금되지 않습니다. 100만 토큰 컨텍스트 전체가 동일한 입력 요금입니다.
3.8 Flash는 2026년 9월 2일 나온 최신 모델이고 Google이 코딩과 에이전트에 맞춰 조정했다고 밝혔습니다(DeepSWE v1.1 1위, Terminal-Bench 2.1 89.4%). 여기서는 $0.450 / $2.250으로 3.6 Flash($0.662 / $3.302)보다 약 32% 저렴하니 더 새롭고 더 싼 쪽입니다. 다만 짧은 요청을 대량으로, 그것도 즉시 응답해야 하는 작업이라면 Gemini 3.1 Flash Lite($0.375 / $2.25)가 낫습니다. 입력 단가가 더 싸고 첫 토큰까지가 훨씬 빠릅니다. 3.8 Flash는 그 값이 약 13.3초입니다.
사고 토큰이 출력 요금으로 과금되는데, 이 세대는 이전보다 확연히 더 많이 생각하기 때문입니다. 저희 프로브에서는 두 단어짜리 답을 내는 데 사고 토큰 83개를 썼고 보이는 출력은 1개 토큰뿐이었습니다. Artificial Analysis 측정에서도 벤치마크 전체에서 출력 토큰 1억 2천만 개를 썼는데 중앙값은 7100만 개였습니다. 비용은 usageMetadata의 candidatesTokenCount와 thoughtsTokenCount를 합쳐서 계산하세요. 깊은 추론이 필요 없다면 maxOutputTokens를 낮추거나 3.1 Flash Lite를 쓰는 편이 낫습니다.
APIMODELS에서는 Gemini 3.8 Flash이(가) 60개가 넘는 모델과 같은 API 키, 같은 잔액 위에 나란히 놓입니다. 그래서 선택은 궁합의 문제이지 종속의 문제가 아닙니다. 40% Below Official、Agentic Coding、1M Context、Multimodal Input을(를) 지원하며 다른 대규모 언어 모델 모델과 가격·성능을 나란히 놓고 따져볼 수 있습니다. 갈아타기는 모델 이름 문자열 하나만 바꾸면 되고 새 계정도 추가 작업도 필요 없습니다. 대규모 언어 모델 선택지와 실시간 가격은 apimodels.app/models에서 볼 수 있습니다.
Gemini 3.8 Flash은(는) 다음을 지원합니다: 40% Below Official、Agentic Coding、1M Context、Multimodal Input. 전체 파라미터와 호출 예제는 APIMODELS 문서를 참고하세요.
네. APIMODELS는 Gemini 3.8 Flash을(를) 하나의 통합 API와 키 한 개로 제공합니다. 공급자별 계정도 필요 없고, 각 공급자의 지역별 네트워크 경로를 직접 챙길 필요도 없습니다.
Stripe(Visa, Mastercard 등 해외 카드)와 Alipay를 지원합니다. 결제 후 잔액은 즉시 반영됩니다.