Google

Gemini 3.7 Flash (batch)

by Googletext+image+file+audio+video->text1 endpoint

Overview

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step problem solving.

Capabilities

Text generation
Image understanding
Audio processing
Video understanding
Tool use / Function calling
Structured output
Extended reasoning
Prompt caching
Long context
File input
Stop sequences
Deterministic seed

Modalities

Input
TextImageVideoFileAudio
Output
Text

Technical Specifications

Context Window
1.0M tokens
Max Output
65.5K tokens
Tokenizer
Gemini

Supported Parameters

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstool_choicetools

Pricing

Per 1M tokens
Input$0.38
Output$1.88
Cache read$0.04
Cache write$0.04
Audio$0.38
Reasoning$1.88
Image$0.38
Added
August 13, 2026
Last synced 9/18/2026