Gemini 3.7 Flash (batch)
by Googletext+image+file+audio+video->text1 endpoint
Overview
Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step problem solving.
Capabilities
Text generation
Image understanding
Audio processing
Video understanding
Tool use / Function calling
Structured output
Extended reasoning
Prompt caching
Long context
File input
Stop sequences
Deterministic seed
Modalities
Input
TextImageVideoFileAudio
Output
Text
Technical Specifications
Context Window
1.0M tokens
Max Output
65.5K tokens
Tokenizer
Gemini
Supported Parameters
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstool_choicetools
Pricing
Per 1M tokens
Input$0.38
Output$1.88
Cache read$0.04
Cache write$0.04
Audio$0.38
Reasoning$1.88
Image$0.38
Added
August 13, 2026
Last synced 9/18/2026