Gemma 4 31B (free)
by Googletext+image+video->text1 endpoint
Overview
Gemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. Features a 256K token context window, configurable thinking/reasoning mode, native function...
Capabilities
Text generation
Image understanding
Video understanding
Tool use / Function calling
Structured output
Extended reasoning
Long context
Top-P sampling
Deterministic seed
Modalities
Input
ImageTextVideo
Output
Text
Technical Specifications
Context Window
262.1K tokens
Max Output
32.8K tokens
Tokenizer
Gemma
Uptime (24h)
9985.1%
Supported Parameters
include_reasoningmax_tokensreasoningresponse_formatseedtemperaturetool_choicetoolstop_p