# Google models

Canonical HTML page: [Google models](<https://impossibl.com/google>)
Markdown alternative: [Google models as Markdown](<https://impossibl.com/google.md>)

Access 13 models from Google through the Impossibl API, including Gemini 2.5 Flash, Gemini 2.5 Flash-Lite, and Gemini 2.5 Pro. Compare API pricing, context windows, and capabilities.

Select two or three models to [compare specifications and API costs](<https://impossibl.com/compare.md>). Model types and billing units are not interchangeable.

## Models

### [Gemini 2.5 Flash](<https://impossibl.com/google/gemini-2.5-flash>)

Gemini 2.5 Flash is a text generation model from Google, available through the Impossibl API. Its published context window is 1,000,000 tokens. The advertised input rate is $0.30 per million input tokens. The advertised output rate is $2.50 per million output tokens.

- API identifier: `google/gemini-2.5-flash`
- Creator: Google; model type: Text generation.
- Context window: 1,000,000 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.30 per million input tokens; $2.50 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-2.5-flash.md>)

### [Gemini 2.5 Flash-Lite](<https://impossibl.com/google/gemini-2.5-flash-lite>)

Gemini 2.5 Flash-Lite is a text generation model from Google, available through the Impossibl API. Its published context window is 1,000,000 tokens. The advertised input rate is $0.10 per million input tokens. The advertised output rate is $0.40 per million output tokens.

- API identifier: `google/gemini-2.5-flash-lite`
- Creator: Google; model type: Text generation.
- Context window: 1,000,000 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.10 per million input tokens; $0.40 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-2.5-flash-lite.md>)

### [Gemini 2.5 Pro](<https://impossibl.com/google/gemini-2.5-pro>)

Gemini 2.5 Pro is a text generation model from Google, available through the Impossibl API. Its published context window is 1,000,000 tokens. The advertised input rate is $1.25 per million input tokens. The advertised output rate is $10.00 per million output tokens. Additional pricing brackets apply when the input exceeds a published context threshold.

- API identifier: `google/gemini-2.5-pro`
- Creator: Google; model type: Text generation.
- Context window: 1,000,000 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $1.25 per million input tokens; $10.00 per million output tokens. Above 200,000 input tokens per request, context-tier rates apply to the whole request.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-2.5-pro.md>)

### [Gemini 3.1 Flash-Lite](<https://impossibl.com/google/gemini-3.1-flash-lite>)

Gemini 3.1 Flash-Lite is a text generation model from Google, available through the Impossibl API. Its published context window is 1,000,000 tokens. The advertised input rate is $0.25 per million input tokens. The advertised output rate is $1.50 per million output tokens.

- API identifier: `google/gemini-3.1-flash-lite`
- Creator: Google; model type: Text generation.
- Context window: 1,000,000 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.25 per million input tokens; $1.50 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.1-flash-lite.md>)

### [Gemini 3.1 Flash TTS (preview)](<https://impossibl.com/google/gemini-3.1-flash-tts-preview>)

Gemini 3.1 Flash TTS (preview) is a text-to-speech model from Google, available through the Impossibl API. The advertised input rate is $1.00 per million input tokens. The advertised output rate is $20.00 per million output tokens.

- API identifier: `google/gemini-3.1-flash-tts-preview`
- Creator: Google; model type: Text to speech.
- Context window: Not published; tool calling: Not published.
- Inputs: text; outputs: audio.
- Base API pricing (USD): $1.00 per million input tokens; $20.00 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.1-flash-tts-preview.md>)

### [Gemini 3.1 Pro (preview)](<https://impossibl.com/google/gemini-3.1-pro-preview>)

Gemini 3.1 Pro Preview is a Google model for complex reasoning, software development, and agents that carry out tasks across multiple steps. It updates Gemini 3 Pro with an emphasis on reliable tool use and factual consistency. Its published context window is 1,000,000 tokens. The advertised input rate is $2.00 per million input tokens. The advertised output rate is $12.00 per million output tokens. Additional pricing brackets apply when the input exceeds a published context threshold.

- API identifier: `google/gemini-3.1-pro-preview`
- Creator: Google; model type: Text generation.
- Context window: 1,000,000 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $2.00 per million input tokens; $12.00 per million output tokens. Above 200,000 input tokens per request, context-tier rates apply to the whole request.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.1-pro-preview.md>)

### [Gemini 3.5 Flash](<https://impossibl.com/google/gemini-3.5-flash>)

Gemini 3.5 Flash is a text generation model from Google, available through the Impossibl API. Its published context window is 1,000,000 tokens. The advertised input rate is $1.50 per million input tokens. The advertised output rate is $9.00 per million output tokens.

- API identifier: `google/gemini-3.5-flash`
- Creator: Google; model type: Text generation.
- Context window: 1,000,000 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $1.50 per million input tokens; $9.00 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.5-flash.md>)

### [Gemini 3.5 Flash-Lite](<https://impossibl.com/google/gemini-3.5-flash-lite>)

Gemini 3.5 Flash-Lite is a text generation model from Google, available through the Impossibl API. Its published context window is 1,048,576 tokens. The advertised input rate is $0.30 per million input tokens. The advertised output rate is $2.50 per million output tokens.

- API identifier: `google/gemini-3.5-flash-lite`
- Creator: Google; model type: Text generation.
- Context window: 1,048,576 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.30 per million input tokens; $2.50 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.5-flash-lite.md>)

### [Gemini 3.6 Flash](<https://impossibl.com/google/gemini-3.6-flash>)

Gemini 3.6 Flash is a text generation model from Google, available through the Impossibl API. Its published context window is 1,048,576 tokens. The advertised input rate is $0.75 per million input tokens. The advertised output rate is $3.75 per million output tokens.

- API identifier: `google/gemini-3.6-flash`
- Creator: Google; model type: Text generation.
- Context window: 1,048,576 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.75 per million input tokens; $3.75 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.6-flash.md>)

### [Gemini 3.7 Flash](<https://impossibl.com/google/gemini-3.7-flash>)

Gemini 3.7 Flash is a text generation model from Google, available through the Impossibl API. Its published context window is 1,048,576 tokens. The advertised input rate is $0.75 per million input tokens. The advertised output rate is $3.75 per million output tokens.

- API identifier: `google/gemini-3.7-flash`
- Creator: Google; model type: Text generation.
- Context window: 1,048,576 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.75 per million input tokens; $3.75 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.7-flash.md>)

### [Gemini 3.8 Flash](<https://impossibl.com/google/gemini-3.8-flash>)

Gemini 3.8 Flash is a Google reasoning model designed for software engineering, extended agent tasks, and business workflows. It builds on Gemini 3.7 Flash with stronger reasoning across tasks that require multiple steps. Its published context window is 1,048,576 tokens. The advertised input rate is $0.75 per million input tokens. The advertised output rate is $3.75 per million output tokens.

- API identifier: `google/gemini-3.8-flash`
- Creator: Google; model type: Text generation.
- Context window: 1,048,576 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $0.75 per million input tokens; $3.75 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-3.8-flash.md>)

### [Gemini Robotics-ER 2 Preview](<https://impossibl.com/google/gemini-robotics-er-2-preview>)

Gemini Robotics-ER 2 Preview is a text generation model from Google, available through the Impossibl API. Its published context window is 131,072 tokens. The advertised input rate is $2.00 per million input tokens. The advertised output rate is $10.00 per million output tokens.

- API identifier: `google/gemini-robotics-er-2-preview`
- Creator: Google; model type: Text generation.
- Context window: 131,072 tokens; tool calling: Not published.
- Inputs: text, image, audio, video; outputs: text.
- Base API pricing (USD): $2.00 per million input tokens; $10.00 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemini-robotics-er-2-preview.md>)

### [Gemma 4 31B](<https://impossibl.com/google/gemma-4-31b>)

Gemma 4 31B is a text generation model from Google, available through the Impossibl API. Its published context window is 128,000 tokens. The advertised input rate is $0.99 per million input tokens. The advertised output rate is $1.49 per million output tokens.

- API identifier: `google/gemma-4-31b`
- Creator: Google; model type: Text generation.
- Context window: 128,000 tokens; tool calling: Not published.
- Inputs: text, image; outputs: text.
- Base API pricing (USD): $0.99 per million input tokens; $1.49 per million output tokens.
- [Complete model facts, cache rates, context tiers, and FAQs as Markdown](<https://impossibl.com/google/gemma-4-31b.md>)

## Compare Google models

- [Gemini 2.5 Flash vs Gemini 2.5 Flash-Lite](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-2.5-flash-lite>); [Markdown comparison](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-2.5-flash-lite.md>)
- [Gemini 2.5 Flash vs Gemini 2.5 Pro](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-2.5-pro>); [Markdown comparison](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-2.5-pro.md>)
- [Gemini 2.5 Flash vs Gemini 3.1 Flash-Lite](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.1-flash-lite>); [Markdown comparison](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.1-flash-lite.md>)
- [Gemini 2.5 Flash vs Gemini 3.1 Pro (preview)](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.1-pro-preview>); [Markdown comparison](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.1-pro-preview.md>)
- [Gemini 2.5 Flash vs Gemini 3.5 Flash](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.5-flash>); [Markdown comparison](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.5-flash.md>)
- [Gemini 2.5 Flash vs Gemini 3.5 Flash-Lite](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.5-flash-lite>); [Markdown comparison](<https://impossibl.com/compare/google/gemini-2.5-flash/google/gemini-3.5-flash-lite.md>)

## Frequently asked questions

### Which Google models are available through Impossibl?

The directory lists 13 models from Google available through the Impossibl API, including Gemini 2.5 Flash, Gemini 2.5 Flash-Lite, and Gemini 2.5 Pro. Open each model page for its API identifier, capabilities, and current pricing.

### How much do Google models cost?

Google model prices vary by model and usage. All rates below are published base API rates in USD. For token-priced models, published input rates start at $0.10 per million input tokens. Published output rates start at $0.40 per million output tokens. Input and output minima may refer to different models. Long-context tiers can change prices for the whole request; check each model's thresholds and rates. Individual model pages include published cache prices and billing units. Applicable fees and workspace-specific pricing can affect the amount paid.

### What context windows do Google models support?

Among Google models with a published limit on Impossibl, the largest context window is 1,048,576 tokens, listed for Gemini 3.5 Flash-Lite, Gemini 3.6 Flash, and Gemini 3.7 Flash. Context limits vary by model and are separate from maximum output limits. Context windows are unpublished for 1 model.

### What inputs and capabilities do Google models support?

Available model types include text generation and text to speech. Published input support includes audio, image, text, and video; support varies by model. Tool-calling support is unspecified for 13 models.

### How do I use Google models through an API?

Use the exact model identifier from the model page with the Impossibl API. For example, select google/gemini-2.5-flash with /v1/chat/completions. Endpoint compatibility depends on the selected model. The API quickstart explains how to create an API key and send a request.

## Sources and related links

Prices, capabilities, limits, and availability describe the public Impossibl API offering. An unpublished fact is unknown; a published zero price is zero. Compare matching billing units and check context tiers before estimating costs.

- [Public Impossibl model catalog](<https://api.impossibl.com/v1/models>)
- [Full model directory as JSON](<https://impossibl.com/models.json>)
- [Model directory as Markdown](<https://impossibl.com/models.md>)
- [API quickstart](<https://impossibl.com/docs/agent-quickstart>)
- [Model documentation](<https://impossibl.com/docs/models>)
