Skip to content

Gemini Omni Flash Preview

gemini-omni-flash-preview
Google · chat · api
Preview Alert me on changes
Context
131.1K
Max output
65.5K
Input $/1M
Output $/1M
Modalities
text
Released
30 Jun 2026
Download image Share on X Share on LinkedIn
AI summary
● machine-written

Gemini Omni Flash Preview: Google's multimodal preview model

Gemini Omni Flash Preview is a preview-stage model from Google available via API, designed for text-based chat interactions. The model supports a 131.1K token context window and can generate up to 65.5K tokens per response. As a preview release, it may change before stabilization and is subject to more restrictive rate limits.

What's new
  • Preview status with potential for specification changes
  • Text modality support via Gemini API
  • 131.1K input context window capacity
  • 65.5K maximum output tokens per generation
Best for
API-based text chat applicationsTesting multimodal capabilities in preview stageDevelopers evaluating Gemini Omni family models
Sources

Source: https://ai.google.dev/gemini-api/docs/models/gemini-omni-flash-preview