O Gemini 2.5 Flash Lite é o integrante leve da família Gemini 2.5 do Google, lançado em 2025-07-22 e ajustado para latência ultrabaixa e eficiência de custo. Ele melhora a taxa de processamento e a velocidade de geração de tokens em relação aos modelos Flash anteriores, com o raciocínio de múltiplas passagens desativado por padrão para manter as respostas rápidas. Oferece entrada de imagens e PDF, chamada de funções e cache de prompts. A $0.10/M tokens de entrada e $0.40/M tokens de saída, é uma das opções mais baratas para classificação, extração e roteamento em grande volume. Janela de contexto: 1M tokens, saída: 64K. Disponível pelos protocolos OpenAI e Gemini.
Providers
/v1/chat/completionsExemplos de Código
from google import genaiclient = genai.Client(api_key="YOUR_OFOX_API_KEY",http_options={"api_version": "v1beta", "base_url": "https://api.ofox.ai/gemini"},)response = client.models.generate_content(model="google/gemini-2.5-flash-lite",contents="Hello!",)print(response.text)
Disponibilidade e status
Benchmarks
Google: Gemini 2.5 Flash Lite obtém 1380 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 151º de 374 modelos com base em 47.185 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1380 | 1376–1383 | 151º de 374 | 47.185 |
| Prompts difíceis | 1390 | 1386–1395 | 158º de 374 | 25.046 |
| Programação | 1397 | 1391–1404 | 175º de 369 | 9.675 |
| Matemática | 1364 | 1353–1375 | 164º de 362 | 2.867 |
| Escrita criativa | 1361 | 1353–1369 | 134º de 372 | 6.502 |
| Seguimento de instruções | 1365 | 1360–1371 | 156º de 374 | 12.894 |
| Chinês | 1407 | 1394–1420 | 143º de 344 | 2.167 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.