De acordo com a B.AI, Gemini 3.6 Flash e Gemini 3.5 Flash-Lite agora estão disponíveis na API da B.AI desde 22 de jul. O Gemini 3.6 Flash, uma versão aprimorada do Gemini 3.5 Flash, reduz o consumo de tokens em aproximadamente 17% em média, mantendo o mesmo preço, com reduções chegando a até 65% em cenários complexos como o DeepSWE.
O Gemini 3.5 Flash-Lite oferece taxa de transferência de 350 tokens por segundo e proporciona máxima eficiência de custo para tarefas com alta concorrência, incluindo processamento em lote de documentos e recuperação agentic. Ambos os modelos agora estão disponíveis por meio de endpoints oficiais de API.