Según B.AI, Gemini 3.6 Flash y Gemini 3.5 Flash-Lite ya están disponibles en la API de B.AI desde el 22 de julio. Gemini 3.6 Flash, una versión mejorada de Gemini 3.5 Flash, reduce el consumo de tokens en aproximadamente un 17% de media manteniendo el mismo precio, con reducciones de hasta el 65% en escenarios complejos como DeepSWE.
Gemini 3.5 Flash-Lite ofrece un rendimiento de 350 tokens por segundo y una eficiencia de costes extrema para tareas de alta concurrencia, incluidas la gestión por lotes de documentos y la recuperación agentica. Ambos modelos ya están disponibles mediante endpoints oficiales de API.