D’après B.AI, Gemini 3.6 Flash et Gemini 3.5 Flash-Lite sont désormais disponibles sur l’API B.AI à partir du 22 juillet. Gemini 3.6 Flash, une version améliorée de Gemini 3.5 Flash, réduit la consommation de tokens d’environ 17 % en moyenne tout en conservant le même niveau de prix, avec des réductions pouvant atteindre 65 % dans des scénarios complexes comme DeepSWE.
Gemini 3.5 Flash-Lite offre un débit de 350 tokens par seconde et garantit une efficacité des coûts extrême pour les tâches très concurrentes, notamment le traitement par lots de documents et la récupération agentique. Les deux modèles sont désormais disponibles via des endpoints d’API officiels.