Theo B.AI, Gemini 3.6 Flash và Gemini 3.5 Flash-Lite hiện đã khả dụng trên B.AI API kể từ ngày 22 tháng 7. Gemini 3.6 Flash, phiên bản được nâng cấp từ Gemini 3.5 Flash, giúp giảm mức tiêu thụ token trung bình khoảng 17% trong khi vẫn giữ nguyên mức giá; mức giảm có thể lên tới 65% trong các tình huống phức tạp như DeepSWE.
Gemini 3.5 Flash-Lite cung cấp thông lượng 350 token mỗi giây và mang lại hiệu quả chi phí cực cao cho các tác vụ yêu cầu mức đồng thời cao, bao gồm xử lý theo lô tài liệu và truy xuất mang tính tác nhân. Cả hai mô hình hiện đều có sẵn thông qua các endpoint API chính thức.