根據 B.AI,Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 目前已在 B.AI API 上線,時間為 7 月 22 日。Gemini 3.6 Flash 為 Gemini 3.5 Flash 的升級版本,平均可將代幣消耗降低約 17%,同時維持相同定價;在像 DeepSWE 這類複雜情境下,降幅最高可達 65%。
Gemini 3.5 Flash-Lite 的吞吐量為每秒 350 個代幣,並為高併發任務(包含文件批次處理與 agentic retrieval)提供極致的成本效益。兩款模型現已透過官方 API 端點提供。