Google 發佈 Gemini 3.6 Flash:Token 效率提升 17%、Agent 默認模型的性價比之戰
2026 年 7 月 21 日 Google 發佈 Gemini 3.6 Flash,輸出 Token 較 3.5 Flash 減少 17%(DeepSWE 基準最高 65%),輸出定價 7.5 美元/百萬 Token,DeepSWE 從 37% 提升至 49%。同批還有 3.5 Flash-Lite 與 3.5 Flash Cyber。7 月 28 日 Gemini API Managed Agents 默認切換至 3.6 Flash,新增 Environment Hooks、預算控制與免費層級。本文基於官方博客梳理模型能力、基準數據與開發者上手要點。
閱讀全文部署文心4.5開源模型給Android設備調用
在上一篇文章《文心4.5開源大模型的使用和部署》已經介紹瞭如何使用fastdeploy部署文心4.5開源大模型的,並且簡單調用了接口,本篇文章來介紹Android如何調用這個部署的接口,並實現對話。
閱讀全文文心4.5開源大模型的使用和部署
文心4.5系列開源模型共10款,涵蓋了激活參數規模分別爲47B 和3B 的混合專家(MoE)模型(最大的模型總參數量爲424B),以及0.3B 的稠密參數模型。下面我們就介紹如何快速使用文心4.5模型推理,以及部署接口給Android、微信小程序等客戶端調用,注意這裏只接受文本類型的模型,實際文心4.5也有多模態的模型。
閱讀全文