Google 发布 Gemini 3.6 Flash:Token 效率提升 17%、Agent 默认模型的性价比之战
2026 年 7 月 21 日 Google 发布 Gemini 3.6 Flash,输出 Token 较 3.5 Flash 减少 17%(DeepSWE 基准最高 65%),输出定价 7.5 美元/百万 Token,DeepSWE 从 37% 提升至 49%。同批还有 3.5 Flash-Lite 与 3.5 Flash Cyber。7 月 28 日 Gemini API Managed Agents 默认切换至 3.6 Flash,新增 Environment Hooks、预算控制与免费层级。本文基于官方博客梳理模型能力、基准数据与开发者上手要点。
阅读全文部署文心4.5开源模型给Android设备调用
在上一篇文章《文心4.5开源大模型的使用和部署》已经介绍了如何使用fastdeploy部署文心4.5开源大模型的,并且简单调用了接口,本篇文章来介绍Android如何调用这个部署的接口,并实现对话。
阅读全文文心4.5开源大模型的使用和部署
文心4.5系列开源模型共10款,涵盖了激活参数规模分别为47B 和3B 的混合专家(MoE)模型(最大的模型总参数量为424B),以及0.3B 的稠密参数模型。下面我们就介绍如何快速使用文心4.5模型推理,以及部署接口给Android、微信小程序等客户端调用,注意这里只接受文本类型的模型,实际文心4.5也有多模态的模型。
阅读全文