Flash News

Google AI官方宣布推出Gemini 3.1 Flash-Lite,以极致性价比实现更快更智能的大规模部署

Google AI官方宣布推出Gemini 3.1 Flash-Lite,该模型专注成本效率与可控计算,输入令牌仅0.25美元/百万、输出1.50美元/百万,比更大模型便宜数倍,同时输出速度较Gemini 2.5 Flash提升45%,并引入灵活“思考层级”让开发者根据任务复杂度主动调节模型推理深度。

这一发布迅速引发开发者关注,因为它直接解决AI规模化部署的最大痛点:在保持高智能的前提下大幅压低成本与延迟,同时支持从简单高吞吐任务到复杂UI生成、深度指令跟随的混合负载,相当于把“轻量快模型”与“重推理能力”合二为一,极大降低企业在生产环境跑AI的门槛。

Google官方博客与Gemini API文档确认,3.1 Flash-Lite现已通过Google AI Studio与Vertex AI预览开放,定价与控制机制被视为对OpenAI o1-mini与Claude Haiku的直接竞争升级。

来源:公开信息

AIGoogle

Source

·ABAB News
·
1 min read
·159d ago
分享: