Gemini 3.1 Flash-Lite 发布:低价高速推理模型
指南2026年3月3日3 分钟阅读

Google 推出 Gemini 3.1 Flash-Lite,输入 token 每百万 0.25 美元,输出 1.50 美元,比 2.5 Flash 快 2.5 倍。它支持思考层级调节,适合翻译、内容审核等高吞吐任务。
本文编译自 Gemini 3.1 Flash-Lite: Built for intelligence at scale,版权归原作者所有。
觉得有用?分享给更多人

觉得有用?分享给更多人
直接调用 API 适合需要自定义提示、检索、路由、日志和安全控制的场景;而 Copilot 提供的是围绕软件开发全流程的集成工具链,包括编辑器、仓库、终端和组织策略。BYOK 功能让你保留现有工作流的同时更换模型提供商。
Buzz 由 Block 公司开发,是一个开源、去中心化的团队聊天平台,支持人类和 AI 智能体共同协作。它整合了聊天和 GitHub 项目管理,开发者可以自行定制和部署。目前处于早期阶段,免费桌面版已上线。