Gemini 2.5 Flash Lite
Google

Gemini 2.5 Flash Lite

作者:天智算力編輯部|更新日期:2026-06-24

API 調用單價

輸入 (USD / 百萬 Token)$0.10
輸出 (USD / 百萬 Token)$0.40
本幣折算 (CNY)0.69 / 2.76

上下文窗口規格

1百萬 Token

最大輸入長度折合約 786K 繁體中文字。

模型定位描述

Gemini 2.5 Flash-Lite是Gemini 2.5系列中的轻量级推理模型,专为超低延迟和成本效益优化。相比早期Flash模型,它在吞吐量、令牌生成速度及常见基准测试性能方面均有提升。该模型默认禁用"多轮思考"(即多重推理)功能以优先保证响应速度,但开发者可通过Reasoning API参数启用该功能,从而根据需求在成本与智能表现之间进行灵活权衡。

適合的業務場景 (EEAT)

🟢 推薦首選場景
  • 複雜邏輯推理、數理推導與深度思考解答任務
  • 自動化 Agentic Workflow、Function Calling 外部接口呼叫
  • 整本合約審查、長文本代碼除錯或長影片轉譯理解
  • 高頻 API 呼叫、企業高併發智能客服或降本增效 MVP 搭建
  • 繁體中文在地化語句生成與流暢對答
🔴 限制與避坑指南
  • 未經 System Prompt 私有化微調前可能出現用語偏置
  • 跨海直連呼叫 API 時需注意出口骨幹網路延遲抖動

核心技術規格指標

多模態支持 (Vision)僅限文字
深度思考 (Reasoning)預設思考模式
工具調用 (Tool Calling)支援
JSON 模式 (Structured Output)支援

相關模型對比推薦