Blog
跳至主要內容

DAY 0 支援:LiteLLM 上的 Gemini 3.1 Flash Lite Preview

Sameer Kankute
SWE @ LiteLLM (LLM Translation)
Krrish Dholakia
CEO, LiteLLM
Ishaan Jaffer
CTO, LiteLLM

LiteLLM 現在完整支援 gemini-3.1-flash-lite-preview,具備完整的 day 0 支援!

備註

如果您只想進行成本追蹤,您目前的 Litellm 版本不需要任何變更。但如果您想使用隨之推出的新功能,例如 thinking levels,則需要使用 v1.80.8-stable.1 或以上版本。

部署此版本

docker run litellm
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
ghcr.io/berriai/litellm:main-v1.80.8-stable.1

新功能

支援全部四種 thinking levels:

  • MINIMAL:極速回應,推理最少
  • LOW:簡單的指令遵循
  • MEDIUM:適合複雜任務的平衡推理
  • HIGH:最大推理深度(動態)

快速開始

基本用法

from litellm import completion

response = completion(
model="gemini/gemini-3.1-flash-lite-preview",
messages=[{"role": "user", "content": "Extract key entities from this text: ..."}],
)

print(response.choices[0].message.content)

搭配 Thinking Levels

from litellm import completion

# Use MEDIUM thinking for complex reasoning tasks
response = completion(
model="gemini/gemini-3.1-flash-lite-preview",
messages=[{"role": "user", "content": "Analyze this dataset and identify patterns"}],
reasoning_effort="medium", # low, medium , high
)

print(response.choices[0].message.content)

支援的端點

LiteLLM 在以下平台上為 Gemini 3.1 Flash Lite Preview 提供 完整端到端支援

  • /v1/chat/completions - 相容 OpenAI chat completions 的端點
  • /v1/responses - 相容 OpenAI Responses API 的端點(串流與非串流)
  • /v1/messages - 相容 Anthropic messages 的端點
  • /v1/generateContentGoogle Gemini API 相容的端點

所有端點都支援:

  • 串流與非串流回應
  • 具備 thought signatures 的函式呼叫
  • 多輪對話
  • 所有 Gemini 3 專屬功能(thinking levels、thought signatures)
  • 完整多模態支援(文字、圖片、音訊、影片)

Gemini 3.1 的 reasoning_effort 對應

LiteLLM 會自動將 OpenAI 的 reasoning_effort 參數對應到 Gemini 的 thinkingLevel

reasoning_effortthinking_level使用情境
minimalminimal極速回應、簡單查詢
lowlow基本指令遵循
mediummedium適用於中等複雜度的平衡推理
highhigh最大推理深度、複雜問題
disableminimal停用延伸推理
noneminimal不進行延伸推理
🚅
LiteLLM Enterprise
為正式環境打造的 SSO/SAML、稽核記錄、支出追蹤、多團隊管理與防護欄。
深入瞭解 →