v1.84.1 - Gemini 3.5 Flash 與可靠性修正
部署此版本
- Docker
- Pip
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
docker.litellm.ai/berriai/litellm:1.84.1
pip install litellm==1.84.1
v1.84.1 是建構於 v1.84.0 之上的修補版本。它新增了 Gemini 3.5 Flash 的 day-0 支援,並推出兩項可靠性修正——跨叢集支出準確性與 Vertex AI 工具呼叫。
新模型 / 已更新模型
新模型支援(1 個新模型)
| 提供者 | 模型 | 上下文視窗 | 輸入($/100 萬 tokens) | 輸出($/100 萬 tokens) | 功能 |
|---|---|---|---|---|---|
| Gemini / Vertex AI | gemini/gemini-3.5-flash, vertex_ai/gemini-3.5-flash | 1M | $1.50 | $9.00 | 推理、視覺、音訊輸入、PDF 輸入、prompt caching、web search、function calling、response schema |
功能
錯誤修正
- Vertex AI
- 在 Vertex Gemini 3.5+ 工具回合中省略
function_call/function_responseid,修正 HTTP 400Unknown name "id"錯誤。Google AI Studio(gemini提供者)在 Gemini 3.5+ 上仍會轉送id,以便嚴格的工具呼叫比對 - PR #28324
- 在 Vertex Gemini 3.5+ 工具回合中省略
支出追蹤、預算與速率限制
- 透過
SET NX而不是INCRBYFLOAT來初始化 Redis 支出計數器,以防止跨叢集重複初始化。在多叢集部署中,這過去會導致團隊spend在 Redis 快取遺失 / TTL 到期後跳升到約為 pod 數量的 Nx,進而觸發錯誤的「Budget Crossed」警示 - PR #27854
完整更新紀錄
https://github.com/BerriAI/litellm/compare/v1.84.0...v1.84.1