v1.80.11-stable - Google Interactions API
部署此版本
- Docker
- Pip
docker run litellm
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
docker.litellm.ai/berriai/litellm:v1.80.11-stable
pip install litellm
pip install litellm==1.80.11
主要亮點
- Gemini 3 Flash Preview - 支援 Google 的 Gemini 3 Flash Preview 與推理能力的第 0 天支援
- Stability AI Image Generation - Stability AI 影像生成與編輯的新提供者
- LiteLLM Content Filter - 內建防護欄,可偵測有害內容、偏見與 PII,並支援影像
- New Provider: Venice.ai - 透過 providers.json 支援 Venice.ai API
- Unified Skills API - Skills API 可跨 Anthropic、Vertex、Azure 與 Bedrock 運作
- Azure Sentinel Logging - Azure Sentinel 的新記錄整合
- Guardrails Load Balancing - 在多個防護欄提供者之間進行負載平衡
- Email Budget Alerts - 當達到預算時傳送電子郵件通知
- Cloudzero Integration on UI - 直接在 UI 上設定您的 Cloudzero 整合
UI 上的 Cloudzero 整合
使用者現在可以直接在 UI 上設定他們的 Cloudzero 整合。
效能:LiteLLM SDK 的記憶體使用量與匯入延遲降低 50%
我們已完全重新架構 litellm.__init__.py,將耗費資源的匯入延後到實際需要時才執行,為 109 個元件 實作了延遲載入。
此重構包含 41 個提供者設定類別、40 個工具函式、快取實作(Redis、DualCache、InMemoryCache)、HTTP 處理器、記錄、型別,以及其他耗費資源的相依性。像 tiktoken 和 boto3 這類大型函式庫現在改為按需載入,而不是在匯入時就預先載入。
這使 LiteLLM 對於伺服器無狀態函式、Lambda 部署與容器化環境特別有利,因為冷啟動時間與記憶體占用都很重要。
新提供者與端點
新提供者(5 個新提供者)
| 提供者 | 支援的 LiteLLM 端點 | 說明 |
|---|---|---|
| Stability AI | /images/generations, /images/edits | Stable Diffusion 3、SD3.5、影像編輯與生成 |
| Venice.ai | /chat/completions, /messages, /responses | 透過 providers.json 的 Venice.ai API 整合 |
| Pydantic AI Agents | /a2a | 用於 A2A 協定工作流程的 Pydantic AI 代理程式 |
| VertexAI Agent Engine | /a2a | 適用於 agentic 工作流程的 Google Vertex AI Agent Engine |
| LinkUp Search | /search | LinkUp 網頁搜尋 API 整合 |
新 LLM API 端點(2 個新端點)
| 端點 | 方法 | 說明 | 文件 |
|---|---|---|---|
/interactions | POST | 用於對話式 AI 的 Google Interactions API | 文件 |
/search | POST | 具 reranker 的 RAG Search API | 文件 |
新模型 / 更新模型
新模型支援(55+ 個新模型)
| 提供者 | 模型 | 上下文視窗 | 輸入($/百萬 tokens) | 輸出($/百萬 tokens) | 功能 |
|---|---|---|---|---|---|
| Gemini | gemini/gemini-3-flash-preview | 1M | $0.50 | $3.00 | 推理、視覺、音訊、影片、PDF |
| Vertex AI | vertex_ai/gemini-3-flash-preview | 1M | $0.50 | $3.00 | 推理、視覺、音訊、影片、PDF |
| Azure AI | azure_ai/deepseek-v3.2 | 164K | $0.58 | $1.68 | 推理、函式呼叫、快取 |
| Azure AI | azure_ai/cohere-rerank-v4.0-pro | 32K | $0.0025/query | - | Rerank |
| Azure AI | azure_ai/cohere-rerank-v4.0-fast | 32K | $0.002/query | - | Rerank |
| OpenRouter | openrouter/openai/gpt-5.2 | 400K | $1.75 | $14.00 | 推理、視覺、快取 |
| OpenRouter | openrouter/openai/gpt-5.2-pro | 400K | $21.00 | $168.00 | 推理、視覺 |
| OpenRouter | openrouter/mistralai/devstral-2512 | 262K | $0.15 | $0.60 | 函式呼叫 |
| OpenRouter | openrouter/mistralai/ministral-3b-2512 | 131K | $0.10 | $0.10 | 函式呼叫、視覺 |
| OpenRouter | openrouter/mistralai/ministral-8b-2512 | 262K | $0.15 | $0.15 | 函式呼叫、視覺 |
| OpenRouter | openrouter/mistralai/ministral-14b-2512 | 262K | $0.20 | $0.20 | 函式呼叫、視覺 |
| OpenRouter | openrouter/mistralai/mistral-large-2512 | 262K | $0.50 | $1.50 | 函式呼叫、視覺 |
| OpenAI | gpt-4o-transcribe-diarize | 16K | $6.00/audio | - | 含 diarization 的音訊轉錄 |
| OpenAI | gpt-image-1.5-2025-12-16 | - | 多種 | 多種 | 影像生成 |
| Stability | stability/sd3-large | - | - | $0.065/image | 影像生成 |
| Stability | stability/sd3.5-large | - | - | $0.065/image | 影像生成 |
| Stability | stability/stable-image-ultra | - | - | $0.08/image | 影像生成 |
| Stability | stability/inpaint | - | - | $0.005/image | 影像編輯 |
| Stability | stability/outpaint | - | - | $0.004/image | 影像編輯 |
| Bedrock | stability.stable-conservative-upscale-v1:0 | - | - | $0.40/image | 影像放大 |
| Bedrock | stability.stable-creative-upscale-v1:0 | - | - | $0.60/image | 影像放大 |
| Vertex AI | vertex_ai/deepseek-ai/deepseek-ocr-maas | - | $0.30 | $1.20 | OCR |
| LinkUp | linkup/search | - | $5.87/1K queries | - | 網頁搜尋 |
| LinkUp | linkup/search-deep | - | $58.67/1K queries | - | 深層網路搜尋 |
| GitHub Copilot | 20+ models | 多種 | - | - | 聊天補全 |
功能
- Gemini
- Anthropic
- Vertex AI
- Azure AI
- Fireworks AI
- 新增 Fireworks AI models 的 reasoning 參數支援 - PR #17967
- Bedrock
- Perplexity
- 使用 API 提供的成本,而非手動計算 - PR #17887
- OpenAI
- GitHub Copilot
- 新增 github_copilot model 資訊 - PR #17858
- 自訂 LLM
- 新增 image_edit 與 aimage_edit 支援 - PR #17999
錯誤修正
LLM API 端點
功能
- Responses API
- Chat Completions API
- 新增 agent skills 支援 - PR #18031
- Skills API
- 統一的 Skills API 可跨 Anthropic、Vertex、Azure、Bedrock 運作 - PR #18232
- Search API
- 新增具 rerankers 的 RAG Search API - PR #18217
- Interactions API
- Image Edit API
- 新增 drop_params 支援並修正 Vertex AI 設定 - PR #18077
- 一般
錯誤
管理端點 / UI
功能
- 虛擬金鑰
- 模型 + 端點
- 向量儲存
- 記錄與支出
- SSO 與健康狀態
- CloudZero
- 一般
- 更新非 root Docker 的 UI 路徑處理 - PR #17989
錯誤
- UI 修正
AI 整合
記錄
- Azure Sentinel
- 新增 Azure Sentinel Logger 整合 - PR #18146
- Prometheus
- 新增擷取自訂標籤頂層中繼資料 - PR #18087
- Langfuse
- 修正 log_failure_event 無法運作 - PR #18234
- Arize Phoenix
- 修正巢狀 spans - PR #18102
- 一般
- 將 extra_headers 變更為 additional_headers - PR #17950
防護欄
- LiteLLM 內容過濾器
- Guardrails API
- Lakera
- 為 Lakera 新增監控模式 - PR #18084
- Pillar Security
- 新增遮罩支援與 MCP 呼叫支援 - PR #17959
- Bedrock Guardrails
秘密管理器
- HashiCorp Vault
- UI
- 在團隊管理 UI 中新增秘密管理器設定控制項 - PR #18149
支出追蹤、預算與速率限制
- 電子郵件預算警示 - 當達到預算時傳送電子郵件通知 - PR #17995
MCP 閘道
- 驗證標頭傳遞 - 新增 MCP 驗證標頭傳遞 - PR #17963
- 修正 deepcopy 錯誤 - 修正處理請求時的 MCP 工具呼叫 deepcopy 錯誤 - PR #18010
- 修正 list tool - 修正沒有資料庫連線時 MCP list_tools 無法運作的問題 - PR #18161
代理程式閘道 (A2A)
- 新提供者:Agent Gateway - 新增對 pydantic ai agents 的支援 - PR #18013
- VertexAI Agent Engine - 新增 Vertex AI Agent Engine 提供者 - PR #18014
- 修正模型擷取 - 修正 get_model_from_request() 以從 Vertex AI passthrough URLs 擷取 model ID - PR #18097
效能 / 負載平衡 / 可靠性改進
- 延遲匯入 - 使用按屬性延遲匯入並擷取共用常數 - PR #17994
- 延遲載入 HTTP 處理器 - 延遲載入 http handlers - PR #17997
- 延遲載入快取 - 延遲載入快取 - PR #18001
- 延遲載入類型 - 延遲載入 bedrock types、.types.utils、GuardrailItem - PR #18053, PR #18054, PR #18072
- 延遲載入設定 - 延遲載入 41 個設定類別 - PR #18267
- 延遲載入用戶端裝飾器 - 延遲載入大型用戶端裝飾器匯入 - PR #18064
- Prisma 建置時間 - 在建置時而非執行時下載 Prisma binaries,以供安全受限環境使用 - PR #17695
- Docker Alpine - 為 ARM64 音訊處理在 Alpine image 中新增 libsndfile - PR #18092
- 安全性 - 防止 LiteLLM API key 在 /health endpoint 失敗時外洩 - PR #18133
文件更新
- SAP 文件 - 更新 SAP 文件 - PR #17974
- Pydantic AI Agents - 新增關於在 LiteLLM A2A gateway 中使用 pydantic ai agents 的文件 - PR #18026
- Vertex AI Agent Engine - 新增 Vertex AI Agent Engine 文件 - PR #18027
- Router 順序 - 新增 router order 參數文件 - PR #18045
- 秘密管理器設定 - 改善秘密管理器設定文件 - PR #18235
- Gemini 3 Flash - 在 Gemini 3 Flash 部落格中新增版本需求 - PR #18227
- README - 擴充 Responses API 區段並更新 endpoints - PR #17354
- Amazon Nova - 在側邊欄和支援模型中新增 Amazon Nova - PR #18220
- Benchmarks - 在 benchmarks 文件中新增基礎設施建議 - PR #18264
- 損壞的連結 - 修正損壞連結的更正 - PR #18104
- README 修正 - 各種 README 改進 - PR #18206
基礎設施 / CI/CD
- PR 範本 - 新增 LiteLLM 團隊 PR 範本與 CI/CD 規則 - PR #17983, PR #17985
- Issue 標記 - 透過元件下拉選單和更多提供者關鍵字改善 issue 標記 - PR #17957
- PR 範本清理 - 移除 PR 範本中多餘欄位 - PR #17956
- 相依套件 - 將 altcha-lib 從 1.3.0 升級到 1.4.1 - PR #18017
新貢獻者
- @dongbin-lunark 在 PR #17757 中完成了第一次貢獻
- @qdrddr 在 PR #18004 中完成了第一次貢獻
- @donicrosby 在 PR #17962 中完成了第一次貢獻
- @NicolaivdSmagt 在 PR #17992 中完成了第一次貢獻
- @Reapor-Yurnero 在 PR #18085 中完成了第一次貢獻
- @jk-f5 在 PR #18086 中完成了第一次貢獻
- @castrapel 在 PR #18077 中完成了第一次貢獻
- @dtikhonov 在 PR #17484 中完成了第一次貢獻
- @opleonnn 在 PR #18175 中完成了第一次貢獻
- @eurogig 在 PR #18084 中完成了第一次貢獻