v1.79.3-stable - 內建 AI Gateway 防護欄
部署此版本
- Docker
- Pip
docker run litellm
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
docker.litellm.ai/berriai/litellm:v1.79.3-stable
pip install litellm
pip install litellm==1.79.3.rc.1
主要亮點
- LiteLLM 自訂防護欄 - 具備 UI 設定支援的內建防護欄
- 效能改善 -
/responsesAPI 延遲中位數降低 19× - Veo3 影片生成(Vertex AI + Google AI Studio) - 使用 OpenAI Video API 搭配 Vertex AI 與 Google AI Studio Veo3 模型來生成影片
AI Gateway 上的內建防護欄
此版本為 LiteLLM AI Gateway 引入內建防護欄,讓您無須依賴外部防護欄 API 即可強制執行保護措施。
- 封鎖關鍵字 - 封鎖已知的敏感關鍵字,例如 "litellm"、"python" 等。
- 模式偵測 - 封鎖已知的敏感模式,例如電子郵件、社會安全號碼、API 金鑰等。
- 自訂 Regex 模式 - 為您的特定使用情境定義自訂 regex 模式。
請在 此處 開始使用 AI Gateway 的內建防護欄。
效能 – /responses 19× 更低的延遲中位數
此更新透過整合我們用於連線處理的內部網路管理,顯著改善了 /responses 延遲,消除了每次請求的初始化額外負擔。
結果
| 指標 | 之前 | 之後 | 改善 |
|---|---|---|---|
| 延遲中位數 | 3,600 ms | 190 ms | −95%(快約 19×) |
| p95 延遲 | 4,300 ms | 280 ms | −93% |
| p99 延遲 | 4,600 ms | 590 ms | −87% |
| 平均延遲 | 3,571 ms | 208 ms | −94% |
| RPS | 231 | 1,059 | +358% |
測試設定
| 類別 | 規格 |
|---|---|
| 負載測試 | Locust:1,000 個並發使用者,500 個逐步升載 |
| 系統 | 4 vCPUs、8 GB RAM、4 個 workers、4 個 instances |
| 資料庫 | PostgreSQL(未使用 Redis) |
| 設定 | config.yaml |
| 負載腳本 | no_cache_hits.py |
新模型 / 已更新模型
新模型支援
| 提供者 | 模型 | 上下文視窗 | 輸入($/100 萬 tokens) | 輸出($/100 萬 tokens) | 功能 |
|---|---|---|---|---|---|
| Azure | azure/gpt-5-pro | 272K | $15.00 | $120.00 | Responses API、reasoning、vision、PDF input |
| Azure | azure/gpt-image-1-mini | - | - | - | 影像生成 - 依像素定價 |
| Azure | azure/container | - | - | - | Container API - $0.03/session |
| OpenAI | openai/container | - | - | - | Container API - $0.03/session |
| Cohere | cohere/embed-v4.0 | 128K | $0.12 | - | 支援圖片輸入的 embeddings |
| Gemini | gemini/gemini-live-2.5-flash-preview-native-audio-09-2025 | 1M | $0.30 | $2.00 | 原生 audio、vision、web search |
| Vertex AI | vertex_ai/minimaxai/minimax-m2-maas | 196K | $0.30 | $1.20 | Function calling、tool choice |
| NVIDIA | nvidia/nemotron-nano-9b-v2 | - | - | - | 聊天補全 |
OCR 模型
| 提供者 | 模型 | 每頁成本 | 功能 |
|---|---|---|---|
| Azure AI | azure_ai/doc-intelligence/prebuilt-read | $0.0015 | 文件閱讀 |
| Azure AI | azure_ai/doc-intelligence/prebuilt-layout | $0.01 | 版面分析 |
| Azure AI | azure_ai/doc-intelligence/prebuilt-document | $0.01 | 文件處理 |
| Vertex AI | vertex_ai/mistral-ocr-2505 | $0.0005 | OCR 處理 |
搜尋模型
| 提供者 | 模型 | 定價 | 功能 |
|---|---|---|---|
| Firecrawl | firecrawl/search | 分級:$0.00166-$0.0166/查詢 | 每次查詢 10-100 筆結果 |
| SearXNG | searxng/search | 免費 | 開源 metasearch |
功能
-
- 新增 Azure GPT-5-Pro Responses API 支援與 reasoning 功能 - PR #16235
- 新增 Azure 的 gpt-image-1-mini 定價與品質等級(low/medium/high) - PR #16182
- 新增在 Azure OpenAI 發生 exceptions 時回傳 Azure Content Policy 錯誤資訊的支援 - PR #16231
- 修正 Azure GPT-5 錯誤路由至 O-series 設定(不支援 temperature 參數) - PR #16246
- 修正 Azure 不接受額外的 body 參數 - PR #16116
- 修正 Azure DALL-E-3 健康檢查的內容政策違規問題,改用安全的預設提示詞 - PR #16329
-
- 修正 AWS Bedrock Converse API 中空白 assistant 訊息的處理,以避免 400 Bad Request 錯誤 - PR #15850
- 修正:從 Bedrock InvokeModel request body 中過濾 AWS 驗證參數 - PR #16315
- 修正 Bedrock proxy 在 file content 中新增 name,當使用 cache_control 時會造成失敗 - PR #16275
- 修正 global.anthropic.claude-haiku-4-5-20251001-v1:0 的 supports_reasoning 標記並更新定價 - PR #16263
-
Gemini(Google AI Studio + Vertex AI)
- 在 model map 中新增 gemini live audio model 成本 - PR #16183
- 修正 Gemini parallel tool calls 的翻譯問題 - PR #16194
- 修正:透過 x-goog-api-key header 搭配自訂 api_base 傳送 Gemini API key - PR #16085
- 修正 image_config.aspect_ratio 對 gemini-2.5-flash-image 無效的問題 - PR #15999
- 修正 Gemini minimal reasoning 環境變數覆寫導致 thoughts 停用的問題 - PR #16347
- 修正 gemini-2.5-flash 的 cache_read_input_token_cost - PR #16354
-
- 修正 databricks streaming - PR #16368
-
- 在請求需要時回傳 diarized transcript - PR #16133
-
- 將 Fireworks audio endpoints 更新為新的
api.fireworks.aidomains - PR #16346
- 將 Fireworks audio endpoints 更新為新的
-
- 新增 cohere embed-v4.0 模型支援 - PR #16358
-
- 支援
reasoning_effort用於 watsonx chat models - PR #16261
- 支援
-
- 移除 reasoning_effort 轉換中的自動摘要 - PR #16210
-
- 移除 Grok 4 Models 的 Reasoning Effort 參數 - PR #16265
-
- 修正 HostedVLLMRerankConfig 不會被使用 - PR #16352
新增提供者支援
- Bedrock Agentcore
- 在 LiteLLM Python SDK 和 LiteLLM AI Gateway 中新增 Bedrock Agentcore 作為提供者 - PR #16252
LLM API 端點
功能
-
- 新增 gpt-4o-transcribe 成本追蹤 - PR #16412
-
- 在 embeddings 端點中使用有效的 CallTypes enum 值 - PR #16328
-
- 在通用成本計算器中將分級定價一般化 - PR #16150
錯誤修正
- 一般
管理端點 / UI
功能
-
虛擬金鑰
-
模型 + 端點
-
防護欄
- UI - 修正防護欄實體無法被選取且未顯示的回歸問題 - PR #16165
- UI - 防護欄資訊頁顯示 PII 設定 - PR #16164
- 將 guardrail_information 變更為 list 類型 - PR #16127
- UI - LiteLLM 防護欄 - 確保您可以看到 PII Patterns 的 UI 友善名稱 - PR #16382
- UI - 防護欄 - LiteLLM 內容過濾器,允許檢視/編輯內容過濾器設定 - PR #16383
- UI - 防護欄 - 允許透過 UI 更新防護欄。確保 litellm_params 實際上會在記憶體中更新 - PR #16384
-
SSO 設定
-
使用情況與分析
-
快取設定
- UI - 快取設定 Redis 新增語意快取設定 - PR #16398
錯誤修正
- 一般
AI 整合
記錄
-
- 修正 langfuse 快取 token 的輸入 token 邏輯 - PR #16203
-
- 修正錯誤:無法正確附加到既有 trace,並進行重構 - PR #15529
-
- OTEL - 在 OTEL Logger 上記錄成本明細 - PR #16334
-
- 新增對
datadogcallback 的 DD Agent Host 支援 - PR #16379
- 新增對
防護欄
-
- PANW prisma airs 防護欄去重與增強的工作階段追蹤 - PR #16273
密鑰管理員
-
- 為 aws secrets manager 新增 tags 與 descriptions 支援 - PR #16224
-
- 新增 Custom Secret Manager - 允許使用者定義並撰寫自訂密鑰管理員 - PR #16297
-
一般
支出追蹤、預算與速率限制
- 成本追蹤
- 修正 OpenAI Responses API 串流測試的 usage 欄位名稱與成本計算 - PR #16236
MCP 閘道
效能 / 負載平衡 / 可靠性改善
-
記憶體洩漏修正
- 解決由 Pydantic 2.11+ 棄用警告造成的記憶體累積 - PR #16110
-
工作階段管理
- 為 responses API 新增 shared_session 支援 - PR #16260
-
錯誤處理
-
組態
-
Redis
- 處理來自 AWS ElastiCache Valkey 的浮點數 redis_version - PR #16207
-
Hook
- 在 during_call_hook 中新增平行執行處理 - PR #16279
-
基礎架構
- 為 prisma 安裝執行階段 node - PR #16410
文件更新
-
提供者文件
-
一般文件
-
安全性
- 移除 tornado 測試檔案(包含 test.key),修正 Python 3.13 安全性問題 - PR #16342
新貢獻者
- @steve-gore-snapdocs 在 PR #16149 做出了他們的首次貢獻
- @timbmg 在 PR #16120 做出了他們的首次貢獻
- @Nivg 在 PR #16202 做出了他們的首次貢獻
- @pablobgar 在 PR #16194 做出了他們的首次貢獻
- @AlanPonnachan 在 PR #16150 做出了他們的首次貢獻
- @Chesars 在 PR #16236 做出了他們的首次貢獻
- @bowenliang123 在 PR #16255 做出了他們的首次貢獻
- @dean-zavad 在 PR #16199 做出了他們的首次貢獻
- @alexkuzmik 在 PR #15529 做出了他們的首次貢獻
- @Granine 在 PR #16281 做出了他們的首次貢獻
- @Oodapow 在 PR #16279 做出了他們的首次貢獻
- @jgoodyear 在 PR #16275 做出了他們的首次貢獻
- @Qanpi 在 PR #16321 做出了他們的首次貢獻
- @ShimonMimoun 在 PR #16313 做出了他們的首次貢獻
- @andriykislitsyn 在 PR #16288 做出了他們的首次貢獻
- @reckless-huang 在 PR #16263 做出了他們的首次貢獻
- @chenmoneygithub 在 PR #16368 做出了他們的首次貢獻
- @stembe-digitalex 在 PR #16354 做出了他們的首次貢獻
- @jfcherng 在 PR #16352 做出了他們的首次貢獻
- @xingyaoww 在 PR #16246 做出了他們的首次貢獻
- @emerzon 在 PR #16373 做出了他們的首次貢獻
- @wwwillchen 在 PR #16376 做出了他們的首次貢獻
- @fabriciojoc 在 PR #16203 做出了他們的首次貢獻
- @jroberts2600 在 PR #16273 做出了他們的首次貢獻