v1.82.0 - 即時防護欄、專案管理,以及 10+ 項效能最佳化
使用此版本進行部署
- Docker
- Pip
docker run litellm
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
ghcr.io/berriai/litellm:main-1.82.0-stable
pip install litellm
pip install litellm==1.82.0
主要亮點
- 即時 API 防護欄 — 完整支援
/v1/realtimeWebSocket 工作階段,包含請求前/後強制執行、語音轉錄掛鉤、工作階段終止政策,以及 Vertex AI Gemini Live 支援 - PR #22152, PR #22153, PR #22161, PR #22165 - 專案管理 — 全新的 Projects UI,具備完整 CRUD、專案範圍虛擬金鑰,以及管理員自願啟用切換—依專案組織團隊與金鑰 - PR #22315, PR #22360, PR #22373, PR #22412
- 防護欄生態系擴展 — Noma v2、Lakera v2 後置呼叫、Singapore 法規政策(PDPA + MAS)、就業歧視阻擋器、程式碼執行阻擋器、防護欄政策版本控管,以及正式環境監控 - PR #21400, PR #21783, PR #21948
- OpenAI Codex 5.3 — 第 0 天 — OpenAI 與 Azure 上的完整支援
gpt-5.3-codex,以及gpt-audio-1.5和gpt-realtime-1.5模型涵蓋範圍 - PR #22035 - 10+ 項效能最佳化 — 串流 hot path 修正、Redis pipeline 批次處理、資料庫任務批次處理、ModelResponse 初始化跳過,以及路由快取改進—降低每次請求的延遲與 CPU
/v1/messages→/responses路由 — 預設情況下,/v1/messages請求現在會路由至 Responses API,適用於 OpenAI/Azure 模型
v1/messages routing change
此版本開始預設將 /v1/messages 請求路由至 /responses API。若要停用並繼續使用 chat/completions,請在您的設定中設為 LITELLM_USE_CHAT_COMPLETIONS_URL_FOR_ANTHROPIC_MESSAGES=true 或 litellm_settings.use_chat_completions_url_for_anthropic_messages: true。
新模型 / 更新模型
新模型支援(20 個新模型)
| 提供者 | 模型 | 上下文視窗 | 輸入(每 100 萬 tokens / 美元) | 輸出(每 100 萬 tokens / 美元) | 功能 |
|---|---|---|---|---|---|
| OpenAI | gpt-5.3-codex | 272K | $1.75 | $14.00 | 推理、程式撰寫 |
| Azure OpenAI | azure/gpt-5.3-codex | 272K | $1.75 | $14.00 | Azure 部署 |
| OpenAI | gpt-audio-1.5 | 128K | $2.50 | $10.00 | 音訊模型 |
| Azure OpenAI | azure/gpt-audio-1.5-2026-02-23 | 128K | $2.50 | $10.00 | 音訊模型 |
| OpenAI | gpt-realtime-1.5 | 32K | $4.00 | $16.00 | 即時模型 |
| Azure OpenAI | azure/gpt-realtime-1.5-2026-02-23 | 32K | $4.00 | $16.00 | 即時模型 |
| Groq | groq/openai/gpt-oss-safeguard-20b | 131K | $0.075 | $0.30 | 防護欄推論 |
| Google Vertex AI | vertex_ai/gemini-3.1-flash-image-preview | - | - | - | 圖片生成 |
| Perplexity | perplexity/perplexity/sonar | - | - | - | Sonar 搜尋 |
| Perplexity | perplexity/openai/gpt-5.1 | - | - | - | 代管路由 |
| Perplexity | perplexity/openai/gpt-5-mini | - | - | - | 代管路由 |
| Perplexity | perplexity/google/gemini-2.5-flash | - | - | - | 代管路由 |
| Perplexity | perplexity/google/gemini-2.5-pro | - | - | - | 代管路由 |
| Perplexity | perplexity/google/gemini-3-flash-preview | - | - | - | 代管路由 |
| Perplexity | perplexity/google/gemini-3-pro-preview | - | - | - | 代管路由 |
| Perplexity | perplexity/anthropic/claude-haiku-4-5 | - | - | - | 代管路由 |
| Perplexity | perplexity/anthropic/claude-sonnet-4-5 | - | - | - | 代管路由 |
| Perplexity | perplexity/anthropic/claude-opus-4-5 | - | - | - | 代管路由 |
| Perplexity | perplexity/anthropic/claude-opus-4-6 | - | - | - | 代管路由 |
| Perplexity | perplexity/xai/grok-4-1-fast-non-reasoning | - | - | - | 代管路由 |
功能
-
- 新的 Azure OpenAI 模型 2026-02-25 - PR #22114
-
- 調整
mistral-small-2503每個 token 的輸入/輸出成本 - PR #22097
- 調整
-
- 新增
groq/openai/gpt-oss-safeguard-20b模型定價 - PR #21951
- 新增
-
- 更新 AIML 模型定價 - PR #22139
-
- 將
api_base傳遞至get_model_info+ 優雅備援 - PR #21970
- 將
-
- 修正 PublicAI Apertus 模型的函式呼叫 - PR #21582
-
- 為
grok-2-vision-1212和grok-3-mini模型新增淘汰日期 - PR #20102
- 為
-
一般
錯誤修正
-
- 修正 anthropic fast 和
inference_geo的 model cost map - PR #21904
- 修正 anthropic fast 和
-
一般
LLM API 端點
功能
-
- 支援
/v1/realtimeWebSocket 端點的防護欄 - PR #22152 - 透過統一的
/realtime端點支援 Vertex AI Gemini Live - PR #22153 - 在 realtime WebSocket 上以
pre_call/post_call模式套用防護欄 - PR #22161 end_session_after_n_fails+ 端點設定精靈步驟 - PR #22165- 語音轉錄的防護欄回呼 - PR #21976
- 修正 Gemini/Vertex AI 和
provider_configrealtime 工作階段未觸發防護欄的問題 - PR #22168 - 新增記錄、支出追蹤支援 + 工具追蹤 - PR #22105
- 支援
-
- 為 OCR 啟用本機檔案支援 - PR #22133
-
- 保留 agentic loop 後續訊息中的 thinking 區塊 - PR #21604
-
一般
錯誤
- 一般
- 修正 realtime websocket 呼叫上的 mypy attr-defined 錯誤 - PR #22202
管理端點 / UI
功能
-
專案
- 新增 Projects 頁面,包含列表與建立流程 - PR #22315
- 新增 Project Details 頁面與編輯 modal - PR #22360
- 在 key 建立/編輯時新增 project keys 表格與 project 下拉選單 - PR #22373
- 在 Projects 表格新增刪除 project 動作 - PR #22412
- 在 Admin Settings 新增 Projects Opt-In 切換 - PR #22416
- 在
/project/list回應中包含created_at和updated_at- PR #22323 - 在 project 中新增標籤 - PR #22216
-
虛擬金鑰 + 存取群組
- 為 Access Group CRUD 流程新增雙向 team/key 同步 - PR #22253
- 在
/key/aliases新增分頁與搜尋以避免 OOM - PR #22137 - 在 UI 中新增分頁式 key 別名選擇器 - PR #22157
- 為 key list 端點新增
project_id與access_group_id篩選器 - PR #22356 - 新增 KeyInfoHeader 元件 - PR #22047
- 將 Edit Settings 限制為 key 擁有者可用 - PR #21985
- 修正來自 env/UI 的 virtual key 寬限期 - PR #20321
-
代理程式
-
Proxy 驗證 / SSO
-
用量 / 支出記錄
-
模型 + 端點
-
UI 改進
-
健康檢查
錯誤
- 為
/user/info中的管理員使用者填入user_id和user_info- PR #22239 - 修正 virtual keys 分頁在篩選時的過期總數 - PR #22222
- 修正預設 preset 下 Spend Update Queue 聚合永遠不會觸發的問題 - PR #21963
- 修正 timezone 設定查找,並以
ZoneInfo取代硬編碼的時區對照表 - PR #21754 - 修正自訂驗證預算問題 - PR #22164
- 修正缺少的 OAuth session state - PR #21992
- 修正 UI 上 OpenAPI Spec 的 Transport Type - PR #22005
- 修正 Claude Code plugin schema - PR #22271
- 為
LiteLLM_ClaudeCodePluginTable新增缺少的 migration - PR #22335 - 在建立 access group 時只標記所選部署 - PR #21655
- CheckBatchCost 的狀態管理修正 - PR #21921
- 移除 ToolPolicies 中重複的 antd import - PR #22107
AI 整合
記錄
-
- 修正 Langfuse OTEL trace 問題 - PR #21309
-
- 修正與 OTEL 回呼共存時的巢狀追蹤 - PR #22169
-
- 為 Slack 警示類型新增可選的摘要模式 - PR #21683
-
一般
防護欄
-
- 基於自訂防護欄框架的 Noma 防護欄 v2 - PR #21400
-
- 新增 Lakera v2 請後回呼,並修正 PII 遮罩 - PR #21783
-
內建防護欄
-
政策範本
-
防護欄監控
- Guardrail Monitor — 衡量正式環境中的防護欄可靠性 - PR #21944
-
安全性
- 修正自訂程式碼防護欄中的未驗證 RCE 與沙箱逃逸問題 - PR #22095
提示管理
此版本沒有重大提示管理變更。
密鑰管理器
此版本沒有重大密鑰管理器變更。
支出追蹤、預算與速率限制
- Gemini/Vertex AI 的優先 PayGo 成本追蹤 - PR #21909
- 將
request_duration_ms新增至 SpendLogs,以便進行每個請求的延遲追蹤 - PR #22066 - 將
in_flight_requests指標新增至/health/backlog+ Prometheus - PR #22319 - 以 key/team 中繼資料豐富失敗支出記錄 - PR #22049
- 新增支出追蹤生命週期記錄,用於偵錯支出流程 - PR #22029
- 修正預算時區設定查找,並以
ZoneInfo取代硬編碼時區對應表 - PR #21754 - 修正 Spend Update Queue 聚合 在預設預設集下從未觸發的問題 - PR #21963
- 避免在
SpendUpdateQueue聚合中變更呼叫端擁有的 dict - PR #21742 - 最佳化舊 spendlog 刪除 cron 工作 - PR #21930
- 健康檢查最大 token 設定 - PR #22299
MCP 閘道
- 將 MCP 驗證標頭 從請求內容傳遞到
/v1/responses和/chat/completions的工具擷取 - PR #22291 - 將
available_on_public_internet預設為 true,以維持 MCP 伺服器行為一致性 - PR #22331 - 清楚的錯誤訊息,適用於 IP 過濾/沒有可用工具 - PR #22142
- 移除過時的
mcp-session-id標頭,以防止跨代理工作程序出現 400 錯誤 - PR #21417 - 略過 MCP 的健康檢查,適用於穿透式 token 驗證 - PR #21982
- 修正缺少的 OAuth session state - PR #21992
- 修正 UI 上 OpenAPI 規格的傳輸類型 - PR #22005
- 新增 e2e 測試,驗證無狀態 StreamableHTTP 行為 - PR #22033
效能 / 負載平衡 / 可靠性改善
串流與熱路徑
- 串流延遲改善 — 4 項針對性的熱路徑修正 - PR #22346
- 在
ModelResponse.__init__中略過一次性Usage()建構 - PR #21611 - 使用
startswith最佳化is_model_o_series_model- PR #21690 - 使用快取的
_safe_get_request_headers取代每次請求建構 - PR #21430 - 為串流請求發出
x-litellm-overhead-duration-ms標頭 - PR #22027
資料庫與 Redis
- 將 11 次
create_task()呼叫批次化合併為update_database()中的 1 次 - PR #22028 - 批次寫入的 Redis pipeline 支出更新 - PR #22044
- 從 prisma-query-engine 僵死程序中復原 - PR #21899
- 最佳化舊 spendlog 刪除 cron 工作 - PR #21930
路由與快取
- 為
_cached_get_model_group_info新增快取失效 - PR #20376 - 移除會終止使用中的 httpx 用戶端的快取清除 close - PR #22247
- 將背景工作參考儲存在
LLMClientCache._remove_key中,以避免未等待的 coroutine 警告 - PR #22143 - 在計算佇列時間前修正
ensure_arrival_time設定 - PR #21918
連線管理
- 僅在需要時於 aiohttp 上設定
enable_cleanup_closed- PR #21897 - gunicorn workers 的 Prometheus child_exit 清理 - PR #22324
- Prometheus 多程序清理 - PR #22221
- 使用
health_check_concurrency限制並行健康檢查 - PR #20584 - 將
get_config失敗與模型同步迴圈隔離 - PR #22224
其他
- 語意快取:支援可設定的向量維度 - PR #21649
- 從設定環境變數中遵循
MAX_STRING_LENGTH_PROMPT_IN_DB- PR #22106 - 強化
MidStreamFallbackError,以保留原始狀態碼與屬性 - PR #22225 - 用於測試的網路模擬工具 - PR #21942
- 為 streaming_handler 中的 iterator protocol 方法新增缺少的回傳型別註記 - PR #21750
安全性
- 修正 OS 層級函式庫與 NPM 傳遞相依性中的重大/高風險 CVE - PR #22008
- 修正自訂程式碼防護欄中的未驗證 RCE 與沙箱逃逸問題 - PR #22095
- 移除被 secret scanner 標記的硬編碼 base64 字串 - PR #22125
文件更新
- 新增含 LiteLLM Proxy 的 OpenAI Agents SDK 教學 - PR #21221
- 新增 OpenClaw 整合教學 - PR #21605
- 新增 Google GenAI SDK 教學(JS 與 Python) - PR #21885
- 新增 Gollem Go 代理程式框架食譜範例 - PR #21747
- 以 Universal-3 Pro、Speech Understanding 和 LLM Gateway 更新 AssemblyAI 文件 - PR #21130
- 新增
store_model_in_db版本文件 - PR #21863 - 新增憑證使用追蹤文件 - PR #22112
- 新增 proxy 請求標籤文件 - PR #22129
- 為
/mcp端點 URL 新增尾端斜線 - PR #20509 - 為 UI 貢獻指南新增 PR 前檢查清單 - PR #21886
- 在文件中以模擬金鑰取代 Azure OpenAI 金鑰 - PR #21997
- 在 v1.81.14 版本說明中新增效能與可靠性區段 - PR #21950
- 更新 v1.81.12-stable 版本說明以指向 stable.1 - PR #22036
- 在 v1.81.14 版本說明中新增安全性漏洞掃描報告 - PR #22385
新貢獻者
- @janfrederickk 在 PR #21660 做出了他們的首次貢獻
- @hztBUAA 在 PR #21656 做出了他們的首次貢獻
- @LeeJuOh 在 PR #21754 做出了他們的首次貢獻
- @WhoisMonesh 在 PR #21750 做出了他們的首次貢獻
- @trevorprater 在 PR #21747 做出了他們的首次貢獻
- @edwiniac 在 PR #21870 做出了他們的首次貢獻
- @stakeswky 在 PR #21867 做出了他們的首次貢獻
- @ta-stripe 在 PR #21701 做出了他們的首次貢獻
- @ron-zhong 在 PR #21948 做出了他們的首次貢獻
- @Arindam200 在 PR #21221 做出了他們的首次貢獻
- @Canvinus 在 PR #21964 做出了他們的首次貢獻
- @nicolopignatelli 在 PR #21951 做出了他們的首次貢獻
- @MarshHawk 在 PR #20584 做出了他們的首次貢獻
- @gavksingh 在 PR #22106 做出了他們的首次貢獻
- @roni-frantchi 在 PR #22090 做出了他們的首次貢獻
- @noahnistler 在 PR #22133 做出了他們的首次貢獻
- @dylan-duan-aai 在 PR #21130 做出了他們的首次貢獻
- @rasmi 在 PR #22322 做出了他們的首次貢獻
差異摘要
02/28/2026
- 新模型 / 更新模型:26
- LLM API 端點:14
- 管理端點 / UI:38
- AI 整合:25
- 支出追蹤、預算與速率限制:10
- MCP Gateway:8
- 效能 / 負載平衡 / 可靠性改善:22
- 安全性:3
- 文件更新:14