v1.72.6-stable - MCP 閘道權限管理
部署此版本
- Docker
- Pip
docker run litellm
docker run
-e STORE_MODEL_IN_DB=True
-p 4000:4000
docker.litellm.ai/berriai/litellm:main-v1.72.6-stable
pip install litellm
pip install litellm==1.72.6.post2
重點摘要
- 為什麼要升級
- Claude Code 上的 Codex-mini:您現在可以透過 Claude Code 使用
codex-mini(OpenAI 的程式碼助理模型)。 - MCP 權限管理:在 LiteLLM 上依 Keys、Teams、Organizations(entities)管理 MCP Servers 的權限。
- UI:可在 logs view 上開啟/關閉自動重新整理。
- Rate Limiting:支援僅針對 output token 的 rate limiting。
- Claude Code 上的 Codex-mini:您現在可以透過 Claude Code 使用
- 誰應該閱讀
- 使用
/v1/messagesAPI(Claude Code)的團隊 - 使用 MCP 的團隊
- 提供自架模型存取並設定 rate limits 的團隊
- 使用
- 升級風險
- 低
- 現有功能或套件更新沒有重大變更。
- 低
主要亮點
MCP 權限管理
本次釋出新增支援在 LiteLLM 上依 Keys、Teams、Organizations(entities)管理 MCP Servers 的權限。當 MCP client 嘗試列出 tools 時,LiteLLM 只會回傳該 entity 有權存取的 tools。
這對於需要存取受限制資料(例如 Jira MCP)、但不希望所有人都能使用的情境非常有幫助。
對 Proxy Admins 而言,這可讓所有 MCP Servers 的存取控制集中管理。對開發者而言,這表示您只會看到指派給您的 MCP tools。
Claude Code 上的 Codex-mini
本次釋出新增支援透過 Claude Code 呼叫 codex-mini(OpenAI 的程式碼助理模型)。
這是透過 LiteLLM 啟用任何 Responses API model(包括 o3-pro)可經由 /chat/completions 與 /v1/messages endpoints 呼叫而達成。這包括:
- 串流請求
- 非串流請求
- Responses API models 在成功與失敗時的成本追蹤
以下是今天的使用方式 today
新增 / 更新的模型
價格 / Context Window 更新
| 提供者 | 模型 | 上下文視窗 | 輸入($/1M tokens) | 輸出($/1M tokens) | 類型 |
|---|---|---|---|---|---|
| VertexAI | vertex_ai/claude-opus-4 | 200K | $15.00 | $75.00 | 新增 |
| OpenAI | gpt-4o-audio-preview-2025-06-03 | 128k | $2.5 (text), $40 (audio) | $10 (text), $80 (audio) | 新增 |
| OpenAI | o3-pro | 200k | 20 | 80 | 新增 |
| OpenAI | o3-pro-2025-06-10 | 200k | 20 | 80 | 新增 |
| OpenAI | o3 | 200k | 2 | 8 | 已更新 |
| OpenAI | o3-2025-04-16 | 200k | 2 | 8 | 已更新 |
| Azure | azure/gpt-4o-mini-transcribe | 16k | 1.25 (text), 3 (audio) | 5 (text) | 新增 |
| Mistral | mistral/magistral-medium-latest | 40k | 2 | 5 | 新增 |
| Mistral | mistral/magistral-small-latest | 40k | 0.5 | 1.5 | 新增 |
- Deepgram:現在支援
nova-3的每秒成本定價。(https://github.com/BerriAI/litellm/pull/11634)
已更新模型
錯誤修正
- Watsonx
- 忽略 Watsonx deployments 上的 space id(會拋出 json errors)- PR
- Ollama
- 為串流請求設定 tool call id - PR
- Gemini (VertexAI + Google AI Studio)
- 自訂 LLM
- Huggingface
- 在缺少時將 /chat/completions 加入 endpoint url - PR
- Deepgram
- 支援 async httpx calls - PR
- Anthropic
- 將前綴(如果已設定)附加到 assistant content start - PR
功能
- VertexAI
- Anthropic
- Perplexity
- Mistral
- SGLang
- 對 context window exceeded error 進行對應以便正確處理 - PR
- Deepgram
- 支援 provider specific params - PR
- Azure
- 回傳內容安全性篩選結果 - PR
LLM API 端點
錯誤修正
功能
支出追蹤
錯誤修正
管理端點 / UI
錯誤
功能
- 左側導覽
- 在 UI 顯示剩餘的 Enterprise 使用者數
- MCP
- 模型
- 在 UI 新增 deepgram 模型
- 在 UI 新增 Model Access Group 支援 - PR
- 金鑰
- 修剪過長的使用者 ID - PR
- 記錄
記錄 / 防護欄 整合
錯誤
- Arize
- Prometheus
- 修正總請求數累加 - PR
功能
- Lasso 防護欄
- [NEW] Lasso Guardrails 支援 - PR
- 使用者
- 在
/user/new上新增organizations參數 - 可在建立時將使用者加入組織 - PR
- 在
- 在使用 bridge 邏輯時防止重複記錄 - PR
效能 / 可靠性改善
錯誤
- 基於標籤的路由
- 當請求指定標籤時,不要考慮「default」模型 - PR(s/o thiagosalvatore)
功能
一般 Proxy 改善
錯誤
- aiohttp
- 修正 aiohttp transport 的 transfer encoding 錯誤 - PR
功能
- aiohttp
- CLI
- 讓所有命令都顯示伺服器 URL - PR
- Unicorn
- 允許設定 keep alive timeout - PR
- Experimental Rate Limiting v2(透過
EXPERIMENTAL_MULTI_INSTANCE_RATE_LIMITING="True"啟用) - Helm
- 支援 migrations-job.yaml 中的 extraContainers - PR
新增貢獻者
- @laurien16 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/8460
- @fengbohello 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11547
- @lapinek 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11570
- @yanwork 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11586
- @dhs-shine 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11575
- @ElefHead 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11450
- @idootop 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11616
- @stevenaldinger 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11649
- @thiagosalvatore 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11454
- @vanities 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11595
- @alvarosevilla95 完成了第一次貢獻,於 https://github.com/BerriAI/litellm/pull/11661
Demo 實例
以下是用來測試變更的 Demo 實例:
- 實例:https://demo.litellm.ai/
- 登入憑證:
- 使用者名稱:admin
- 密碼:sk-1234