v1.77.5-stable - MCP OAuth 2.0 支援
部署此版本
- Docker
- Pip
docker run litellm
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
docker.litellm.ai/berriai/litellm:v1.77.5-stable
pip install litellm
pip install litellm==1.77.5
主要亮點
- MCP OAuth 2.0 支援 - 為 Model Context Protocol 整合強化驗證
- 排程金鑰輪換 - 具備自動化金鑰輪換功能,提升安全性
- 全新 Gemini 2.5 Flash 與 Flash-lite 模型 - 具改善定價與功能的最新 2025 年 9 月預覽模型
- 效能改善 - RPS 提升 54%
效能改善 - RPS 提升 54%
此版本帶來每個執行個體 54% 的 RPS 提升(1,040 → 1,602 RPS,彙總)。
此改善來自修正 LiteLLM Router 中的 O(n²) 效率低落問題,主要原因是在針對大型陣列的迴圈中重複使用 in 陳述式。
測試是在僅資料庫的設定下執行(沒有快取命中)。
測試設定
所有基準測試皆使用 Locust 執行,包含 1,000 個並行使用者與 500 的漸進啟動。此環境經過配置,以壓測路由層並消除快取作為變數。
系統規格
- CPU: 8 vCPUs
- 記憶體: 32 GB RAM
組態 (config.yaml)
查看完整組態:gist.github.com/AlexsanderHamir/config.yaml
載入腳本 (no_cache_hits.py)
查看完整載入測試腳本:gist.github.com/AlexsanderHamir/no_cache_hits.py
新模型 / 更新模型
新模型支援
| 提供者 | 模型 | 上下文視窗 | 輸入(每 100 萬 tokens) | 輸出(每 100 萬 tokens) | 功能 |
|---|---|---|---|---|---|
| Gemini | gemini-2.5-flash-preview-09-2025 | 1M | $0.30 | $2.50 | 聊天、推理、視覺、音訊 |
| Gemini | gemini-2.5-flash-lite-preview-09-2025 | 1M | $0.10 | $0.40 | 聊天、推理、視覺、音訊 |
| Gemini | gemini-flash-latest | 1M | $0.30 | $2.50 | 聊天、推理、視覺、音訊 |
| Gemini | gemini-flash-lite-latest | 1M | $0.10 | $0.40 | 聊天、推理、視覺、音訊 |
| DeepSeek | deepseek-chat | 131K | $0.60 | $1.70 | 聊天、函式呼叫、快取 |
| DeepSeek | deepseek-reasoner | 131K | $0.60 | $1.70 | 聊天、推理 |
| Bedrock | deepseek.v3-v1:0 | 164K | $0.58 | $1.68 | 聊天、推理、函式呼叫 |
| Azure | azure/gpt-5-codex | 272K | $1.25 | $10.00 | Responses API、推理、視覺 |
| OpenAI | gpt-5-codex | 272K | $1.25 | $10.00 | Responses API、推理、視覺 |
| SambaNova | sambanova/DeepSeek-V3.1 | 33K | $3.00 | $4.50 | 聊天、推理、函式呼叫 |
| SambaNova | sambanova/gpt-oss-120b | 131K | $3.00 | $4.50 | 聊天、推理、函式呼叫 |
| Bedrock | qwen.qwen3-coder-480b-a35b-v1:0 | 262K | $0.22 | $1.80 | 聊天、推理、函式呼叫 |
| Bedrock | qwen.qwen3-235b-a22b-2507-v1:0 | 262K | $0.22 | $0.88 | 聊天、推理、函式呼叫 |
| Bedrock | qwen.qwen3-coder-30b-a3b-v1:0 | 262K | $0.15 | $0.60 | 聊天、推理、函式呼叫 |
| Bedrock | qwen.qwen3-32b-v1:0 | 131K | $0.15 | $0.60 | 聊天、推理、函式呼叫 |
| Vertex AI | vertex_ai/qwen/qwen3-next-80b-a3b-instruct-maas | 262K | $0.15 | $1.20 | 聊天、函式呼叫 |
| Vertex AI | vertex_ai/qwen/qwen3-next-80b-a3b-thinking-maas | 262K | $0.15 | $1.20 | 聊天、函式呼叫 |
| Vertex AI | vertex_ai/deepseek-ai/deepseek-v3.1-maas | 164K | $1.35 | $5.40 | 聊天、推理、函式呼叫 |
| OpenRouter | openrouter/x-ai/grok-4-fast:free | 2M | $0.00 | $0.00 | 聊天、推理、函式呼叫 |
| XAI | xai/grok-4-fast-reasoning | 2M | $0.20 | $0.50 | 聊天、推理、函式呼叫 |
| XAI | xai/grok-4-fast-non-reasoning | 2M | $0.20 | $0.50 | 聊天、函式呼叫 |
功能
- Gemini
- XAI
- 新增 xai/grok-4-fast 模型 - PR #14833
- Anthropic
- Bedrock
- Vertex AI
- SambaNova
- 新增 sambanova deepseek v3.1 與 gpt-oss-120b - PR #14866
- OpenAI
- OpenRouter
- 將 gpt-5 與 gpt-5-codex 新增至 OpenRouter 成本對照表 - PR #14879
- VLLM
- 修正 vllm passthrough - PR #14778
- Flux
- 支援 flux 圖片編輯 - PR #14790
錯誤修正
- Anthropic
- OpenAI
- 修正 openai image edit 會靜默忽略多張圖片的錯誤 - PR #14893
- VLLM
- 修正:將 vLLM 提供者的 rerank 端點從 /v1/rerank 改為 /rerank - PR #14938
新增提供者支援
- W&B Inference
- 將 W&B Inference 新增至 LiteLLM - PR #14416
LLM API 端點
功能
錯誤
管理端點 / UI
功能
- Proxy CLI 驗證
虛擬金鑰
模型 + 端點
- 修正:將 Oracle 新增到提供者清單 - PR #14835
錯誤
- SSO - 修正:SSO「清除」按鈕會寫入空值,而不是移除 SSO 設定 - PR #14826
- 管理設定 - 從管理設定中移除實用連結 - PR #14918
- 管理路由 - 在管理路由中新增 /user/list - PR #14868
Logging / Guardrail / Prompt Management 整合
功能
- DataDog
- 記錄 -
datadog回呼記錄訊息內容,而不傳送至 datadog - PR #14909
- 記錄 -
- Langfuse
- 為快取 token 新增 langfuse 使用詳細資訊 - PR #10955
- Opik
- 改善 opik 整合程式碼 - PR #14888
- SQS
- 為 SQS 記錄器新增錯誤記錄支援 - PR #14974
防護欄
- LakeraAI v2 防護欄 - 確保例外能正確拋出 - PR #14867
- Presidio 防護欄 - 在 Presidio 防護欄中透過 Union[PiiEntityType, str] 支援自訂實體類型 - PR #14899
- Noma 防護欄 - 在 UI 中新增 noma 防護欄提供者 - PR #14415
提示管理
- BitBucket 整合 - 為 Prompt Management 新增 BitBucket 整合 - PR #14882
支出追蹤、預算與速率限制
- Service Tier 定價 - 為 openai 新增基於 service_tier 的定價支援(Service 與 Priority Support 皆適用) - PR #14796
- 成本追蹤 - 在 StandardLoggingPayload 中顯示輸入、輸出、工具呼叫成本明細 - PR #14921
- 平行請求限制器 v3
- Priority Reservation - 修正:Priority Reservation:沒有 priority metadata 的金鑰,會獲得比具有明確 priority 設定的金鑰更高的優先順序 - PR #14832
MCP 閘道
- MCP 設定 - 在 mcp_info 設定中啟用自訂欄位 - PR #14794
- MCP 工具 - 從 list_tools 移除 server_name 前綴 - PR #14720
- OAuth 流程 - v2 oauth flow 的初始提交 - PR #14964
效能 / 負載平衡 / 可靠性改善
- 記憶體洩漏修正 - 修正設定 TTL 時 InMemoryCache 的無界成長 - PR #14869
- 快取效能 - 修正:快取根本原因 - PR #14827
- 並行性修正 - 修正當許多 Python 執行緒使用 sync completions 進行串流時的並行性/擴充性 - PR #14816
- 效能最佳化 - 修正:將 get_deployment 成本降至 O(1) - PR #14967
- 效能最佳化 - 修正:移除緩慢的字串操作 - PR #14955
- 資料庫連線管理 - 修正:資料庫連線狀態重試 - PR #14925
文件更新
- 提供者文件 - 修正 provider_specific_params.md 的文件 - PR #14787
- 模型參考 - 將模型參考從 gemini-pro 更新為 gemini-2.5-pro - PR #14775
- Letta 指南 - 新增 Letta 指南文件 - PR #14798
- README - 讓 README 文件更清楚 - PR #14860
- Session Management - 更新 session management 可用性的文件 - PR #14914
- 成本文件 - 為自訂定價中額外的成本相關鍵值新增文件 - PR #14949
- Azure Passthrough - 新增 azure passthrough 文件 - PR #14958
- 一般文件 - 2025 年 9 月文件更新 - PR #14769
- 在文件中釐清端點與 mode 之間的橋接。
- 在相關指南中新增 Vertex AI Gemini API 設定作為替代方案。 在 Bedrock guardrails 文件中連結 AWS 驗證資訊。
- 新增包含程式碼片段的 Cancel Response API 使用方式
- 釐清 SSO(Single Sign-On)最多 5 位使用者免費:
- 將側邊欄按字母排序,並將快速開始/簡介保留在各分類頂部
- 在 cache_params 下記錄 max_connections。
- 釐清 IAM AssumeRole Policy 要求。
- 在 Getting Started 中新增 transform utilities 範例(展示請求轉換)。
- 在各文件中新增 models.litellm.ai 作為完整模型清單的參考。
- 新增 async_post_call_success_hook 的程式碼片段。
- 移除指向 callbacks 管理指南的失效連結。 - 重新排版並連結 cookbooks + 其他相關文件
- 文件更正 - 更正 2025 年 9 月文件更新 - PR #14916
新貢獻者
- @uzaxirr 在 PR #14761 中完成了首次貢獻
- @xprilion 在 PR #14416 中完成了首次貢獻
- @CH-GAGANRAJ 在 PR #14779 中完成了首次貢獻
- @otaviofbrito 在 PR #14778 中完成了首次貢獻
- @danielmklein 在 PR #14639 中完成了首次貢獻
- @Jetemple 在 PR #14826 中完成了首次貢獻
- @akshoop 在 PR #14818 中完成了首次貢獻
- @hazyone 在 PR #14821 中完成了首次貢獻
- @leventov 在 PR #14816 中完成了首次貢獻
- @fabriciojoc 在 PR #10955 中完成了首次貢獻
- @onlylonly 在 PR #14845 中完成了首次貢獻
- @Copilot 在 PR #14869 中完成了首次貢獻
- @arsh72 在 PR #14899 中完成了首次貢獻
- @berri-teddy 在 PR #14914 中完成了首次貢獻
- @vpbill 在 PR #14415 中完成了首次貢獻
- @kgritesh 在 PR #14893 中完成了首次貢獻
- @oytunkutrup1 在 PR #14858 中完成了首次貢獻
- @nherment 在 PR #14933 中完成了首次貢獻
- @deepanshululla 在 PR #14974 中完成了首次貢獻
- @TeddyAmkie 在 PR #14758 中完成了首次貢獻
- @SmartManoj 在 PR #14775 中完成了首次貢獻
- @uc4w6c 在 PR #14720 中完成了首次貢獻
- @luizrennocosta 在 PR #14783 中完成了首次貢獻
- @AlexsanderHamir 在 PR #14827 中完成了首次貢獻
- @dharamendrak 在 PR #14721 中完成了首次貢獻
- @TomeHirata 在 PR #14164 中完成了首次貢獻
- @mrFranklin 在 PR #14860 中完成了首次貢獻
- @luisfucros 在 PR #14866 中完成了首次貢獻
- @huangyafei 在 PR #14879 中完成了首次貢獻
- @thiswillbeyourgithub 在 PR #14949 中完成了首次貢獻
- @Maximgitman 在 PR #14965 中完成了首次貢獻
- @subnet-dev 在 PR #14938 中完成了首次貢獻
- @22mSqRi 在 PR #14972 中完成了首次貢獻