v1.63.14-stable
這些是自 v1.63.11-stable 以來的變更。
此版本帶來:
- LLM 翻譯改進(MCP 支援與 Bedrock Application Profiles)
- 用量型路由的效能改進
- 透過 websockets 的串流防護欄支援
- Azure OpenAI 用戶端效能修正(來自前一個版本)
執行 LiteLLM Proxy 的 Docker
docker run
-e STORE_MODEL_IN_DB=True
-p 4000:4000
docker.litellm.ai/berriai/litellm:main-v1.63.14-stable.patch1
示範執行個體
這裡有一個示範執行個體可用來測試變更:
- 執行個體:https://demo.litellm.ai/
- 登入憑證:
- 使用者名稱:admin
- 密碼:sk-1234
新模型 / 已更新模型
- Azure gpt-4o - 修正定價為最新全球定價 - PR
- O1-Pro - 新增定價 + 模型資訊 - PR
- Azure AI - 新增 mistral 3.1 small 定價 - PR
- Azure - 新增 gpt-4.5-preview 定價 - PR
LLM 翻譯
- 新 LLM 功能
- Bedrock:支援 bedrock application inference profiles 文件
- 從 bedrock application profile id 推斷 aws region - (
arn:aws:bedrock:us-east-1:...)
- 從 bedrock application profile id 推斷 aws region - (
- Ollama - 支援透過
/v1/completions呼叫 開始使用 - Bedrock - 支援
us.deepseek.r1-v1:0模型名稱 文件 - OpenRouter -
OPENROUTER_API_BASE環境變數支援 文件 - Azure - 新增音訊模型參數支援 - 文件
- OpenAI - PDF 檔案支援 文件
- OpenAI - o1-pro Responses API 串流支援 文件
- [BETA] MCP - 搭配 LiteLLM SDK 使用 MCP Tools 文件
- 錯誤修正
- Voyage:修正 embedding 追蹤中的 prompt token - PR
- Sagemaker - 修正「Content-Length 宣告的資料量過少」錯誤 - PR
- OpenAI 相容模型 - 修正呼叫設定了 custom_llm_provider 的 openai-compatible models 時的問題 - PR
- VertexAI - 支援 Embedding 的 ‘outputDimensionality’ - PR
- Anthropic - 在串流 / 非串流時回傳一致的 json 回應格式 - PR
支出追蹤改進
litellm_proxy/- 支援在使用 client sdk 時,從 proxy 讀取 litellm response cost header- 重設預算工作 - 修正 keys/teams/users 的預算重設錯誤 PR
- 串流 - 防止包含 usage 的最後一個 chunk 被忽略(影響 bedrock 串流 + 成本追蹤)PR
UI
- Users 頁面
- 功能:控制預設內部使用者設定 PR
- 圖示:
- 功能:以本機 svg 取代外部 "artificialanalysis.ai" 圖示 PR
- 登入 / 登出
- 修正:當
default_user_id使用者不存在於 DB 中時的預設登入 PR
- 修正:當
記錄整合
- 支援串流回應的 post-call 防護欄 開始使用
- Arize 開始使用
- StandardLoggingPayload - 在 payload 中記錄 litellm_model_name。可知道傳送到 API 提供者的模型是什麼 開始使用
- Prompt Management - 允許建置自訂 prompt management 整合 開始使用
效能 / 可靠性改進
- Redis 快取 - 新增 5 秒預設逾時,防止卡住的 redis 連線影響 llm 請求 PR
- 允許停用所有支出更新 / 寫入 DB - patch 可透過旗標停用所有支出更新至 DB PR
- Azure OpenAI - 正確重複使用 azure openai client,修正前一個 Stable 版本中的效能問題 PR
- Azure OpenAI - 在 Azure/OpenAI clients 上使用 litellm.ssl_verify PR
- 用量型路由 - 萬用字元模型支援 開始使用
- 用量型路由 - 支援批次寫入增量到 redis - 將延遲降低至與 ‘simple-shuffle’ 相同 PR
- Router - 在 ‘no healthy deployments available error’ 中顯示模型降溫原因 PR
- 快取 - 為記憶體快取中的項目新增最大值限制(1MB)- 防止大型 image url 經由 proxy 傳送時發生 OOM 錯誤 PR
一般改進
- Passthrough Endpoints - 支援在 pass-through endpoints Response Headers 回傳 api-base 文件
- SSL - 支援從環境變數讀取 ssl security level - 允許使用者指定較低的安全設定 開始使用
- Credentials - 只有在
STORE_MODEL_IN_DB為 True 時才輪詢 Credentials 表 PR - Image URL Handling - 關於 image url handling 的新架構文件 文件
- OpenAI - 升級至 pip install "openai==1.68.2" PR
- Gunicorn - 安全性修正 - 升級 gunicorn==23.0.0 PR