跳至主要內容

v1.63.14-stable

這些是自 v1.63.11-stable 以來的變更。

此版本帶來:

  • LLM 翻譯改進(MCP 支援與 Bedrock Application Profiles)
  • 用量型路由的效能改進
  • 透過 websockets 的串流防護欄支援
  • Azure OpenAI 用戶端效能修正(來自前一個版本)

執行 LiteLLM Proxy 的 Docker

docker run
-e STORE_MODEL_IN_DB=True
-p 4000:4000
docker.litellm.ai/berriai/litellm:main-v1.63.14-stable.patch1

示範執行個體

這裡有一個示範執行個體可用來測試變更:

新模型 / 已更新模型

  • Azure gpt-4o - 修正定價為最新全球定價 - PR
  • O1-Pro - 新增定價 + 模型資訊 - PR
  • Azure AI - 新增 mistral 3.1 small 定價 - PR
  • Azure - 新增 gpt-4.5-preview 定價 - PR

LLM 翻譯

  1. 新 LLM 功能
  • Bedrock:支援 bedrock application inference profiles 文件
    • 從 bedrock application profile id 推斷 aws region - (arn:aws:bedrock:us-east-1:...)
  • Ollama - 支援透過 /v1/completions 呼叫 開始使用
  • Bedrock - 支援 us.deepseek.r1-v1:0 模型名稱 文件
  • OpenRouter - OPENROUTER_API_BASE 環境變數支援 文件
  • Azure - 新增音訊模型參數支援 - 文件
  • OpenAI - PDF 檔案支援 文件
  • OpenAI - o1-pro Responses API 串流支援 文件
  • [BETA] MCP - 搭配 LiteLLM SDK 使用 MCP Tools 文件
  1. 錯誤修正
  • Voyage:修正 embedding 追蹤中的 prompt token - PR
  • Sagemaker - 修正「Content-Length 宣告的資料量過少」錯誤 - PR
  • OpenAI 相容模型 - 修正呼叫設定了 custom_llm_provider 的 openai-compatible models 時的問題 - PR
  • VertexAI - 支援 Embedding 的 ‘outputDimensionality’ - PR
  • Anthropic - 在串流 / 非串流時回傳一致的 json 回應格式 - PR

支出追蹤改進

  • litellm_proxy/ - 支援在使用 client sdk 時,從 proxy 讀取 litellm response cost header
  • 重設預算工作 - 修正 keys/teams/users 的預算重設錯誤 PR
  • 串流 - 防止包含 usage 的最後一個 chunk 被忽略(影響 bedrock 串流 + 成本追蹤)PR

UI

  1. Users 頁面
    • 功能:控制預設內部使用者設定 PR
  2. 圖示:
    • 功能:以本機 svg 取代外部 "artificialanalysis.ai" 圖示 PR
  3. 登入 / 登出
    • 修正:當 default_user_id 使用者不存在於 DB 中時的預設登入 PR

記錄整合

  • 支援串流回應的 post-call 防護欄 開始使用
  • Arize 開始使用
    • 修正無效的套件匯入 PR
    • 遷移為使用 standardloggingpayload 作為中繼資料,確保 spans 成功落地 PR
    • 修正記錄為僅記錄 LLM I/O PR
    • 動態 API 金鑰/Space 參數支援 開始使用
  • StandardLoggingPayload - 在 payload 中記錄 litellm_model_name。可知道傳送到 API 提供者的模型是什麼 開始使用
  • Prompt Management - 允許建置自訂 prompt management 整合 開始使用

效能 / 可靠性改進

  • Redis 快取 - 新增 5 秒預設逾時,防止卡住的 redis 連線影響 llm 請求 PR
  • 允許停用所有支出更新 / 寫入 DB - patch 可透過旗標停用所有支出更新至 DB PR
  • Azure OpenAI - 正確重複使用 azure openai client,修正前一個 Stable 版本中的效能問題 PR
  • Azure OpenAI - 在 Azure/OpenAI clients 上使用 litellm.ssl_verify PR
  • 用量型路由 - 萬用字元模型支援 開始使用
  • 用量型路由 - 支援批次寫入增量到 redis - 將延遲降低至與 ‘simple-shuffle’ 相同 PR
  • Router - 在 ‘no healthy deployments available error’ 中顯示模型降溫原因 PR
  • 快取 - 為記憶體快取中的項目新增最大值限制(1MB)- 防止大型 image url 經由 proxy 傳送時發生 OOM 錯誤 PR

一般改進

  • Passthrough Endpoints - 支援在 pass-through endpoints Response Headers 回傳 api-base 文件
  • SSL - 支援從環境變數讀取 ssl security level - 允許使用者指定較低的安全設定 開始使用
  • Credentials - 只有在 STORE_MODEL_IN_DB 為 True 時才輪詢 Credentials 表 PR
  • Image URL Handling - 關於 image url handling 的新架構文件 文件
  • OpenAI - 升級至 pip install "openai==1.68.2" PR
  • Gunicorn - 安全性修正 - 升級 gunicorn==23.0.0 PR

完整 Git Diff

這裡是完整的 git diff