v1.93.0rc1 - GPT-5.6、Client-Forwarded MCP Credentials 與 Meta Model API
部署此版本
- Docker
- Pip
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
docker.litellm.ai/berriai/litellm:1.93.0-rc.1
pip install litellm==1.93.0rc1
重點摘要
- GPT-5.6 與更多新模型 - OpenAI GPT-5.6(
sol/terra/luna)在 OpenAI 與 Azure 的 day-0 定價與中繼資料、xAI Grok-4.5、OpenAI Realtime 2.1(以及-mini)、Google Cloud Chirp 3 語音轉文字,以及 Bedrock Claude Opus 4.8 的jp區域推論設定檔。 - Meta Model API 提供者 - 新的 OpenAI 相容提供者(
meta)可在 Chat Completions、/v1/messages與 Responses 上 day-0 提供muse-spark-1.1。 - Client-forwarded MCP credentials - 新的
true_passthrough與oauth_delegate驗證模式,加上dcr_bridge密封信封路徑,讓用戶端可保有自己的上游 MCP 憑證,並對兩個 authorize 分支強制 PKCE S256,且將上游 discovery 綁定至每個伺服器。 - shadcn / Base UI 儀表板遷移 - 共用 DataTable、圖表(recharts)與全高側邊欄 shell 轉移到 Base UI 基元,並重新設計帳號選單與可重複使用的篩選/欄位可見性控制。
- 更智慧的複雜度路由器 - 關鍵字層級覆寫、語義關鍵字比對、可選的 LLM-based 分類器,以及自動路由器的每次決策路由記錄。
新提供者與端點
新提供者(1 個新提供者)
| 提供者 | 支援的 LiteLLM 端點 | 說明 |
|---|---|---|
Meta Model API (meta) | Chat Completions、/v1/messages、Responses | OpenAI 相容的 Meta Model API 提供者,可在 day-0 提供 muse-spark-1.1 - PR #32701 |
新模型 / 更新模型
新模型支援(31 個新定價項目)
| 提供者 | 模型 | 上下文視窗 | 輸入($/1M tokens) | 輸出($/1M tokens) | 功能 |
|---|---|---|---|---|---|
| OpenAI | gpt-5.6(以及 -sol / -terra / -luna) | 1.05M | $5.00(terra $2.50、luna $1.00) | $30.00(terra $15.00、luna $6.00) | 推理、視覺、函式呼叫、提示快取、PDF 輸入、網頁搜尋 |
| Azure | azure/gpt-5.6(以及 us / eu 區域 + -sol / -terra / -luna) | 1.05M | $5.00 | $30.00 | 推理、視覺、函式呼叫、提示快取、PDF 輸入、網頁搜尋 |
| Azure | azure/{us,eu}/gpt-5.4、azure/{us,eu}/gpt-5.5(data-zone + long-context) | 1.05M | $2.75 / $5.50 | $16.50 / $33.00 | 推理、視覺、函式呼叫、提示快取、PDF 輸入 |
| OpenAI | gpt-realtime-2.1、gpt-realtime-2.1-mini | 128K | $4.00 / $0.60 | $24.00 / $2.40 | 音訊輸入/輸出、函式呼叫 |
| xAI | xai/grok-4.5、xai/grok-4.5-latest | 500K | $2.00 | $6.00 | 推理、視覺、函式呼叫、網頁搜尋 |
| Meta | meta/muse-spark-1.1 | 1.05M | $1.25 | $4.25 | 推理、視覺、函式呼叫、提示快取、PDF 輸入、網頁搜尋 |
| Amazon Bedrock | jp.anthropic.claude-opus-4-8 | 1M | $5.50 | $27.50 | 推理、電腦使用、視覺、PDF 輸入、自適應思考 |
| Google Vertex AI | vertex_ai/chirp_3(Speech-to-Text) | n/a | $0.00026667 / sec | n/a | 音訊轉錄 |
GPT-5.6 在 OpenAI 與 Azure 皆提供 priority、flex、batch,以及高於 272k 的長上下文定價層級 - PR #32659、PR #32678。Azure gpt-5.4 / gpt-5.5 新增了 data-zone 與 long-context 項目 - PR #32279,而 Bedrock 區域推論設定檔現在會在 get_model_info 中解析為其區域定價 - PR #32389。
功能
- OpenAI
- Azure
- xAI
- 新增
xai/grok-4.5定價與中繼資料 - PR #32549
- 新增
- Meta
- 新增 Meta Model API 提供者與
muse-spark-1.1的 day-0 支援 - PR #32701
- 新增 Meta Model API 提供者與
- Amazon Bedrock
- Google Vertex AI
- 新增 Google Cloud Speech-to-Text Chirp 3 轉錄支援 - PR #32274
- Anthropic
錯誤修正
- Amazon Bedrock
- 保留 stream 參數並為 Bedrock Mantle 串流解碼 SSE - PR #32141
- 當 invoke Messages 串流結束且沒有
message_stop時,發出 SSE 錯誤事件 - PR #32159 - 在 strip-and-retry 重新簽署時,停止過時的 SigV4 標頭覆蓋新的簽章 - PR #32371
- 在訊息層級快取點上遵守
cache_controlttl - PR #32538, PR #32551 - 在 Claude Invoke 中保留對話中段的系統訊息,並以模型支援為條件 - PR #32578, PR #32831
- 在即時處理常式中遵守 AWS 驗證參數 - PR #32275
- Google Vertex AI
- Azure
- 以路徑在查詢字串之前來建構 responses
input_itemsURL - PR #32270
- 以路徑在查詢字串之前來建構 responses
- 一般
LLM API 端點
功能
- Responses API
- 轉送
- 串流非 SSE 的 pass-through 回應,而不是將它們緩衝在記憶體中 - PR #32386
- 一般
錯誤
- Responses API
- Rerank
- 以 debug 記錄
optional_rerank_params,使請求內容不會寫入記錄 - PR #32533
- 以 debug 記錄
- 一般
- 停止在 pass-through 中讓 request 參數覆蓋合併後的目標查詢參數 - PR #32404
管理端點 / UI
功能
- UI(shadcn / Base UI 遷移)
- 將 shadcn primitives 從 Radix 切換為 Base UI - PR #32124
- 新增共用的可組合 DataTable,並以 shadcn table primitives 重新設計樣式,包含篩選抽屜、欄位可見性與搜尋 - PR #32680, PR #32209, PR #32856
- shadcn charts 基礎,搭配相容 tremor 的包裝器,並將 caching、projects、activity、usage 與 per-user 圖表轉換為 shadcn/recharts - PR #32668, PR #32721, PR #32722, PR #32725, PR #32726, PR #32729
- 全高側邊欄 shell,搭配內容範圍的頂部列、重新設計的帳戶選單,以及共用的 CopyButton - PR #32793, PR #32931, PR #32945
- 型別化的 openapi-fetch 基礎(
fetchClient),附帶第一個型別化呼叫端 - PR #29884
- 儀表板
- 驗證與管理
- 具有 JSON merge patch 語義的 RESTful
PATCH /team/{team_id},可由組織管理員存取 - PR #32883 - 當 token 沒有 team claims 時,JWT 驗證會回退到 DB team memberships - PR #31356
- 用於 Claude Code
apiKeyHelper支援的lite auth print-token- PR #32846 - 為
GET /key/list新增expires篩選器 - PR #32953 - 使 Microsoft Graph endpoint 可針對 GCC High 設定 - PR #32517
- 具有 JSON merge patch 語義的 RESTful
錯誤
- UI
- 將 key models 下拉選單選項範圍限制為該 key 的 team - PR #32382
- 載入時反映已儲存的「Store Prompts in Spend Logs」切換狀態 - PR #32145
- 防止 reasoning 區塊擴大 chat playground 版面配置 - PR #32485
- 將 Virtual Keys 的「Key Hash」篩選標籤重新命名為「Key ID」 - PR #32672
- 透過 UI primitives 傳遞 refs,並在 refs 被吞掉時讓測試失敗 - PR #32401
- 移除 lite CLI 中
--base-url的尾隨斜線 - PR #32845
- 驗證與管理
AI 整合
記錄
- OpenTelemetry
- Prometheus
- 當 gauge 為 NoOpMetric 時,略過 budget metric 的 DB/cache 查詢 - PR #32834
- DataDog
- 事先拆分記錄批次,以維持在 intake payload 限制內 - PR #32860
- 一般
防護欄
- Model Armor
- 在
pre_mcp_call/during_mcp_call模式中掃描 MCP 工具呼叫 - PR #32296
- 在
- 內容過濾器
- 為 Content Filter 新增
pre_mcp_call支援 - PR #32936
- 為 Content Filter 新增
- CrowdStrike AIDR
- 僅傳送自上一個 assistant 回合以來的新訊息 - PR #31974
- GraySwan
- 傳遞 GraySwan 掃描 id 標頭 - PR #32544
- 一般
- 在共用內容輔助工具中遍歷 Responses-API 文字分類體系 - PR #32542
- 透過對 Bedrock guardrails 提升
ModifyResponseException,以遵守disable_exception_on_block- PR #32289 - 在沒有 false-COMPLIANT 結果的情況下比對多模式
guardrail_mode- PR #32832 - 依提供者篩選 Add-Guardrail 模式下拉選單 - PR #32712
- 在持久化前遮罩嵌入於
guardrail_response中的憑證 - PR #32687 - 在 headroom guardrail 上記錄真實 token/壓縮統計資料 - PR #32158
密鑰管理器
- 一般
- 強化外部 secret-manager 名稱驗證 - PR #32092
支出追蹤、預算與速率限制
- 預算
- 速率限制
- 成本追蹤
- 強制執行 Dashscope tiered pricing 的預算與成本追蹤 - PR #32942
- 在 batch 成本工作中正確計價 Anthropic pass-through 訊息批次 - PR #32307
- 當
group_by=team時,依team_id篩選/global/spend/report- PR #32170 - 在記錄 UI 中加總多輪 session 成本,並限制 logs 分頁數量 - PR #32796, PR #31825
- 遵守
store_prompts_in_spend_logs於guardrail_information- PR #32688
MCP 閘道
- 用戶端轉送的憑證 (
true_passthrough/oauth_delegate/dcr_bridge)- 新增
true_passthrough與oauth_delegate驗證模式,並將上游 OAuth discovery 綁定到各個 server - PR #31989, PR #32414 - 新增
dcr_bridge資料欄與接線、供用戶端持有憑證使用的 sealed-envelope 模組,以及 discovery facade 與 register/token relay,並強制使用 PKCE S256 - PR #32745, PR #32748, PR #32753, PR #32747 - 透過單一 envelope bearer 接受
dcr_bridgeoauth_delegate用戶端,並提供 key derivation 的消費者輔助工具 - PR #32824, PR #32794 - 在用戶端轉送的 pass-through 工具呼叫上轉送上游 401 - PR #32556
- 新增
- OAuth 2.0(On-Behalf-Of)
- 語意過濾
- Bug 修正
效能/負載平衡/可靠性改善
- 路由
- 可靠性
- 當 client 已中斷連線時,復原 Prisma DB reconnect 迴圈 - PR #32323
- 獨立設定 coordination Redis 與 response cache,並從
REDIS_*env 建立 usage cache - PR #32661, PR #32635 - 僅在連線池 kwargs 中 ssl 為 truthy 時使用
SSLConnection- PR #32825 - 將 Prometheus
/metricsMount 保留在 gateway route trim 中 - PR #32317 - 將
general_settingsrequest allowlist 接到 litellm globals - PR #32243
- 熱路徑
文件更新
- 將 OSS 貢獻者導向每日 OSS 分支 - PR #32830
依擁有權區域彙整的 PR
依擁有區域分類的 PR 數量(總計:240)
- 其他(CI / chore / tests / 重構 / 版本號更新):56
- UI:42
- MCP:36
- 模型與提供者:31
- 效能:14
- 支出 / 預算 / 速率限制:13
- LLM API 端點:13
- 防護欄:10
- 驗證與管理:9
- 記錄:9
- 文件:6
- 密鑰管理器:1
新貢獻者
完整變更記錄
https://github.com/BerriAI/litellm/compare/v1.92.0-rc.1...v1.93.0-rc.1