v1.83.14 - GPT-5.5、Prompt Compression 與 Memory API
部署此版本
- Docker
- Pip
docker run \
-e STORE_MODEL_IN_DB=True \
-p 4000:4000 \
docker.litellm.ai/berriai/litellm:main-v1.83.14-stable
pip install litellm==1.83.14
主要亮點
- 即日支援 GPT-5.5 與 GPT-5.5 Pro — OpenAI 與 Azure 版本附帶完整價格對照表、日期化快照,以及 Pro 層級的 Responses 模式路由。
- 伺服器端 Prompt Compression — 一級代理回呼,在長上下文輸入(Claude Code、RAG、文件工作負載)送達上游模型前透明壓縮,無需用戶端選擇啟用。
/v1/memoryCRUD 端點 — 代理現在公開一個記憶體儲存 API,具備 Prisma 支援的中繼資料,由新的 agent loop 使用。- LLM-as-a-Judge 防護欄 — 以模型評分的請求後防護欄,具備可設定的評分準則,加入 Bedrock / Lakera / Presidio / Noma 家族。
- MCP OAuth 強化 — 可發現的 + BYOK authorize/token 端點已加強,臨時 OAuth 工作階段現在透過 Redis 在代理執行個體間共享,而且每個伺服器的存取政策在代理與 broker 中都一致執行。
- 成員級團隊預算正式上線 — 個別成員預算、Teams UI 中的每位成員週期呈現,以及用於使用者/組織支出檢查的原子計數器對齊。
- 自適應路由 — 可選用的路由器政策,在既有萬用字元備援之上,依近期延遲/錯誤歷史加權部署。
新模型/更新模型
新模型支援(22 個新模型)
| 提供者 | 模型 | 上下文視窗 | 輸入($/百萬 tokens) | 輸出($/百萬 tokens) | Mode |
|---|---|---|---|---|---|
| OpenAI | gpt-5.5, gpt-5.5-2026-04-23 | 1,050,000 | $5.00 | $30.00 | 聊天 |
| OpenAI | gpt-5.5-pro, gpt-5.5-pro-2026-04-23 | 1,050,000 | $60.00 | $360.00 | responses |
| OpenAI | gpt-5.4-mini-2026-03-17 | 272,000 | $0.75 | $4.50 | 聊天 |
| OpenAI | gpt-5.4-nano-2026-03-17 | 272,000 | $0.20 | $1.25 | 聊天 |
| Azure OpenAI | azure/gpt-5.5, azure/gpt-5.5-2026-04-23 | 1,050,000 | $5.00 | $30.00 | 聊天 |
| Azure OpenAI | azure/gpt-5.5-pro, azure/gpt-5.5-pro-2026-04-23 | 1,050,000 | $60.00 | $360.00 | responses |
| Azure OpenAI | azure/gpt-5.4-mini-2026-03-17 | 1,050,000 | $0.75 | $4.50 | 聊天 |
| Azure OpenAI | azure/gpt-5.4-nano-2026-03-17 | 1,050,000 | $0.20 | $1.25 | 聊天 |
| AWS Bedrock | anthropic.claude-mythos-preview | 1,000,000 | - | - | 聊天 |
| AWS Bedrock | bedrock/us-east-1/zai.glm-5, bedrock/us-west-2/zai.glm-5 | 200,000 | $1.00 | $3.20 | 聊天 |
| AWS Bedrock | bedrock/us-east-1/minimax.minimax-m2.5, bedrock/us-west-2/minimax.minimax-m2.5 | - | - | - | 聊天 |
| Moonshot | moonshot/kimi-k2.6 | 262,144 | $0.95 | $4.00 | 聊天 |
| OpenRouter | openrouter/anthropic/claude-opus-4.7 | 1,000,000 | $5.00 | $25.00 | 聊天 |
| Gemini | gemini/gemini-embedding-2, gemini-embedding-2, vertex_ai/gemini-embedding-2 | 8,192 | $0.20 | - | embedding |
| DashScope | dashscope/qwen-image-2.0, dashscope/qwen-image-2.0-pro | - | - | - | image_generation |
功能
- Bedrock
- OpenAI
- Azure OpenAI
- 具日期版本的
azure/gpt-5.5+azure/gpt-5.5-pro項目 - PR #26361
- 具日期版本的
- Gemini
- Vertex AI
- 多區域 Vertex hosts (
aiplatform.*.rep.googleapis.com) - PR #26281
- 多區域 Vertex hosts (
- DashScope
- 支援
qwen-image-2.0與qwen-image-2.0-pro的圖片生成 - PR #25672
- 支援
- Moonshot
- 將
moonshot/kimi-k2.6加入模型登錄檔 - PR #26203
- 將
- Anthropic
- 將已停用的
claude-3-haiku-20240307參照遷移至claude-haiku-4-5-20251001- PR #26139
- 將已停用的
- 一般
- 將 38 個模型從舊版
max_tokens遷移至max_input_tokens/max_output_tokens- PR #24422
- 將 38 個模型從舊版
錯誤修正
- Anthropic
- Azure
- 在搭配
include_usage的串流中保留role='assistant'- PR #24354
- 在搭配
- Bedrock
- Gemini
- Vertex AI
- 在
multimodalembedding請求中轉送dimensions參數 - PR #24415
- 在
- Zhipu / GLM
- 映射非標準
finish_reason值 - PR #24373
- 映射非標準
- OVHcloud
- 修正 tool calling 無法運作的問題 - PR #25948
- Scaleway
- 新增音訊支援 - PR #26110
LLM API 端點
功能
- Responses API
- Anthropic Messages API
- 記憶 API
- 一般
- 在 Responses API 中套用 GPT-5 temperature 驗證 - PR #24371
錯誤修正
- Responses API
- 標準化橋接的 object 欄位 - PR #26327
- Anthropic Messages API
- 在
/v1/messages記錄中保留anthropic_messages呼叫類型 - PR #26248
- 在
- Image API
- Vector Stores
- 記憶 API
- 在
/v1/memory前將 metadata 轉為 JSON 後再寫入 Prisma - PR #26536
- 在
- 一般
- 強化 passthrough 目標 URL 建構 - PR #26467
管理端點 / UI
功能
- 虛擬金鑰 / 驗證
- UI
- 重構
- 將 projects 管理移至 enterprise 套件 - PR #25677
錯誤修正
- 虛擬金鑰 / 驗證
- 集中處理
common_checks以封堵授權繞過 - PR #26279 - 收緊 key 路由欄位上的呼叫端權限檢查 - PR #26492
- 將呼叫端權限檢查擴展至 service-account + 收緊 raw-body 接受條件 - PR #26493
- 在
/key/regenerate上強制執行upperbound_key_generate_params- PR #26340 - 在
/key/update的 metadata 中保留service_account_id- PR #26004 - 將
/global/spend/*路由限制為 admin 角色 - PR #26490 - 強化
/team/new與/team/update中的團隊 metadata 處理 - PR #26464 - 將請求本文參數限制擴展至雲端提供者 auth 欄位 - PR #26264
- 在提供者 URL 參數上強制執行格式限制 - PR #26287
- 將 RAG ingestion 設定繫結到已儲存的憑證值 - PR #26512
- 將 RAG ingestion 憑證清理範圍擴大至 AWS endpoint/identity 欄位 - PR #26525
- 強化
/model/info對複數憑證欄位名稱的遮罩 - PR #26513
- 集中處理
- UI
- 在 model 編輯時停止注入 $0 成本 - PR #26001
AI 整合
記錄
- 一般
- 將
litellm_call_id新增至StandardLoggingPayload與 OTel span - PR #26133
- 將
- Vertex AI Passthrough
- 記錄
:embedContent與:batchEmbedContents回應 - PR #26146
- 記錄
防護欄
- Bedrock 防護欄
- LLM-as-a-Judge
- 推出 LLM-as-a-Judge 防護欄 - PR #26360
- 一般
支出追蹤、預算與速率限制
- 每位成員的預算
- 速率限制
- 在 counter miss 時,從資料庫重新播種 enforcement 讀取路徑 - PR #26459
- 預算
MCP 閘道
- OAuth
- 權限 / 路由
- 工具篩選
- 在
mcp_semantic_tool_filter中比對帶有用戶端命名空間前綴的工具 - PR #26117
- 在
效能 / 負載平衡 / 可靠性改善
- 路由
- Prompt 壓縮
- 一等公民的伺服器端 prompt 壓縮回呼 - PR #25729
- 可靠性
- 修正資料庫無法連線時的
/health/readiness503 迴圈 - PR #26134
- 修正資料庫無法連線時的
- 開發者易用性
- 供 uvicorn 熱重載使用的
--reload旗標(僅限開發)- PR #25901
- 供 uvicorn 熱重載使用的
一般 Proxy 改進
- 建置 / Docker
- 遷移
- CI / 基礎設施
- 將更多 CI 工作從 CircleCI 遷移到 GitHub Actions - PR #26261
- CCI:快取、清理、anchors、install-path 一致性、Python 3.12、Ruby/Node pins - PR #26286
- CircleCI 設定清理與整併 - PR #26226
- 加快 proxy 單元測試並將
proxy-utils拆成獨立的 matrix 項目 - PR #26150 - 移除 CCI/GHA 測試重複並以語意方式分片 proxy DB 測試 - PR #26356
- 獨立的
create-release-branch工作流程 +contents:write權限 - PR #26342, PR #26359 - 供應鏈防護以封鎖修改依賴項的 fork PR - PR #26511
- 對
auth_ui_unit_tests使用 Postgres sidecar,而非共享資料庫 - PR #26141 - 修正 Ubuntu 上
e2e_ui_testing的 stale-bundle 問題(cp -r合併語意)- PR #26047 - 套用 black 格式化以修正 CI lint 失敗 - PR #26140
- 測試穩定性
- 封裝 / 依賴項
- UI
- 雜項
- 在
is_model_gpt_5_model中以startswith取代子字串檢查 - PR #25793
- 在
文件更新
- 在 View All 頁面新增缺少的可觀測性整合 - PR #24420
- 釐清 proxy 文件中的
x-litellm-model-group與提供者 model id 之間的差異 - PR #25497 - Gemini 3 thinking_level 預設值與發行說明 - PR #25842
- 對齊部落格與文件頁面的 fenced code block padding - PR #25932
- 在 prompt caching 文件中新增支援的提供者 - PR #26124
- 移除
docs/my-website,將貢獻者導向BerriAI/litellm-docs- PR #26454
新貢獻者
- @dongyu-turo 首次貢獻於 #24164
- @Alpha-Zark 首次貢獻於 #25672
- @vinhphamhuu-ct 首次貢獻於 #25767
- @Bytechoreographer 首次貢獻於 #25788
- @BraulioV 首次貢獻於 #25793
- @Vigilans 首次貢獻於 #25883
- @nhyy244 首次貢獻於 #26110
- @sakenuGOD 首次貢獻於 #26117
- @Michael-RZ-Berri 首次貢獻於 #26124
- @anmolg1997 首次貢獻於 #26228
完整變更記錄: https://github.com/BerriAI/litellm/compare/v1.83.10-stable...v1.83.14-stable
04/27/2026
- 新模型 / 更新模型:29
- LLM API 端點:18
- 管理端點 / UI:23
- AI 整合(記錄 / 防護欄):11
- 支出追蹤、預算與速率限制:6
- MCP 閘道:8
- 效能 / 負載平衡 / 可靠性改善:5
- 一般 Proxy 改進:27
- 文件更新:6