Auto Router v2:一個整合複雜度、語義與自適應路由的路由器
Auto Router v2 將 LiteLLM 的複雜度、語義與自適應路由器整合為單一路由器,搭配 LLM 分類器、關鍵字分層、多模型池與自適應 Thompson sampling。
AI Gateway
我們如何打造全球使用最廣泛的開放原始碼 AI 閘道,以及在路由、可靠性與可觀測性方面的實務心得。
人才招募中將最新文章寄到您的信箱
路由至超過 100 個提供者
Auto Router v2 將 LiteLLM 的複雜度、語義與自適應路由器整合為單一路由器,搭配 LLM 分類器、關鍵字分層、多模型池與自適應 Thompson sampling。
日期:2026 年 7 月 4 日至 2026 年 7 月 10 日
兩週的產品品質更新。我們修正了兩個重大問題(MCP 憑證解析與透傳記憶體),並總共推出 134 個錯誤修正。另有我們下一個目標:95% 的端到端測試涵蓋率。
歡迎於 7 月 23 日星期四上午 7:30(PT)參加 LiteLLM 7 月 townhall,了解 LiteLLM 的產品更新與路線圖。
LiteLLM 對 GPT-5.6 系列(Sol、Terra、Luna)的第 0 天支援。
平台管理員可在 LiteLLM proxy 上採取的實用槓桿,用來降低 Claude Code 支出,而無需要求開發者做任何變更。
LiteLLM AI Gateway 上對 Claude Sonnet 5 的第 0 天支援。可透過 Anthropic、Azure、Vertex AI 與 Bedrock 使用。
將 Headroom 作為 LiteLLM 上的 pre_call 防護欄,藉此在 Claude Code 與其他 LLM 流量上減少輸入 token。
June LiteLLM town hall 的回顧,涵蓋安全性強化、我們的零回歸承諾、78 個功能提交,以及 gateway 逐步遷移到 Rust。
在您的請求中保留 OpenAI code_interpreter tool,並在您自己的 sandbox 中執行程式碼。LiteLLM 會攔截 tool 呼叫並將其路由到 E2B 或 OpenSandbox;無需變更用戶端。
LiteLLM 正在將其 AI 閘道遷移到 Rust:15 倍吞吐量、少 11 倍記憶體,以及每次請求不到 1ms 的額外負擔。沒有 v2、沒有遷移,您的設定維持不變。
自 2026 年 6 月 29 日星期一起,LiteLLM 將主動支援最近四條穩定次版本線。較舊的版本線將進入生命週期結束,並且隨著新的穩定版本線發布,支援視窗會往前推進。
LiteLLM 現已支援在執行 valkey-search 模組的 Valkey 叢集上進行語意提示快取,包括 AWS ElastiCache for Valkey,且無需 RediSearch、Redis Stack 或 Qdrant。
請於 6 月 25 日星期四美西時間上午 7:30 參加 LiteLLM 6 月 townhall,瞭解 LiteLLM 的產品更新與路線圖。
LiteLLM AI Gateway 提供 Claude Fable 5 的第 0 天支援。可在 Anthropic、Azure、Vertex AI 與 Bedrock 上使用。
AI 閘道正往上層移動:從路由模型請求,走向路由代理程式工作。
LiteLLM 現已與 Microsoft ASSERT 整合,提供以政策驅動的代理程式評估——在問題進入正式環境前先攔截安全性與品質缺陷。
一個 SDK。只要更改字串即可在 Claude Code、Codex 與 Pi AI 之間切換。可搭配 LiteLLM AI Gateway 使用,提供金鑰、預算、記錄與備援。
揭露 LiteLLM proxy 中存在的 Host header 認證繞過。已在 v1.84.0 中處理。受影響的部署非常有限,且沒有任何 LiteLLM Cloud 客戶受到影響。
LiteLLM AI Gateway 對 Claude Opus 4.8 的 Day 0 支援。可透過 Anthropic、Azure、Vertex AI 和 Bedrock 使用。
我們如何在 LiteLLM AI Gateway 上打造一個背景代理程式,在沒有人工介入的情況下合併 PR(以及背後的基礎架構、harness 與憑證範圍設定作業)。
5 月 LiteLLM town hall 回顧,涵蓋 89 項安全修補、新的版本發布編號、MCP 工具集、效能提升,以及 LiteLLM Agent Platform。
在 LiteLLM Proxy 和 SDK 中使用 Gemini 3.5 Flash 的指南,提供 day 0 支援。
LiteLLM 現在支援 Google AI Studio Managed Agents API。透過 LiteLLM 建立、管理並執行自訂代理程式。
歡迎於 5 月 19 日星期二 PST 上午 7:30 參加 LiteLLM 5 月員工大會,了解 LiteLLM 的產品更新與路線圖。
LiteLLM 的 componentized deployment 如何將管理/UI 控制平面與 LLM 資料平面隔離,提升大規模下的可靠性。
2026 年 5 月 11 日,mistralai PyPI 套件的惡意版本被發布,作為協同供應鏈攻擊的一部分。LiteLLM 未受影響 — 我們僅透過 httpx 直接呼叫 Mistral,從不匯入 mistralai SDK。
在 LiteLLM Gateway 上啟動受沙箱隔離的代理程式工作階段 — 一個用於受管代理程式的控制平面,現已進入公開預覽。
CVE-2026-42208(LiteLLM Proxy 的 API key 驗證路徑中的 SQL injection)已修正。請升級至 v1.83.10-stable。
日期: 2026 年 4 月
移除 `-stable` 和 `-nightly` 後綴。每週發版將升級 MINOR;PATCH 現在保留給真正的 hotfix。舊版發佈會永久保留其標籤;新版將以 `1.84.0` 開始。
透過 Gemini API 和 Vertex AI 在 LiteLLM 上使用正式可用的 gemini-embedding-2 進行多模態嵌入——與預覽版相同的流程,且模型 ID 穩定。
LiteLLM 上 GPT-5.5 與 GPT-5.5 Pro 的 Day 0 支援。
CVE-2026-30623(透過 MCP stdio 傳輸進行的已驗證 RCE)已修復。請升級至 v1.83.6-nightly 或 v1.83.7-stable 或更新版本。
將 Akto 的基於模型偵測與 LiteLLM 的內建防護欄串接在一起——攔截僅靠模式比對檢查會漏掉的 PII、提示注入與政策違規。
Claude Opus 4.7 在 LiteLLM AI Gateway 上的 Day 0 支援 - 可跨 Anthropic、Azure、Vertex AI 和 Bedrock 使用。
LiteLLM 的正式環境 AI 閘道如何在大規模情況下處理 Redis 劣化而不發生連鎖故障 — 斷路器模式、0ms 快速失敗、自動復原。
4 月 LiteLLM town hall 的回顧,涵蓋 CI/CD v2、產品穩定性工作,以及近期藍圖。
LiteLLM v1.83.0 中已修補之安全漏洞的揭露,以及我們的漏洞賞金計畫啟動。
歡迎參加 LiteLLM 4 月市政大會,時間為 4 月 10 日星期五上午 7:30,了解 LiteLLM 的安全性與產品藍圖。
CI/CD v2 導入了隔離環境、更強的安全防護欄,以及為 LiteLLM 提供更安全的發佈分離。
LiteLLM 正與 Vanta 合作進行 SOC 2 Type 2 與 ISO 27001 重新認證,並聘請獨立稽核員進行驗證。
發生了什麼、我們已經做了什麼,以及 LiteLLM 的發布與安全流程接下來會如何演進。
截至 2026 年 3 月 24 日下午 2:00(ET)
日期: 2026 年 3 月 18 日
LiteLLM 中對 GPT-5.4-mini 與 GPT-5.4-nano 模型的支援
LiteLLM 現在支援在多次影片生成之間建立、擷取及管理可重複使用的 video characters。
使用 LiteLLM proxy 透過 HTTP 路由 OpenAI 風格的 WebRTC 即時通訊:client_secrets 與 SDP 交換。
LiteLLM 中對 GPT-5.4 模型的支援
在 LiteLLM Proxy 和 SDK 上使用 Gemini 3.1 Flash Lite Preview 的指南,具備 day 0 支援。
日期: 2026 年 2 月 27 日
LiteLLM 對 GPT-5.3-Codex 的 Day 0 支援,包括 Responses API 的 phase 參數處理。
日期: 2026 年 2 月 24 日
日期: 2026 年 2 月 23 日
日期: 2026 年 1 月 22 日
在 LiteLLM Proxy 和 SDK 上使用 Gemini 3.1 Pro 並提供 day 0 支援的指南。
日期: 2026 年 2 月 16 日
LiteLLM AI Gateway 對 Claude Sonnet 4.6 的第 0 天支援 - 可跨 Anthropic、Azure、Vertex AI 和 Bedrock 使用。
日期: 2026 年 2 月 13 日
LiteLLM 對 MiniMax-M2.5 的 Day 0 支援
日期: 2026 年 1 月 27 日
我們如何透過替換單一中介軟體基底類別,改善 LiteLLM proxy 的延遲與吞吐量
我們如何打造一套長時間執行的發佈驗證系統,在回歸問題到達使用者之前就將其攔截。
LiteLLM AI Gateway 對 Claude Opus 4.6 的第 0 天支援 - 可跨 Anthropic、Azure、Vertex AI 和 Bedrock 使用。
我們第一季的效能目標,以及在一般硬體上達成次毫秒級 Proxy 額外負擔的架構方向。
在 LiteLLM Proxy 與 SDK 上使用具備 day 0 支援的 Gemini 3 Flash 之指南。
LiteLLM 中 Claude Opus 4.5 與進階功能指南:Tool Search、Programmatic Tool Calling 與 Effort 參數。
使用 gemini-3-pro-preview 搭配 LiteLLM Proxy 和 SDK 的常見問題與最佳做法。
透過 LiteLLM 上的 gemini-embedding-2-preview,經由 Gemini API(每個輸入一個向量,與 OpenAI 相容)與 Vertex AI(每個請求一個單一整合向量),從文字、圖片、音訊、影片和 PDF 產生嵌入。