跳至主要內容

CLI - 快速開始

透過 CLI 快速設定 LiteLLM Proxy。

LiteLLM Server(LLM 閘道)管理:

$ uv tool install 'litellm[proxy]'

快速開始 - LiteLLM Proxy CLI

執行以下命令以啟動 litellm proxy

$ litellm --model huggingface/bigcode/starcoder

#INFO: Proxy running on http://0.0.0.0:4000
資訊

若您需要詳細的除錯記錄,請使用 --detailed_debug

$ litellm --model huggingface/bigcode/starcoder --detailed_debug

Test

In a new shell, run, this will make an openai.chat.completions request. Ensure you're using openai v1.0.0+

litellm --test

這現在會自動將所有對 gpt-3.5-turbo 的請求路由到託管於 huggingface inference endpoints 的 bigcode starcoder。

支援的 LLM

LiteLLM 支援的所有 LLM 都支援在 Proxy 上使用。查看所有支援的 llms

$ export AWS_ACCESS_KEY_ID=
$ export AWS_REGION_NAME=
$ export AWS_SECRET_ACCESS_KEY=
$ litellm --model bedrock/anthropic.claude-v2

快速開始 - LiteLLM Proxy + Config.yaml

此設定讓您可以建立模型清單並設定 api_basemax_tokens(所有 litellm 參數)。關於設定的更多詳細資訊請見這裡

為 LiteLLM Proxy 建立設定

設定範例

model_list: 
- model_name: gpt-3.5-turbo # user-facing model alias
litellm_params: # all params accepted by litellm.completion() - https://docs.litellm.ai/docs/completion/input
model: azure/<your-deployment-name>
api_base: <your-azure-api-endpoint>
api_key: <your-azure-api-key>
- model_name: gpt-3.5-turbo
litellm_params:
model: azure/gpt-turbo-small-ca
api_base: https://my-endpoint-canada-berri992.openai.azure.com/
api_key: <your-azure-api-key>
- model_name: vllm-model
litellm_params:
model: openai/<your-model-name>
api_base: <your-vllm-api-base> # e.g. http://0.0.0.0:3000/v1
api_key: <your-vllm-api-key|none>

使用設定執行 proxy

litellm --config your_config.yaml

使用 LiteLLM Proxy - Curl 請求、OpenAI 套件、Langchain

資訊

LiteLLM 與多個 SDK 相容 - 包括 OpenAI SDK、Anthropic SDK、Mistral SDK、LLamaIndex、Langchain(Js、Python)

更多範例請見這裡

curl --location 'http://0.0.0.0:4000/chat/completions' \
--header 'Content-Type: application/json' \
--data ' {
"model": "gpt-3.5-turbo",
"messages": [
{
"role": "user",
"content": "what llm are you"
}
]
}
'

更多資訊

📖 Proxy 端點 - Swagger 文件

  • POST /chat/completions - 呼叫 100+ 個 LLM 的聊天完成端點
  • POST /completions - 完成端點
  • POST /embeddings - Azure、OpenAI、Huggingface 端點的嵌入端點
  • GET /models - 伺服器上的可用模型
  • POST /key/generate - 產生用於存取 proxy 的金鑰

除錯 Proxy

正常運作期間發生的事件

litellm --model gpt-3.5-turbo --debug

詳細資訊

litellm --model gpt-3.5-turbo --detailed_debug

使用環境變數設定除錯等級

正常運作期間發生的事件

export LITELLM_LOG=INFO

詳細資訊

export LITELLM_LOG=DEBUG

沒有記錄

export LITELLM_LOG=None