| ACTIONS_ID_TOKEN_REQUEST_TOKEN | 用於在 GitHub Actions 中請求 ID token 的 Token |
| ACTIONS_ID_TOKEN_REQUEST_URL | 用於在 GitHub Actions 中請求 ID token 的 URL |
| AGENTOPS_ENVIRONMENT | AgentOps 記錄整合的環境 |
| AGENTOPS_API_KEY | AgentOps 記錄整合的 API 金鑰 |
| AGENTOPS_SERVICE_NAME | AgentOps 記錄整合的服務名稱 |
| AISPEND_ACCOUNT_ID | AI Spend 的帳戶 ID |
| AISPEND_API_KEY | AI Spend 的 API 金鑰 |
| AIOHTTP_CONNECTOR_LIMIT | aiohttp connector 的連線限制。設為 0 時,不套用限制。預設為 0 |
| AIOHTTP_CONNECTOR_LIMIT_PER_HOST | aiohttp connector 每個主機的連線限制。設為 0 時,不套用限制。預設為 0 |
| AIOHTTP_KEEPALIVE_TIMEOUT | aiohttp 連線的 keep-alive 逾時時間(秒)。預設為 120 |
| AIOHTTP_SO_KEEPALIVE | 在 aiohttp socket 上啟用 TCP SO_KEEPALIVE,以便偵測閒置的提供者連線,並在 NAT/負載平衡器悄然丟棄之前將其回收。預設為 False |
| AIOHTTP_TCP_KEEPCNT | 在連線被視為已失效之前,未確認的 TCP keepalive 探測次數(適用於 AIOHTTP_SO_KEEPALIVE=True 時)。預設為 5 |
| AIOHTTP_TCP_KEEPIDLE | aiohttp TCP 連線在送出 keepalive 探測前必須處於閒置的秒數(適用於 AIOHTTP_SO_KEEPALIVE=True 時)。預設為 60 |
| AIOHTTP_TCP_KEEPINTVL | aiohttp TCP keepalive 探測之間的秒數(適用於 AIOHTTP_SO_KEEPALIVE=True 時)。預設為 30 |
| AIOHTTP_TRUST_ENV | 啟用 aiohttp trust environment 的旗標。設為 True 時,aiohttp 會尊重 HTTP(S)_PROXY 環境變數。預設為 False |
| AIOHTTP_TTL_DNS_CACHE | aiohttp 的 DNS 快取存活時間(秒)。預設為 300 |
| AKTO_GUARDRAIL_API_BASE | Akto Guardrail API 的基礎 URL(例如 http://localhost:9090)。由 Akto guardrail 整合使用。 |
| AKTO_API_KEY | 用於向 Akto Guardrail 服務驗證的 API 金鑰。 |
| ALLOWED_EMAIL_DOMAINS | 允許存取的電子郵件網域清單 |
| APSCHEDULER_COALESCE | 是否將工作中多個待處理的執行合併為一個。預設為 False |
| APSCHEDULER_MAX_INSTANCES | 每個工作的最大並行執行個數。預設為 1 |
| APSCHEDULER_MISFIRE_GRACE_TIME | 排程錯過執行的寬限時間(秒)。預設為 1 |
| APSCHEDULER_REPLACE_EXISTING | 是否以相同 ID 的新工作取代既有工作。預設為 False |
| ARIZE_API_KEY | Arize 平台整合的 API 金鑰 |
| ARIZE_SPACE_KEY | Arize 平台的 Space key |
| ARGILLA_BATCH_SIZE | Argilla 記錄的批次大小 |
| ARGILLA_API_KEY | Argilla 平台的 API 金鑰 |
| ARGILLA_SAMPLING_RATE | Argilla 記錄的取樣率 |
| ARGILLA_DATASET_NAME | Argilla 記錄的資料集名稱 |
| ARGILLA_BASE_URL | Argilla 服務的基礎 URL |
| ATHINA_API_KEY | Athina 服務的 API 金鑰 |
| ATHINA_BASE_URL | Athina 服務的基礎 URL(預設為 https://log.athina.ai) |
| AUTH_STRATEGY | 用於驗證的策略(例如:OAuth、API key) |
| AUTO_REDIRECT_UI_LOGIN_TO_SSO | 啟用在已設定 SSO 時,自動將 UI 登入頁面重新導向到 SSO 的旗標。預設為 false |
| AUDIO_SPEECH_CHUNK_SIZE | 音訊語音處理的區塊大小。預設為 1024 |
| ANTHROPIC_API_KEY | Anthropic 服務的 API 金鑰。使用 x-api-key 標頭進行驗證。 |
| ANTHROPIC_AUTH_TOKEN | Anthropic 服務的替代驗證 Token。使用 Authorization: Bearer 標頭,取代 x-api-key。當未設定 ANTHROPIC_API_KEY 時作為備援。 |
| ANTHROPIC_API_BASE | Anthropic API 的基礎 URL。預設為 https://api.anthropic.com |
| ANTHROPIC_BASE_URL | 用於設定 Anthropic API 基礎 URL 的 ANTHROPIC_API_BASE 替代方案。當未設定 ANTHROPIC_API_BASE 時作為備援。 |
| ANTHROPIC_TOKEN_COUNTING_BETA_VERSION | Anthropic token 計數 API 的 beta 版本標頭。預設為 token-counting-2024-11-01 |
| AWS_ACCESS_KEY_ID | AWS 服務的 Access Key ID |
| AWS_BATCH_ROLE_ARN | 用於批次作業的 AWS IAM role ARN |
| AWS_DEFAULT_REGION | 當未設定 AWS_REGION 時,用於服務互動的預設 AWS 區域 |
| AWS_PROFILE_NAME | 要使用的 AWS CLI 設定檔名稱 |
| AWS_REGION | 用於服務互動的 AWS 區域(優先於 AWS_DEFAULT_REGION) |
| AWS_REGION_NAME | 用於服務互動的預設 AWS 區域 |
| AWS_ROLE_ARN | 要假設以進行驗證的 AWS IAM role ARN |
| AWS_ROLE_NAME | AWS IAM 使用的 role 名稱 |
| AWS_S3_BUCKET_NAME | 用於檔案操作的 AWS S3 bucket 名稱 |
| AWS_S3_OUTPUT_BUCKET_NAME | 用於批次作業的 AWS S3 輸出 bucket 名稱 |
| AWS_SECRET_ACCESS_KEY | AWS 服務的 Secret Access Key |
| AWS_SESSION_NAME | AWS session 名稱 |
| AWS_WEB_IDENTITY_TOKEN | AWS 的 web identity token |
| AWS_WEB_IDENTITY_TOKEN_FILE | 包含 AWS web identity token 的檔案路徑 |
| AZURE_API_VERSION | 所使用的 Azure API 版本 |
| AZURE_AI_API_BASE | Azure AI 服務的基礎 URL(例如:Azure AI Anthropic) |
| AZURE_AI_API_KEY | Azure AI 服務的 API 金鑰(例如:Azure AI Anthropic) |
| AZURE_AUTHORITY_HOST | Azure authority host URL |
| AZURE_CERTIFICATE_PASSWORD | Azure OpenAI 憑證密碼 |
| AZURE_CLIENT_ID | Azure 服務的 Client ID |
| AZURE_CLIENT_SECRET | Azure 服務的 Client secret |
| AZURE_COMPUTER_USE_INPUT_COST_PER_1K_TOKENS | Azure Computer Use 服務每 1K token 的輸入成本 |
| AZURE_COMPUTER_USE_OUTPUT_COST_PER_1K_TOKENS | Azure Computer Use 服務每 1K token 的輸出成本 |
| AZURE_DEFAULT_RESPONSES_API_VERSION | 所使用的 Azure Default Responses API 版本。預設為 "preview" |
| AZURE_DOCUMENT_INTELLIGENCE_API_VERSION | Azure Document Intelligence 服務的 API 版本 |
| AZURE_DOCUMENT_INTELLIGENCE_DEFAULT_DPI | Azure Document Intelligence 服務的預設 DPI(每英吋點數)設定 |
| AZURE_TENANT_ID | Azure Active Directory 的 Tenant ID |
| AZURE_USERNAME | Azure 服務的使用者名稱,與 AZURE_PASSWORD 一起使用,以便在 azure ad token 的基本使用者名稱/密碼流程中使用 |
| AZURE_PASSWORD | Azure 服務的密碼,與 AZURE_USERNAME 一起使用,以便在 azure ad token 的基本使用者名稱/密碼流程中使用 |
| AZURE_FEDERATED_TOKEN_FILE | Azure federated token 檔案路徑 |
| AZURE_FILE_SEARCH_COST_PER_GB_PER_DAY | Azure File Search 服務每 GB 每日成本 |
| AZURE_SCOPE | 對於 EntraID Auth,Azure 服務的 Scope,預設為 "https://cognitiveservices.azure.com/.default" |
| AZURE_SENTINEL_DCR_IMMUTABLE_ID | Azure Sentinel 記錄用資料收集規則的不可變 ID |
| AZURE_SENTINEL_STREAM_NAME | Azure Sentinel 記錄的串流名稱 |
| AZURE_SENTINEL_AUDIT_STREAM_NAME | Azure Sentinel 稽核記錄的串流名稱;未設定時回退至 AZURE_SENTINEL_STREAM_NAME |
| AZURE_SENTINEL_CLIENT_SECRET | Azure Sentinel 驗證的 Client secret |
| AZURE_SENTINEL_ENDPOINT | Azure Sentinel 記錄的端點 |
| AZURE_SENTINEL_TENANT_ID | Azure Sentinel 驗證的 Tenant ID |
| AZURE_SENTINEL_CLIENT_ID | Azure Sentinel 驗證的 Client ID |
| AZURE_KEY_VAULT_URI | Azure Key Vault 的 URI |
| AZURE_OPERATION_POLLING_TIMEOUT | Azure 操作輪詢的逾時時間(秒) |
| AZURE_STORAGE_ACCOUNT_KEY | 用於驗證 Azure Blob Storage 記錄的 Azure Storage Account Key |
| AZURE_STORAGE_ACCOUNT_NAME | 用於記錄到 Azure Blob Storage 的 Azure Storage Account 名稱 |
| AZURE_STORAGE_FILE_SYSTEM | 用於記錄到 Azure Blob Storage 的 Azure Storage File System 名稱。(通常是 Container 名稱) |
| AZURE_STORAGE_TENANT_ID | 用於驗證 Azure Blob Storage 記錄的 Application Tenant ID |
| AZURE_STORAGE_CLIENT_ID | 用於驗證 Azure Blob Storage 記錄的 Application Client ID |
| AZURE_STORAGE_CLIENT_SECRET | 用於驗證 Azure Blob Storage 記錄的 Application Client Secret |
| AZURE_VECTOR_STORE_COST_PER_GB_PER_DAY | Azure Vector Store 服務每 GB 每日成本 |
| BACKGROUND_HEALTH_CHECK_MAX_TOKENS | 當模型沒有 health_check_max_tokens 時,代理程式背景健康檢查中 max_tokens 的可選全域預設值。若未設定,非萬用字元模型預設為 5。設定時也適用於萬用字元路由。預設為未設定 |
| BACKGROUND_HEALTH_CHECK_MAX_TOKENS_REASONING | 對於非萬用字元推理模型(supports_reasoning(model)=true),設定時此項優先於 BACKGROUND_HEALTH_CHECK_MAX_TOKENS。若未設定,推理模型會回退至 BACKGROUND_HEALTH_CHECK_MAX_TOKENS(若已設定)或預設行為。萬用字元路由會忽略此項。預設為未設定 |
| BATCH_STATUS_POLL_INTERVAL_SECONDS | 輪詢批次狀態的間隔秒數。預設為 3600(1 小時) |
| BATCH_STATUS_POLL_MAX_ATTEMPTS | 輪詢批次狀態的最大嘗試次數。預設為 24(24 小時) |
| BEDROCK_MAX_POLICY_SIZE | Bedrock policy 的最大大小。預設為 75 |
| BEDROCK_MIN_THINKING_BUDGET_TOKENS | Bedrock 推理模型的最小 thinking budget token 數。若 budget_tokens 低於此值,Bedrock 會回傳 400 錯誤。較低的請求值會被限制為此最小值。預設為 1024 |
| BERRISPEND_ACCOUNT_ID | BerriSpend 服務的帳戶 ID |
| BRAINTRUST_API_KEY | Braintrust 整合的 API 金鑰 |
| BRAINTRUST_API_BASE | Braintrust API 的基礎 URL。預設為 https://api.braintrustdata.com/v1 |
| BRAINTRUST_MOCK | 啟用 Braintrust 整合測試的 mock 模式。設為 true 時,會攔截 Braintrust API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| BRAINTRUST_MOCK_LATENCY_MS | 啟用 mock 模式時,Braintrust API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 100ms |
| CACHED_STREAMING_CHUNK_DELAY | 快取串流區塊的延遲(秒)。預設為 0.02 |
| CHATGPT_API_BASE | ChatGPT API 的基礎 URL。預設為 https://chatgpt.com/backend-api/codex |
| CHATGPT_AUTH_FILE | ChatGPT 驗證資料的檔名。預設為 "auth.json" |
| CHATGPT_DEFAULT_INSTRUCTIONS | ChatGPT 提供者的預設系統指示 |
| CHATGPT_ORIGINATOR | ChatGPT API 請求的 originator 識別碼。預設為 "codex_cli_rs" |
| CHATGPT_TOKEN_DIR | 用於儲存 ChatGPT 驗證 token 的目錄。預設為 "~/.config/litellm/chatgpt" |
| CHATGPT_USER_AGENT | ChatGPT API 請求的自訂 user agent 字串 |
| CHATGPT_USER_AGENT_SUFFIX | 要附加到 ChatGPT user agent 字串的後綴 |
| CIRCLE_OIDC_TOKEN | CircleCI 的 OpenID Connect token |
| CIRCLE_OIDC_TOKEN_V2 | CircleCI 的 OpenID Connect token 版本 2 |
| CLI_JWT_EXPIRATION_HOURS | CLI 產生的 JWT token 到期時間(小時)。預設為 24 小時。也可透過 LITELLM_CLI_JWT_EXPIRATION_HOURS 設定 |
| CLI_SSO_CLAIM_MAP | 以逗號分隔的允許清單,將 OIDC claim 路徑對應到 LiteLLM 使用者 metadata 鍵,用於 CLI SSO(例如 employment_type->acme_employment_type,org_info.department->department)。純量值也會以 /sso/cli/poll 回傳為 attribution_metadata。別名:LITELLM_CLI_SSO_CLAIM_MAP |
| CLOUDZERO_API_KEY | 用於驗證的 CloudZero API 金鑰 |
| CLOUDZERO_CONNECTION_ID | 用於資料提交的 CloudZero connection ID |
| CLOUDZERO_EXPORT_INTERVAL_MINUTES | CloudZero 資料匯出作業的間隔分鐘數 |
| CLOUDZERO_MAX_FETCHED_DATA_RECORDS | 要從 CloudZero 取得的最大資料筆數 |
| CLOUDZERO_TIMEZONE | 日期處理所用的時區(預設:UTC) |
| CONFIG_FILE_PATH | 設定檔的檔案路徑 |
| CYBERARK_ACCOUNT | 用於祕密管理的 CyberArk 帳戶名稱 |
| CYBERARK_API_BASE | CyberArk API 的基礎 URL |
| CYBERARK_API_KEY | CyberArk secret management service 的 API 金鑰 |
| CYBERARK_CLIENT_CERT | CyberArk 驗證用用戶端憑證路徑 |
| CYBERARK_CLIENT_KEY | CyberArk 驗證用用戶端金鑰路徑 |
| CYBERARK_USERNAME | CyberArk 驗證的使用者名稱 |
| CYBERARK_SSL_VERIFY | 啟用或停用 CyberArk SSL 憑證驗證的旗標。預設為 True |
| CONFIDENT_API_KEY | DeepEval 整合的 API 金鑰 |
| CUSTOM_TIKTOKEN_CACHE_DIR | Tiktoken 快取的自訂目錄 |
| CONFIDENT_API_KEY | Confident AI(Deepeval)記錄服務的 API 金鑰 |
| COHERE_API_BASE | Cohere API 的基礎 URL。預設為 https://api.cohere.com |
| COMPETITOR_LLM_TEMPERATURE | 用於競品探索的 LLM 溫度設定。預設為 0.3 |
| CURSOR_API_BASE | Cursor AI 提供者整合的 API 基礎 URL。預設為 https://api.cursor.com |
| DATABASE_HOST | 資料庫伺服器的主機名稱 |
| DATABASE_HOST_READ_REPLICA | 讀取複本資料庫伺服器的主機名稱。僅由元件化部署(實驗性)在 IAM_TOKEN_DB_AUTH=True 時使用,以便從 RDS IAM 環境變數組裝 DATABASE_URL_READ_REPLICA |
| DATABASE_NAME | 資料庫名稱 |
| DATABASE_NAME_READ_REPLICA | 讀取複本的資料庫名稱(預設為 DATABASE_NAME)。僅由元件化部署(實驗性)在 IAM_TOKEN_DB_AUTH=True 時使用 |
| DATABASE_PASSWORD | 資料庫使用者密碼 |
| DATABASE_PORT | 資料庫連線的連接埠號 |
| DATABASE_PORT_READ_REPLICA | 讀取複本的連接埠號(預設 5432)。僅由元件化部署(實驗性)在 IAM_TOKEN_DB_AUTH=True 時使用 |
| DATABASE_SCHEMA | 資料庫中使用的 schema 名稱 |
| DATABASE_SCHEMA_READ_REPLICA | 讀取複本的 schema 名稱(預設為 DATABASE_SCHEMA)。僅由元件化部署(實驗性)在 IAM_TOKEN_DB_AUTH=True 時使用 |
| DATABASE_URL | 資料庫的連線 URL |
| DATABASE_URL_READ_REPLICA | 選用的讀取複本連線 URL。設定後,代理程式會將唯讀查詢(find_*、count、group_by、query_raw/_first)路由至此端點,而寫入仍使用 DATABASE_URL。對於具有分離讀寫端點的 Aurora 類叢集很有用。若未設定,則回退為僅寫入行為。搭配 IAM_TOKEN_DB_AUTH=True 時,讀取端 IAM token 會與寫入端一起自動重新整理 |
| DATABASE_USER | 資料庫連線的使用者名稱 |
| DATABASE_USER_READ_REPLICA | 讀取複本的資料庫使用者(預設為 DATABASE_USER)。僅由元件化部署(實驗性)在 IAM_TOKEN_DB_AUTH=True 時使用 |
| DATABASE_USERNAME | 資料庫使用者的別名 |
| DATABRICKS_API_BASE | Databricks API 的基礎 URL |
| DATABRICKS_API_KEY | 用於 Databricks API 驗證的 API 金鑰(Personal Access Token) |
| DATABRICKS_CLIENT_ID | Databricks OAuth M2M 驗證的 Client ID(Service Principal application ID) |
| DATABRICKS_CLIENT_SECRET | Databricks OAuth M2M 驗證的 Client secret |
| DATABRICKS_USER_AGENT | Databricks API 請求的自訂 user agent 字串。用於合作夥伴遙測歸因 |
| DAYS_IN_A_MONTH | 用於計算的每月天數。預設為 28 |
| DAYS_IN_A_WEEK | 用於計算的每週天數。預設為 7 |
| DAYS_IN_A_YEAR | 用於計算的每年天數。預設為 365 |
| DRAIN_ENDPOINT_TOKEN | 呼叫 /health/drain 端點時,X-Drain-Token 標頭所需的共享密鑰。當設定(於此處或透過 general_settings.drain_endpoint_token)時,未帶匹配 Token 的 drain 呼叫會被 401 拒絕;未設定時,該端點維持僅接受 opt-in 的行為。請讓 kubelet 從 preStop httpGet.httpHeaders 傳送它。 |
| DYNAMOAI_API_KEY | DynamoAI Guardrails 服務的 API 金鑰 |
| DYNAMOAI_API_BASE | DynamoAI API 的基礎 URL。預設為 https://api.dynamo.ai |
| DYNAMOAI_MODEL_ID | 用於 DynamoAI 追蹤/記錄目的的模型 ID |
| DYNAMOAI_POLICY_IDS | 要套用的 DynamoAI policy ID,以逗號分隔清單表示 |
| DD_BASE_URL | Datadog 整合的基礎 URL |
| DATADOG_BASE_URL | (DD_BASE_URL 的替代方案)Datadog 整合的基礎 URL |
| _DATADOG_BASE_URL | (DD_BASE_URL 的替代方案)Datadog 整合的基礎 URL |
| DD_AGENT_HOST | DataDog agent 的主機名稱或 IP(例如:"localhost")。設定後,記錄會傳送至 agent,而非直接 API |
| DD_AGENT_PORT | DataDog agent 的記錄接收連接埠。預設為 10518 |
| DD_API_KEY | Datadog 整合的 API 金鑰 |
| DD_APP_KEY | Datadog Cost Management 整合的 Application key。與 DD_API_KEY 一起用於成本指標 |
| DD_BATCH_SIZE | 在 flush 到 Datadog 之前緩衝的記錄事件數量。限制於 [1, 1000];預設為 1000。若批次超過 Datadog 的 5MB 請求上限,請降低此值(例如 50) |
| DD_SITE | Datadog 的站點 URL(例如:datadoghq.com) |
| DD_SOURCE | Datadog 記錄的來源識別碼 |
| DD_TRACER_STREAMING_CHUNK_YIELD_RESOURCE | 用於 Datadog 追蹤串流 chunk yield 的資源名稱。預設為 "streaming.chunk.yield" |
| DD_ENV | Datadog 記錄的環境識別碼。僅支援 datadog_llm_observability callback |
| DD_LLMOBS_ML_APP | Datadog LLM Observability 的預設 ml_app 名稱(Application 欄位)。會回退至 DD_SERVICE。可透過 metadata.ml_app 逐請求覆寫。 |
| DD_SERVICE | Datadog 記錄的服務識別碼。預設為 "litellm-server" |
| DD_VERSION | Datadog 記錄的版本識別碼。預設為 "unknown" |
| DATADOG_MOCK | 啟用 Datadog 整合測試的 mock 模式。設為 true 時,會攔截 Datadog API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| DATADOG_MOCK_LATENCY_MS | 啟用 mock 模式時,Datadog API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 100ms |
| DEBUG_OTEL | 啟用 OpenTelemetry 的除錯模式 |
| DEFAULT_ALLOWED_FAILS | 模型在進入冷卻前允許的最大失敗次數。預設為 3 |
| DEFAULT_A2A_AGENT_TIMEOUT | A2A(Agent-to-Agent)協定請求的預設逾時時間(秒)。預設為 6000 |
| DEFAULT_ACCESS_GROUP_CACHE_TTL | 快取存取群組資訊的存活時間(秒)。預設為 600(10 分鐘) |
| DEFAULT_ANTHROPIC_CHAT_MAX_TOKENS | Anthropic chat completions 的預設最大 token 數。預設為 4096 |
| DEFAULT_BATCH_SIZE | 作業的預設批次大小。預設為 512 |
| DEFAULT_CHUNK_OVERLAP | RAG 文字切分器的預設重疊區塊數。預設為 200 |
| DEFAULT_CHUNK_SIZE | RAG 文字切分器的預設區塊大小。預設為 1000 |
| DEFAULT_CLIENT_DISCONNECT_CHECK_TIMEOUT_SECONDS | 檢查用戶端斷線的逾時時間(秒)。預設為 1 |
| DEFAULT_COOLDOWN_TIME_SECONDS | 失敗後使模型進入冷卻的持續時間(秒)。預設為 5 |
| DEFAULT_CRON_JOB_LOCK_TTL_SECONDS | cron 工作鎖的存活時間(秒)。預設為 60(1 分鐘) |
| DEFAULT_DATAFORSEO_LOCATION_CODE | DataForSEO 搜尋 API 的預設地點代碼。預設為 2250(法國) |
| DEFAULT_FAILURE_THRESHOLD_PERCENT | 使部署進入冷卻的失敗閾值百分比。預設為 0.5(50%) |
| DEFAULT_FAILURE_THRESHOLD_MINIMUM_REQUESTS | 套用錯誤率冷卻前的最小請求數。可避免第一次失敗就觸發冷卻。預設為 5 |
| DEFAULT_FLUSH_INTERVAL_SECONDS | flush 作業的預設間隔秒數。預設為 5 |
| DEFAULT_HEALTH_CHECK_INTERVAL | 健康檢查的預設間隔秒數。預設為 300(5 分鐘) |
| DEFAULT_HEALTH_CHECK_PROMPT | 用於非圖片模型健康檢查的預設提示詞。預設為 "test from litellm" |
| DEFAULT_IMAGE_HEIGHT | 圖片的預設高度。預設為 300 |
| DEFAULT_IMAGE_TOKEN_COUNT | 圖片的預設 token 數。預設為 250 |
| DEFAULT_IMAGE_WIDTH | 圖片的預設寬度。預設為 300 |
| DEFAULT_IN_MEMORY_TTL | 記憶體快取的預設存活時間(秒)。預設為 5 |
| DEFAULT_MANAGEMENT_OBJECT_IN_MEMORY_CACHE_TTL | 記憶體快取中管理物件(User、Team、Key、Organization)的預設存活時間(秒)。預設為 60 秒。 |
| DEFAULT_MAX_LRU_CACHE_SIZE | LRU 快取的預設最大大小。預設為 64 |
| DEFAULT_MAX_RECURSE_DEPTH | 預設最大遞迴深度。預設為 100 |
| DEFAULT_MAX_RECURSE_DEPTH_SENSITIVE_DATA_MASKER | 敏感資料遮罩器的預設最大遞迴深度。預設為 10 |
| DEFAULT_MAX_RETRIES | 預設最大重試次數。預設為 2 |
| DEFAULT_MAX_TOKENS | LLM 請求的預設最大 token 數。預設為 4096 |
| DEFAULT_MAX_TOKENS_FOR_TRITON | Triton 模型的預設最大 token 數。預設為 2000 |
| DEFAULT_MAX_REDIS_BATCH_CACHE_SIZE | redis 批次快取的預設最大大小。預設為 1000 |
| DEFAULT_MCP_SEMANTIC_FILTER_EMBEDDING_MODEL | MCP 語意工具篩選的預設 embedding model。預設為 "text-embedding-3-small" |
| DEFAULT_MCP_SEMANTIC_FILTER_SIMILARITY_THRESHOLD | MCP 語意工具篩選的預設相似度閾值。預設為 0.3 |
| DEFAULT_MCP_SEMANTIC_FILTER_TOP_K | MCP 語意工具篩選要回傳的預設前 K 筆結果數量。預設為 10 |
| MCP_NPM_CACHE_DIR | STDIO MCP servers 使用的 npm 快取目錄。在容器中,預設值(~/.npm)可能不存在或為唯讀。預設為 /tmp/.npm_mcp_cache |
| LITELLM_MCP_CLIENT_TIMEOUT | MCP 用戶端連線逾時時間(秒)(stdio 與 HTTP/SSE 傳輸)。預設為 60 |
| LITELLM_MCP_TOOL_LISTING_TIMEOUT | 從 MCP server 列出工具的逾時時間(秒)。預設為 30 |
| LITELLM_MCP_METADATA_TIMEOUT | 取得 OAuth metadata 的 HTTP 用戶端逾時時間(秒)。預設為 10 |
| LITELLM_MCP_HEALTH_CHECK_TIMEOUT | MCP servers 的健康檢查逾時時間(秒)。預設為 10 |
| LITELLM_MCP_STDIO_EXTRA_COMMANDS | 以逗號分隔的額外命令 basename 允許清單,供 MCP stdio 傳輸在內建允許清單之外使用。範例:my-mcp-bin。預設為空 |
| MCP_OAUTH2_TOKEN_CACHE_DEFAULT_TTL | MCP OAuth2 token 快取的預設 TTL(秒)。預設為 3600 |
| MCP_OAUTH2_TOKEN_CACHE_MAX_SIZE | MCP OAuth2 token 快取中的最大項目數。預設為 200 |
| MCP_OAUTH2_TOKEN_CACHE_MIN_TTL | MCP OAuth2 token 快取的最小 TTL(秒)。預設為 10 |
| MCP_OAUTH2_TOKEN_EXPIRY_BUFFER_SECONDS | 計算快取 TTL 時,從 token 到期時間中扣除的秒數。預設為 60 |
| MCP_PER_USER_TOKEN_DEFAULT_TTL | 儲存在 Redis 中、每位使用者的 MCP OAuth token 預設 TTL(秒)。預設為 43200(12 小時) |
| MCP_PER_USER_TOKEN_EXPIRY_BUFFER_SECONDS | 計算 Redis TTL 時,從每位使用者的 MCP OAuth token 到期時間中扣除的秒數。預設為 60 |
| MCP_TOKEN_EXCHANGE_CACHE_MAX_SIZE | MCP OAuth2 token exchange 快取中的最大項目數。預設為 500 |
| MCP_TRUSTED_REDIRECT_ORIGINS | 以逗號分隔的額外 redirect_uri origin 允許清單,供 MCP OAuth authorize 端點接受,超出同源與 loopback 之外。每個項目必須是 host 或 host:port;*.suffix 前綴可匹配任何嚴格更深一層的子網域。僅限 HTTPS。當第一方 OAuth 用戶端位於姊妹網域時(例如 app.example.com)請使用此設定。對於經過 ingress 的部署,若 proxy 自身的 origin 不正確,請改設定 PROXY_BASE_URL。請參閱 MCP OAuth — Reverse proxy and ingress configuration。 |
| DEFAULT_MOCK_RESPONSE_COMPLETION_TOKEN_COUNT | mock 回應 completions 的預設 token 數。預設為 20 |
| DEFAULT_MOCK_RESPONSE_PROMPT_TOKEN_COUNT | mock 回應 prompts 的預設 token 數。預設為 10 |
| DEFAULT_MODEL_CREATED_AT_TIME | 模型的預設建立時間戳。預設為 1677610602 |
| DEFAULT_NUM_WORKERS_LITELLM_PROXY | 當未設定 NUM_WORKERS 時,LiteLLM proxy 的預設 worker 數。預設為 1。我們強烈建議將 NUM_WORKERS 設為可用 vCPU 數量(例如 NUM_WORKERS=8 或 --num_workers 8)。 |
| DEFAULT_PROMPT_INJECTION_SIMILARITY_THRESHOLD | 提示詞注入相似度的預設閾值。預設為 0.7 |
| DEFAULT_POLLING_INTERVAL | 排程器的預設輪詢間隔(秒)。預設為 0.03 |
| DEFAULT_REASONING_EFFORT_DISABLE_THINKING_BUDGET | 預設 reasoning effort 停用 thinking budget。預設為 0 |
| DEFAULT_REASONING_EFFORT_HIGH_THINKING_BUDGET | 預設 high reasoning effort thinking budget。預設為 4096 |
| DEFAULT_REASONING_EFFORT_LOW_THINKING_BUDGET | 預設 low reasoning effort thinking budget。預設為 1024 |
| DEFAULT_REASONING_EFFORT_MAX_THINKING_BUDGET | 舊版 Anthropic 模型所使用、採用 thinking.budget_tokens 的預設 max reasoning effort thinking budget(Claude 4.5 系列 + Haiku)。在 Claude 4.6/4.7 上,max 階層會改為透過自適應 output_config.effort=max 路由,並忽略此常數。預設為 16384 |
| DEFAULT_REASONING_EFFORT_MEDIUM_THINKING_BUDGET | 預設 medium reasoning effort thinking budget。預設為 2048 |
| DEFAULT_REASONING_EFFORT_MINIMAL_THINKING_BUDGET | 預設 minimal reasoning effort thinking budget。預設為 512 |
| DEFAULT_REASONING_EFFORT_MINIMAL_THINKING_BUDGET_GEMINI_2_5_FLASH | Gemini 2.5 Flash 的預設 minimal reasoning effort thinking budget。預設為 512 |
| DEFAULT_REASONING_EFFORT_MINIMAL_THINKING_BUDGET_GEMINI_2_5_FLASH_LITE | Gemini 2.5 Flash Lite 的預設 minimal reasoning effort thinking budget。預設為 512 |
| DEFAULT_REASONING_EFFORT_MINIMAL_THINKING_BUDGET_GEMINI_2_5_PRO | Gemini 2.5 Pro 的預設 minimal reasoning effort thinking budget。預設為 512 |
| DEFAULT_REASONING_EFFORT_XHIGH_THINKING_BUDGET | 舊版 Anthropic 模型所使用、採用 thinking.budget_tokens 的預設 xhigh reasoning effort thinking budget。延續 low/medium/high 的 2× 演進 1024 → 2048 → 4096 → 8192。在 Claude 4.6/4.7 上,xhigh 階層會改為透過自適應 output_config.effort=xhigh 路由,並忽略此常數。預設為 8192 |
| DEFAULT_REDIS_MAJOR_VERSION | 當無法判定版本時,預設要假設的 Redis 主版本。預設為 7 |
| DEFAULT_REDIS_SYNC_INTERVAL | 預設 Redis 同步間隔(秒)。預設為 1 |
| DEFAULT_SEMANTIC_GUARD_EMBEDDING_MODEL | Semantic Guard(路由匹配 guardrail)的預設 embedding model。預設為 "text-embedding-3-small" |
| DEFAULT_SEMANTIC_GUARD_SIMILARITY_THRESHOLD | Semantic Guard 路由匹配的預設相似度閾值。預設為 0.75 |
| DEFAULT_REPLICATE_GPU_PRICE_PER_SECOND | Replicate GPU 每秒的預設價格。預設為 0.001400 |
| DEFAULT_REPLICATE_POLLING_DELAY_SECONDS | Replicate 輪詢的預設延遲(秒)。預設為 1 |
| DEFAULT_REPLICATE_POLLING_RETRIES | Replicate 輪詢的預設重試次數。預設為 5 |
| DEFAULT_SQS_BATCH_SIZE | SQS 記錄的預設批次大小。預設為 512 |
| DEFAULT_SQS_FLUSH_INTERVAL_SECONDS | SQS 記錄的預設 flush 間隔。預設為 10 |
| DEFAULT_S3_BATCH_SIZE | S3 記錄的預設批次大小。預設為 512 |
| DEFAULT_S3_FLUSH_INTERVAL_SECONDS | S3 記錄的預設 flush 間隔。預設為 10 |
| DEFAULT_SLACK_ALERTING_THRESHOLD | Slack 警示的預設閾值。預設為 300 |
| DEFAULT_SOFT_BUDGET | LiteLLM proxy keys 的預設 soft budget。預設為 50.0 |
| DEFAULT_TRIM_RATIO | 從提示詞結尾裁剪的 token 比例預設值。預設為 0.75 |
| DEFAULT_GOOGLE_VIDEO_DURATION_SECONDS | google 中影片生成的預設持續時間(秒)。預設為 8 |
| DIRECT_URL | 服務端點的直接 URL |
| DISABLE_ADMIN_UI | 停用管理 UI 的切換 |
| LITELLM_HIDE_DEFAULT_CREDENTIALS_HINT | 用於隱藏管理 UI 登入頁面上「Default Credentials」資訊卡的旗標(/ui/login 與 /fallback/login)。當 UI 憑證透過 UI_USERNAME / UI_PASSWORD 或 SSO 管理,且關於 admin + MASTER_KEY 的硬編碼提示變得誤導或被安全掃描器標記時很有用。預設為 false |
| LITELLM_ENABLE_HSTS | 在 proxy 與 UI 回應上送出 Strict-Transport-Security response header 的旗標。僅在透過 HTTPS 提供的部署中生效。預設為 false |
| DISABLE_AIOHTTP_TRANSPORT | 停用 aiohttp 傳輸的旗標。設為 True 時,litellm 會使用 httpx 而非 aiohttp。預設為 False |
| DISABLE_AIOHTTP_TRUST_ENV | 停用 aiohttp trust environment 的旗標。設為 True 時,litellm 不會信任 aiohttp 的環境,例如在設為 True 時,不會使用 HTTP_PROXY 與 HTTPS_PROXY 環境變數。預設為 False |
| DISABLE_SCHEMA_UPDATE | 停用 schema 更新的切換 |
| DYNAMIC_RATE_LIMIT_ERROR_THRESHOLD_PER_MINUTE | 在平行請求限制器中,每分鐘部署失敗達到此門檻後即強制套用速率限制。預設為 1 |
| DOCS_DESCRIPTION | 文件頁面的說明文字 |
| DOCS_FILTERED | 表示文件已篩選的旗標 |
| DOCS_TITLE | 文件頁面的標題 |
| DOCS_URL | Swagger API 文件的路徑。預設為 "/" |
| EMAIL_LOGO_URL | 電子郵件中使用的 Logo URL |
| EMAIL_BUDGET_ALERT_TTL | 電子郵件預算警示的存活時間(秒) |
| EMAIL_BUDGET_ALERT_MAX_SPEND_ALERT_PERCENTAGE | 觸發電子郵件預算警示的最大支出百分比 |
| EMAIL_SUPPORT_CONTACT | 支援聯絡電子郵件地址 |
| EMAIL_SIGNATURE | 所有電子郵件的自訂 HTML 頁尾/簽名。可包含 HTML 標籤以進行格式設定與連結。 |
| EMAIL_SUBJECT_INVITATION | 邀請電子郵件的自訂主旨樣板。 |
| EMAIL_SUBJECT_KEY_CREATED | 金鑰建立電子郵件的自訂主旨樣板。 |
| EMAIL_BUDGET_ALERT_MAX_SPEND_ALERT_PERCENTAGE | 觸發警示的最大預算百分比(以小數表示:0.8 = 80%)。預設為 0.8 |
| EMAIL_BUDGET_ALERT_TTL | 預算警示去重的存活時間(秒)。預設為 86400(24 小時) |
| ENKRYPTAI_API_BASE | EnkryptAI Guardrails API 的基礎 URL。預設為 https://api.enkryptai.com |
| ENKRYPTAI_API_KEY | EnkryptAI Guardrails 服務的 API 金鑰 |
| FAROS_API_KEY | 用於將 LLM 使用資料傳送至 Faros AI 的 API 金鑰 |
| FAROS_API_URL | Faros AI API 的基礎 URL。預設為 https://prod.api.faros.ai |
| FAROS_GRAPH | LiteLLM 使用資料寫入的 Faros graph。預設為 "default" |
| FAROS_ORIGIN | LiteLLM 寫入 Faros 的資料列所記錄的 origin。預設為 "litellm" |
| FAROS_TOOL_CATEGORY | LiteLLM 寫入 Faros vcs_UserTool 資料列所記錄的工具類別。預設為 "LiteLLM" |
| FAROS_USER_SOURCE | LiteLLM 使用者寫入 Faros vcs_User 資料列所記錄的 source。預設為 "LiteLLM" |
| FIREWORKS_AI_4_B | Fireworks AI 4B 模型的大小參數。預設為 4 |
| FIREWORKS_AI_16_B | Fireworks AI 16B 模型的大小參數。預設為 16 |
| FIREWORKS_AI_56_B_MOE | Fireworks AI 56B MOE 模型的大小參數。預設為 56 |
| FIREWORKS_AI_80_B | Fireworks AI 80B 模型的大小參數。預設為 80 |
| FIREWORKS_AI_176_B_MOE | Fireworks AI 176B MOE 模型的大小參數。預設為 176 |
| FOCUS_PROVIDER | Focus 匯出的目標提供者(例如:s3)。預設為 s3。 |
| FOCUS_FORMAT | Focus 匯出的輸出格式。預設為 parquet。 |
| FOCUS_FREQUENCY | 排程 Focus 匯出的頻率(hourly、daily 或 interval)。預設為 hourly。 |
| FOCUS_CRON_OFFSET | 排程每小時/每日 Focus 匯出時使用的分鐘偏移量。預設為 5 分鐘。 |
| FOCUS_INTERVAL_SECONDS | 當 frequency 為 interval 時,Focus 匯出的間隔(秒)。 |
| FOCUS_PREFIX | 上傳 Focus 匯出檔案時使用的物件 key 前綴(或資料夾)。預設為 focus_exports。 |
| FOCUS_S3_BUCKET_NAME | 使用 S3 目的地時,上傳 Focus 匯出檔案的 S3 bucket。 |
| FOCUS_S3_REGION_NAME | Focus 匯出 S3 bucket 的 AWS 區域。 |
| FOCUS_S3_ENDPOINT_URL | Focus 匯出 S3 client 的自訂端點(選用;對 S3 相容儲存很有用)。 |
| FOCUS_S3_ACCESS_KEY | Focus 匯出 S3 client 使用的 AWS access key ID。 |
| FOCUS_S3_SECRET_KEY | Focus 匯出 S3 client 使用的 AWS secret access key。 |
| FOCUS_S3_SESSION_TOKEN | Focus 匯出 S3 client 使用的 AWS session token(選用)。 |
| MAVVRIK_API_KEY | Mavvrik FOCUS 匯出整合的 API 金鑰。 |
| MAVVRIK_API_ENDPOINT | Mavvrik FOCUS 匯出的租戶 API 端點,例如 https://api.mavvrik.ai/<tenant_id>。 |
| MAVVRIK_CONNECTION_ID | Mavvrik FOCUS 匯出的 AI cost connection ID。 |
| MAVVRIK_FOCUS_MAX_ROWS | Mavvrik FOCUS 目的地每個匯出視窗的最大列數。預設為 500000。 |
| FOCUS_GCS_BUCKET_NAME | 使用 GCS 目的地時,上傳 Focus 匯出檔案的 GCS bucket。 |
| FOCUS_GCS_PATH_SERVICE_ACCOUNT | 用於 Focus 匯出 GCS client 的 service account JSON 金鑰檔案路徑。若未設定,則回退至 Application Default Credentials。 |
| FUNCTION_DEFINITION_TOKEN_COUNT | 函式定義的 token 數。預設為 9 |
| GALILEO_API_KEY | Galileo Cloud(代管版)的 API 金鑰。當 success_callback 包含 galileo 時,與 v2 spans API 一起使用。 |
| GALILEO_BASE_URL | Galileo 平台的基礎 URL。Galileo Cloud 請使用 https://api.galileo.ai。企業版/自架版請將主控台 URL 中的 console 替換為 api。 |
| GALILEO_LOG_STREAM_ID | Galileo Cloud v2 spans 記錄的 log stream ID(選用)。 |
| GALILEO_PASSWORD | Galileo enterprise Observe 驗證的密碼 |
| GALILEO_PROJECT_ID | Galileo 使用的專案 ID |
| GALILEO_USERNAME | Galileo enterprise Observe 驗證的使用者名稱 |
| GOOGLE_SECRET_MANAGER_PROJECT_ID | Google Secret Manager 的專案 ID |
| GRACEFUL_SHUTDOWN_TIMEOUT | 代理程式在關閉時等待進行中的請求排空的秒數(SIGTERM 或 /health/drain preStop hook)後,才繼續進行卸載。預設為 30 |
| GCS_BUCKET_NAME | Google Cloud Storage bucket 的名稱 |
| GCS_MOCK | 啟用 GCS 整合測試的 mock 模式。設為 true 時,會攔截 GCS API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| GCS_MOCK_LATENCY_MS | 啟用 mock 模式時,GCS API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 150ms |
| GCS_PATH_SERVICE_ACCOUNT | Google Cloud service account JSON 檔案路徑 |
| GCS_FLUSH_INTERVAL | GCS 記錄的 flush 間隔(秒)。指定您希望多久將記錄送至 GCS。預設為 20 秒 |
| GCS_BATCH_SIZE | GCS 記錄的批次大小。指定累積多少筆記錄後 flush 到 GCS。若 BATCH_SIZE 設為 10,則每 10 筆記錄 flush 一次。預設為 2048 |
| GCS_USE_BATCHED_LOGGING | 啟用 GCS 的批次記錄。啟用時(預設),多個記錄 payload 會合併為單一 GCS object 上傳(NDJSON 格式),大幅減少 API 呼叫。停用時,會將每筆記錄各自作為獨立 GCS object 傳送(舊版行為)。預設為 true |
| GCS_PUBSUB_TOPIC_ID | 要將 LiteLLM SpendLogs 傳送到的 PubSub Topic ID。 |
| GCS_PUBSUB_PROJECT_ID | 要將 LiteLLM SpendLogs 傳送到的 PubSub Project ID。 |
| GENERIC_AUTHORIZATION_ENDPOINT | 一般 OAuth 提供者的授權端點 |
| GENERIC_CLIENT_ID | 一般 OAuth 提供者的 Client ID |
| GENERIC_CLIENT_SECRET | 一般 OAuth 提供者的 Client secret |
| GENERIC_CLIENT_STATE | 一般用戶端驗證的 state 參數 |
| GENERIC_CLIENT_USE_PKCE | 為一般 OAuth 提供者啟用 PKCE(Proof Key for Code Exchange)。當您的 OAuth 提供者需要 PKCE 時,請設為 "true"。預設為 false |
| GENERIC_SSO_HEADERS | 要加入請求的額外標頭,以逗號分隔,例如 Authorization=Bearer <token>、Content-Type=application/json 等。 |
| GENERIC_INCLUDE_CLIENT_ID | 在 OAuth 請求中包含 client ID |
| GENERIC_SCOPE | 一般 OAuth 提供者的 scope 設定 |
| GENERIC_TOKEN_ENDPOINT | 一般 OAuth 提供者的 token 端點 |
| GENERIC_USER_DISPLAY_NAME_ATTRIBUTE | 一般驗證中使用者顯示名稱的屬性 |
| GENERIC_USER_EMAIL_ATTRIBUTE | 一般驗證中使用者電子郵件的屬性 |
| GENERIC_USER_EXTRA_ATTRIBUTES | 以逗號分隔的額外欄位清單,從一般 SSO 提供者回應中擷取(例如:"department,employee_id,groups")。在自訂 SSO handler 中可透過 CustomOpenID.extra_fields 存取。支援巢狀欄位的點記法 |
| GENERIC_USER_FIRST_NAME_ATTRIBUTE | 一般驗證中使用者名字的屬性 |
| GENERIC_USER_ID_ATTRIBUTE | 一般驗證中使用者 ID 的屬性 |
| GENERIC_USER_LAST_NAME_ATTRIBUTE | 一般驗證中使用者姓氏的屬性 |
| GENERIC_USER_PROVIDER_ATTRIBUTE | 指定使用者提供者的屬性 |
| GENERIC_USER_ROLE_ATTRIBUTE | 指定使用者角色的屬性 |
| GENERIC_USERINFO_ENDPOINT | 在一般 OAuth 中擷取使用者資訊的端點 |
| GENERIC_LOGGER_ENDPOINT | 要將記錄傳送至的 Generic Logger callback 端點 URL |
| GENERIC_LOGGER_HEADERS | 要包含在 Generic Logger callback 請求中的標頭 JSON 字串 |
| GENERIC_ROLE_MAPPINGS_DEFAULT_ROLE | 在一般 SSO 中,當沒有任何角色對應符合時要指派的預設 LiteLLM 角色。與 GENERIC_ROLE_MAPPINGS_ROLES 一起使用 |
| GENERIC_ROLE_MAPPINGS_GROUP_CLAIM | SSO token 中包含使用者群組的 claim/attribute 名稱。用於角色對應 |
| GENERIC_ROLE_MAPPINGS_ROLES | 將 LiteLLM 角色對應到 SSO 群組名稱的 Python dict 字串。範例:{"proxy_admin": ["admin-group"], "internal_user": ["users"]} |
| GENERIC_USER_ROLE_MAPPINGS | 用於從 SSO 設定使用者角色對應的 GENERIC_ROLE_MAPPINGS_ROLES 替代方案 |
| GEMINI_API_BASE | Gemini API 的基礎 URL。預設為 https://generativelanguage.googleapis.com |
| GALILEO_API_KEY | Galileo Cloud(代管版)的 API 金鑰。當 success_callback 包含 galileo 時,與 v2 spans API 一起使用。 |
| GALILEO_BASE_URL | Galileo 平台的基礎 URL。Galileo Cloud 請使用 https://api.galileo.ai。企業版/自架版請將主控台 URL 中的 console 替換為 api。 |
| GALILEO_LOG_STREAM_ID | Galileo Cloud v2 spans 記錄的 log stream ID(選用)。 |
| GALILEO_PASSWORD | Galileo enterprise Observe 驗證的密碼 |
| GALILEO_PROJECT_ID | Galileo 使用的專案 ID |
| GALILEO_USERNAME | Galileo enterprise Observe 驗證的使用者名稱 |
| GITHUB_COPILOT_TOKEN_DIR | 用於儲存 github_copilot llm provider 的 GitHub Copilot token 目錄 |
| GITHUB_COPILOT_API_KEY_FILE | 用於儲存 github_copilot llm provider 的 GitHub Copilot API 金鑰檔案 |
| GITHUB_COPILOT_ACCESS_TOKEN_FILE | 用於儲存 github_copilot llm provider 的 GitHub Copilot access token 檔案 |
| GITHUB_COPILOT_API_BASE | GitHub Copilot API 的基礎 URL。對於具有自訂主機的 GitHub Enterprise 訂閱,類似於 https://copilot-api.my-company.ghe.com. 預設為 https://api.githubcopilot.com |
| GITHUB_COPILOT_DEVICE_CODE_URL | GitHub Copilot device code 驗證的 URL。對於具有自訂主機的 GitHub Enterprise 訂閱,類似於 https://my-company.ghe.com/login/device/code. 預設為 https://github.com/login/device/code |
| GITHUB_COPILOT_ACCESS_TOKEN_URL | GitHub Copilot access token 取得的 URL。對於具有自訂主機的 GitHub Enterprise 訂閱,類似於 https://my-company.ghe.com/login/oauth/access_token. 預設為 https://github.com/login/oauth/access_token |
| GITHUB_COPILOT_API_KEY_URL | GitHub Copilot API 金鑰取得的 URL。對於具有自訂主機的 GitHub Enterprise 訂閱,類似於 https://my-company.ghe.com/api/v3/copilot_internal/v2/token. 預設為 https://api.github.com/copilot_internal/v2/token |
| GITHUB_COPILOT_CLIENT_ID | GitHub Copilot device flow 驗證的 Client ID。這由 github_copilot 提供者用於 device code 驗證。預設為 "Iv1.b507a08c87ecfe98" |
| GREENSCALE_API_KEY | Greenscale 服務的 API 金鑰 |
| GREENSCALE_ENDPOINT | Greenscale 服務的端點 URL |
| GRAYSWAN_API_BASE | GraySwan API 的基礎 URL。預設為 https://api.grayswan.ai |
| GRAYSWAN_API_KEY | GraySwan Cygnal 服務的 API 金鑰 |
| GRAYSWAN_REASONING_MODE | GraySwan guardrail 的推理模式 |
| GRAYSWAN_VIOLATION_THRESHOLD | GraySwan guardrail 的違規閾值 |
| GOOGLE_APPLICATION_CREDENTIALS | Google Cloud 憑證 JSON 檔案路徑 |
| GOOGLE_CLIENT_ID | Google OAuth 的 Client ID |
| GOOGLE_CLIENT_SECRET | Google OAuth 的 Client secret |
| GOOGLE_KMS_RESOURCE_NAME | Google KMS 中資源的名稱 |
| GUARDRAILS_AI_API_BASE | Guardrails AI API 的基礎 URL |
| HEALTH_CHECK_TIMEOUT_SECONDS | 健康檢查的逾時時間(秒)。預設為 60 |
| HEROKU_API_BASE | Heroku API 的基礎 URL |
| HEROKU_API_KEY | Heroku 服務的 API 金鑰 |
| HF_API_BASE | Hugging Face API 的基礎 URL |
| HCP_VAULT_ADDR | Hashicorp Vault Secret Manager 的位址 |
| HCP_VAULT_APPROLE_MOUNT_PATH | Hashicorp Vault Secret Manager 中 AppRole 驗證的掛載路徑。預設為 "approle" |
| HCP_VAULT_APPROLE_ROLE_ID | Hashicorp Vault Secret Manager 中 AppRole 驗證的 Role ID |
| HCP_VAULT_APPROLE_SECRET_ID | Hashicorp Vault Secret Manager 中 AppRole 驗證的 Secret ID |
| HCP_VAULT_CLIENT_CERT | Hashicorp Vault Secret Manager 的用戶端憑證路徑 |
| HCP_VAULT_CLIENT_KEY | Hashicorp Vault Secret Manager 的用戶端金鑰路徑 |
| HCP_VAULT_MOUNT_NAME | Hashicorp Vault Secret Manager 的掛載名稱 |
| HCP_VAULT_NAMESPACE | Hashicorp Vault Secret Manager 的命名空間 |
| HCP_VAULT_PATH_PREFIX | Hashicorp Vault Secret Manager 的路徑前綴 |
| HCP_VAULT_TOKEN | Hashicorp Vault Secret Manager 的 Token |
| HCP_VAULT_CERT_ROLE | Hashicorp Vault Secret Manager Auth 的角色 |
| HELICONE_API_KEY | Helicone 服務的 API 金鑰 |
| HELICONE_API_BASE | Helicone 服務的基礎 URL,預設為 https://api.helicone.ai |
| HELICONE_MOCK | 啟用 Helicone 整合測試的 mock 模式。設為 true 時,會攔截 Helicone API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| HELICONE_MOCK_LATENCY_MS | 啟用 mock 模式時,Helicone API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 100ms |
| HOSTNAME | 伺服器的主機名稱,這將會 輸出至 datadog 記錄 |
| HOURS_IN_A_DAY | 用於計算的每天小時數。預設為 24 |
| HIDDENLAYER_API_BASE | HiddenLayer API 的基礎 URL。預設為 https://api.hiddenlayer.ai |
| HIDDENLAYER_AUTH_URL | HiddenLayer 的驗證 URL。預設為 https://auth.hiddenlayer.ai |
| HIDDENLAYER_CLIENT_ID | HiddenLayer SaaS 驗證的 Client ID |
| HIDDENLAYER_CLIENT_SECRET | HiddenLayer SaaS 驗證的 Client secret |
| HUGGINGFACE_API_BASE | Hugging Face API 的基礎 URL |
| HUGGINGFACE_API_KEY | Hugging Face API 的 API 金鑰 |
| HUMANLOOP_PROMPT_CACHE_TTL_SECONDS | Humanloop 中快取提示詞的存活時間(秒)。預設為 60 |
| IAM_TOKEN_DB_AUTH | 資料庫驗證用 IAM token |
| IBM_GUARDRAILS_API_BASE | IBM Guardrails API 的基礎 URL |
| IBM_GUARDRAILS_AUTH_TOKEN | IBM Guardrails API 的授權 bearer token |
| INITIAL_RETRY_DELAY | 重試請求的初始延遲(秒)。預設為 0.5 |
| JITTER | 重試延遲計算的抖動因子。預設為 0.75 |
| JSON_LOGS | 啟用 JSON 格式記錄 |
| JWT_AUDIENCE | JWT token 的預期 audience |
| JWT_ISSUER | JWT token 的預期 issuer(iss claim)。設定後,PyJWT 會驗證 iss claim,並拒絕來自其他 issuer 的 token |
| JWT_PUBLIC_KEY_URL | 取得 JWT 驗證用 public key 的 URL |
| LAGO_API_BASE | Lago API 的基礎 URL |
| LAGO_API_CHARGE_BY | 用於決定 Lago 收費基礎的參數 |
| LAGO_API_EVENT_CODE | Lago API 事件的事件代碼 |
| LAGO_API_KEY | 存取 Lago 服務的 API 金鑰 |
| LANGFUSE_BASE_URL | Langfuse 服務的基礎 URL |
| LANGFUSE_DEBUG | 切換 Langfuse 的除錯模式 |
| LANGFUSE_FLUSH_INTERVAL | flush Langfuse 記錄的間隔 |
| LANGFUSE_TRACING_ENVIRONMENT | Langfuse tracing 的環境 |
| LANGFUSE_HOST | 已棄用的 Langfuse 服務主機 URL |
| LANGFUSE_MOCK | 啟用 Langfuse 整合測試的 mock 模式。設為 true 時,會攔截 Langfuse API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| LANGFUSE_MOCK_LATENCY_MS | 啟用 mock 模式時,Langfuse API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 100ms |
| LANGFUSE_PUBLIC_KEY | Langfuse 驗證的 public key |
| LANGFUSE_RELEASE | Langfuse 整合的發行版本 |
| LANGFUSE_SECRET_KEY | Langfuse 驗證的 secret key |
| LANGFUSE_PROPAGATE_TRACE_ID | 啟用將 trace ID 傳遞至 Langfuse 的旗標。預設為 False |
| LANGSMITH_API_KEY | Langsmith 平台的 API 金鑰 |
| LANGSMITH_BASE_URL | Langsmith 服務的基礎 URL |
| LANGSMITH_BATCH_SIZE | Langsmith 作業的批次大小 |
| LANGSMITH_DEFAULT_RUN_NAME | Langsmith run 的預設名稱 |
| LANGSMITH_PROJECT | Langsmith 整合的專案名稱 |
| LANGSMITH_SAMPLING_RATE | Langsmith 記錄的取樣率 |
| LANGSMITH_TENANT_ID | Langsmith 多租戶部署的 Tenant ID |
| LANGSMITH_MOCK | 啟用 Langsmith 整合測試的 mock 模式。設為 true 時,會攔截 Langsmith API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| LANGSMITH_MOCK_LATENCY_MS | 啟用 mock 模式時,Langsmith API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 100ms |
| LANGTRACE_API_KEY | Langtrace 服務的 API 金鑰 |
| LASSO_API_BASE | Lasso API 的基礎 URL |
| LASSO_API_KEY | Lasso 服務的 API 金鑰 |
| LASSO_USER_ID | Lasso 服務的使用者 ID |
| LASSO_CONVERSATION_ID | Lasso 服務的對話 ID |
| LENGTH_OF_LITELLM_GENERATED_KEY | LiteLLM 產生的金鑰長度。預設為 16 |
| LEGACY_MULTI_INSTANCE_RATE_LIMITING | 啟用舊版多執行個體速率限制的旗標。預設為 False |
| LITERAL_API_KEY | Literal 整合的 API 金鑰 |
| LITERAL_API_URL | Literal 服務的 API URL |
| LITERAL_BATCH_SIZE | Literal 作業的批次大小 |
| LITELLM_ANTHROPIC_BETA_HEADERS_URL | 取得 Anthropic beta headers 設定的自訂 URL。預設為 GitHub main branch URL |
| LITELLM_ANTHROPIC_DISABLE_URL_SUFFIX | 停用 Anthropic API base URL 的自動附加 URL 後綴。設為 true 時,會防止 LiteLLM 自動將 /v1/messages 或 /v1/complete 加到自訂 Anthropic API 端點 |
| LITELLM_ASSETS_PATH | UI 資產與 logo 所在目錄的路徑。當以唯讀檔案系統執行時使用(例如:Kubernetes)。Docker 中預設為 /var/lib/litellm/assets。 |
| LITELLM_BLOG_POSTS_URL | 取得 LiteLLM blog posts JSON 的自訂 URL。預設為 GitHub main branch URL |
| LITELLM_CLI_JWT_EXPIRATION_HOURS | CLI 產生的 JWT token 到期時間(小時)。預設為 24 小時 |
| LITELLM_CLI_SSO_CLAIM_MAP | CLI_SSO_CLAIM_MAP 的別名 — CLI SSO 歸因 metadata 的允許清單 OIDC claims |
| LITELLM_CORS_ALLOW_CREDENTIALS | 設為 true 以在 CORS 回應中明確允許 credentials。未設定時,若 LITELLM_CORS_ORIGINS 為 *(萬用字元),credentials 會自動停用,以避免瀏覽器將任何 origin 與 credentials 對映的安全設定錯誤 |
| LITELLM_CORS_ORIGINS | 允許的 CORS origins 以逗號分隔清單(例如 https://app.example.com,https://admin.example.com)。未設定時預設為 *(所有 origins) |
| LITELLM_DD_AGENT_HOST | LiteLLM 專用記錄的 DataDog agent 主機名稱或 IP。設定後,記錄會傳送至 agent,而非直接 API |
| LITELLM_DEPLOYMENT_ENVIRONMENT | 部署的環境名稱(例如:"production"、"staging")。當未設定 OTEL_ENVIRONMENT_NAME 時作為備援。會在遙測資料中設定 environment 標籤 |
| LITELLM_DETAILED_TIMING | 設為 true 時,會在回應中加入詳細的各階段 timing 標頭(x-litellm-timing-{pre-processing,llm-api,post-processing,message-copy}-ms)。預設為 false。請參閱 latency overhead 文件 |
| LITELLM_DD_AGENT_PORT | LiteLLM 專用記錄的 DataDog agent 連接埠。預設為 10518 |
| LITELLM_DD_LLM_OBS_PORT | Datadog LLM Observability agent 的連接埠。預設為 8126 |
| LITELLM_DEFAULT_EMBEDDING_ENCODING_FORMAT | OpenAI 相容 embedding 請求的預設 encoding_format,當請求或模型 litellm_params 中未設定時使用(例如 float、base64)。備援為 float。請參閱 Embeddings。 |
| LITELLM_DEV_ENV_HOT_RELOAD | 代理程式在以 --reload 啟動時自行設定的內部旗標,表示重新載入的 worker 應以 override=True 重新讀取 .env,使現有金鑰的編輯在重新載入時生效。不應由使用者設定 |
| LITELLM_DONT_SHOW_FEEDBACK_BOX | 隱藏 LiteLLM UI 中 feedback box 的旗標 |
| LITELLM_DROP_PARAMS | 要在 LiteLLM 請求中捨棄的參數 |
| LITELLM_MODIFY_PARAMS | 要在 LiteLLM 請求中修改的參數 |
| LITELLM_EMAIL | 與 LiteLLM 帳戶關聯的電子郵件 |
| LITELLM_FAVICON_URL | LiteLLM UI favicon 的自訂 URL。設定後會覆寫預設 favicon |
| LITELLM_GLOBAL_MAX_PARALLEL_REQUEST_RETRIES | LiteLLM 平行請求的最大重試次數 |
| LITELLM_GLOBAL_MAX_PARALLEL_REQUEST_RETRY_TIMEOUT | LiteLLM 平行請求重試的逾時時間 |
| LITELLM_DISABLE_ACCESS_LOG_PATHS | 要從 uvicorn access logs 排除的 URL path 以逗號分隔清單(例如 /health,/metrics)。適合用來抑制雜訊過多的健康檢查記錄項目。 |
| LITELLM_DISABLE_LAZY_LOADING | 設為 "1"、"true"、"yes" 或 "on" 時,會停用屬性的 lazy loading(目前僅影響 encoding/tiktoken)。這可確保在 VCR 開始記錄 HTTP 請求之前先初始化 encoding,修正 VCR cassette 建立問題。請參閱 issue #18659 |
| LITELLM_DISABLE_REDACT_SECRETS | 設為 "true" 時,會停用從 proxy 記錄輸出中自動遮罩機密(API 金鑰、token、憑證)。機密遮罩預設已啟用。 |
| LITELLM_DISABLE_ACCESS_LOG_PATHS | 要捨棄其 uvicorn access-log 行的精確請求路徑以逗號分隔清單(例如健康檢查、root 探測、造成記錄洪流的 metrics 擷取)。路徑會對比任何查詢字串之前的部分。空值/未設定會停用篩選。 |
| LITELLM_MIGRATION_DIR | prisma migrations 的自訂 migrations 目錄,用於在唯讀檔案系統中為資料庫建立基準。 |
| LITELLM_HOSTED_UI | LiteLLM 代管 UI 的 URL |
| LITELLM_UI_API_DOC_BASE_URL | API Reference 基礎 URL 的選用覆寫(用於範例程式碼/文件),當管理 UI 與 proxy 不在同一主機時使用。未設定時預設為 PROXY_BASE_URL。 |
| LITELLM_UI_PATH | Admin UI 檔案所在目錄的路徑。當以唯讀檔案系統執行時使用(例如:Kubernetes)。Docker 中預設為 /var/lib/litellm/ui。 |
| LITELLM_UI_SESSION_DURATION | UI 登入工作階段的持續時間(username/password、SSO、邀請連結)。格式:"30s"、"30m"、"24h"、"7d"。不適用於 EXPERIMENTAL_UI_LOGIN 流程,該流程為安全起見使用固定 10 分鐘到期時間。預設為 "24h" |
| LITELLM_EXPIRED_UI_SESSION_KEY_CLEANUP_BATCH_SIZE | 每次清理執行中要刪除的已過期 LiteLLM dashboard session key 最大數量。預設為 1000。 |
| LITELLM_EXPIRED_UI_SESSION_KEY_CLEANUP_ENABLED | 設為 true 以啟用已過期 LiteLLM dashboard session key 的背景清理工作。預設為 false。 |
| LITELLM_EXPIRED_UI_SESSION_KEY_CLEANUP_INTERVAL_SECONDS | 執行已過期 LiteLLM dashboard session key 清理工作的間隔秒數。預設為 86400(24 小時)。 |
| LITELM_ENVIRONMENT | LiteLLM Instance 的環境,目前僅用於 DeepEval 的記錄,以判定 DeepEval 整合的環境。 |
| LITELLM_KEY_ROTATION_ENABLED | 啟用 LiteLLM 自動金鑰輪替(boolean)。預設為 false。 |
| LITELLM_KEY_ROTATION_CHECK_INTERVAL_SECONDS | 執行自動輪替金鑰工作的間隔秒數。預設為 86400(24 小時)。 |
| LITELLM_KEY_ROTATION_GRACE_PERIOD | 輪替後保留舊金鑰有效的持續時間(例如 "24h"、"2d")。預設為空白(立即撤銷)。用於排程輪替,以及在 regenerate 請求未指定時作為備援。 |
| LITELLM_KEY_ROTATION_LOCK_TTL_SECONDS | 金鑰輪替工作所使用的分散式鎖 TTL(秒)。預設為 600(10 分鐘)。 |
| LITELLM_LICENSE | LiteLLM 使用的授權金鑰 |
| LITELLM_LOCAL_ANTHROPIC_BETA_HEADERS | 設為 True 時,僅使用本地內建的 Anthropic beta headers 設定,並停用遠端擷取。預設為 False |
| LITELLM_OIDC_ALLOWED_CREDENTIAL_DIRS | 以逗號分隔的絕對目錄清單,oidc/file/ 提供者可從中讀取 token 檔案。預設為 /var/run/secrets,/run/secrets。 |
| LITELLM_LOCAL_BLOG_POSTS | 設為 True 時,僅使用本地內建的 blog posts,並停用從 GitHub 的遠端擷取。預設為 False |
| LITELLM_LOCAL_MODEL_COST_MAP | LiteLLM 中 model cost mapping 的本地設定 |
| LITELLM_LOCAL_POLICY_TEMPLATES | 設為 "true" 時,使用本地備份 policy 範本,而非從 GitHub 擷取。policy 範本預設從 https://raw.githubusercontent.com/BerriAI/litellm/main/policy_templates.json 擷取,失敗時自動回退到本地備份 |
| LITELLM_LOG | 啟用 LiteLLM 的詳細記錄 |
| LITELLM_MODEL_COST_MAP_URL | 取得 model cost map 資料的 URL。預設為 https://raw.githubusercontent.com/BerriAI/litellm/main/model_prices_and_context_window.json |
| LITELLM_LOG_FILE | LiteLLM 記錄要寫入的檔案路徑。設定後,記錄會同時寫入主控台與指定檔案 |
| LITELLM_LOGGER_NAME | OTEL logger 的名稱 |
| LITELLM_METER_NAME | OTEL Meter 的名稱 |
| LITELLM_OTEL_INTEGRATION_ENABLE_EVENTS | 可選擇啟用 OTEL 的語意記錄(gen_ai.content.prompt/gen_ai.content.completion,或在 semconv 模式下為 gen_ai.client.inference.operation.details)。預設 false。請參閱 OpenTelemetry |
| LITELLM_OTEL_INTEGRATION_ENABLE_METRICS | 可選擇啟用 OTEL 的語意指標(TTFT、TPOT、回應持續時間、成本、token 使用量)。預設 false。請參閱 OpenTelemetry |
| LITELLM_OTEL_BAGGAGE_TEAM_METADATA_KEYS | 以逗號分隔的 team-metadata 子鍵允許清單,會以 litellm.team.metadata 的形式提升到 OTEL spans 上。預設為空,因此在每個子鍵明確列入允許清單之前,團隊的任何自由格式 metadata 都不會傳送到您的 tracing backend。也可在 config.yaml 的 callback_settings.otel 下以 baggage_team_metadata_keys 設定。請參閱 OpenTelemetry。 |
| LITELLM_ENABLE_PYROSCOPE | 若為 true,會啟用 Pyroscope CPU profiling。profile 會傳送至 PYROSCOPE_SERVER_ADDRESS。預設關閉。請參閱 Pyroscope profiling。 |
| LITELLM_ENABLE_TEAM_STALE_ALIAS_BYPASS | 當 true 時,若某團隊的舊版 model_aliases 項目將公開模型名稱對應到內部 model_name_<team_id>_<uuid> 部署,當該公開名稱存在團隊範圍的同層部署時,前置呼叫處理可略過該重寫——因此負載平衡 / order 會套用於同層部署。為了向後相容,預設為 false。請參閱 Team-scoped models and legacy aliases。當偵測到陳舊別名且此旗標關閉時,proxy 可能會記錄一次性警告。 |
| PYROSCOPE_APP_NAME | Pyroscope 回報的應用程式名稱。當 LITELLM_ENABLE_PYROSCOPE 為 true 時必填。沒有預設值。 |
| PYROSCOPE_SERVER_ADDRESS | 要傳送 profile 的 Pyroscope server URL。當 LITELLM_ENABLE_PYROSCOPE 為 true 時必填。沒有預設值。 |
| PYROSCOPE_SAMPLE_RATE | 選用。Pyroscope profiling 的取樣率(整數)。沒有預設值;未設定時,會使用 pyroscope-io library 預設值。 |
| PYROSCOPE_GRAFANA_USER | 選用。Grafana Cloud Pyroscope 使用者/租戶 ID,用於 basic auth。當設定 PYROSCOPE_GRAFANA_API_TOKEN 時必填。 |
| PYROSCOPE_GRAFANA_API_TOKEN | 選用。Grafana Cloud API/access policy token,用於 Pyroscope basic auth。當設定 PYROSCOPE_GRAFANA_USER 時必填。 |
| LITELLM_MASTER_KEY | 用於 proxy 驗證的主金鑰 |
| LITELLM_MAX_BUDGET_PER_SESSION_TTL | max-budget-per-session 限制器所使用的 session 預算計數器 TTL(秒)。預設為 3600(1 小時) |
| LITELLM_MAX_ITERATIONS_TTL | max-iterations 限制器所使用的 session 迭代計數器 TTL(秒)。預設為 3600(1 小時) |
| LITELLM_MAX_STREAMING_DURATION_SECONDS | 串流回應允許的最長持續時間(秒)。超過此時間的串流會以 Timeout error 終止。預設為 None(無限制) |
| LITELLM_STREAM_INACTIVITY_TIMEOUT_SECONDS | 在對 async 串流提供者等待下一個 chunk 前的最長秒數,超過後將引發 Timeout。可防止提供者僅以 keepalive bytes 維持連線但停止送出內容。預設為 None(停用) |
| LITELLM_MODE | LiteLLM 的運作模式(例如:production、development) |
| LITELLM_NON_ROOT | 在 Docker 容器中以 non-root 模式執行 LiteLLM 以提升安全性的旗標 |
| LITELLM_RATE_LIMIT_WINDOW_SIZE | LiteLLM 的速率限制視窗大小。預設為 60 |
| LITELLM_REASONING_AUTO_SUMMARY | 若設為 "true",會自動為所有翻譯路徑(Anthropic adapter、Responses API 等)上的推理模型啟用詳細推理摘要(summary: "detailed")。預設為 "false" |
| LITELLM_SALT_KEY | LiteLLM 加密用的 salt key |
| LITELLM_SENSITIVE_ROUTING_TTL | 黏著式敏感資料 routing 決策的 TTL(秒);控制 session 保持釘選到由 routing guardrail 選出的內部部署模型的時間長度。預設為 3600 |
| LITELLM_SSL_CIPHERS | 用於更快 handshake 的 SSL/TLS cipher 設定。控制 OpenSSL 連線的 cipher suite 偏好。 |
| LITELLM_SECRET_AWS_KMS_LITELLM_LICENSE | LiteLLM 的 AWS KMS 加密授權 |
| LITELLM_TOKEN | LiteLLM 整合的存取 token |
| LITELLM_TPM_TOKEN_RESERVATION_ENABLED | 當為 false 時,v3 rate limiter 會跳過前置 TPM token 保留,並根據實際使用量在請求後強制執行 TPM。預設為 true |
| LITELLM_USE_CHAT_COMPLETIONS_URL_FOR_ANTHROPIC_MESSAGES | 設為 "true" 時,會將 OpenAI /v1/messages 請求對 Anthropic 模型改經由 chat/completions,而非 Responses API。也可透過 litellm_settings.use_chat_completions_url_for_anthropic_messages 設定 |
| LITELLM_ROUTE_ALL_CHAT_OPENAI_TO_RESPONSES | 設為 "true" 時,會將所有 OpenAI /chat/completions 請求透過 Responses API bridge 路由。建議用於 OpenAI 模型。也可透過 litellm_settings.route_all_chat_openai_to_responses 設定 |
| LITELLM_GEMINI_LIVE_DEFER_SETUP | 設為 "true" 時,會延後 Gemini/Vertex Live 的設定,直到用戶端傳送 session.update(runtime tool injection 所需)。為向後相容,預設為 "false",即連線時自動傳送 setup。也可透過 litellm.gemini_live_defer_setup 設定 |
| LITELLM_USE_LEGACY_INTERACTIONS_SCHEMA | 設為 "true" 時,會使用舊版 Google Interactions API schema(outputs array、2026-05-07 revision),而非新版 schema(steps array、2026-05-20 revision)。舊版 schema 將於 2026 年 6 月 8 日停止支援。也可透過 litellm_settings.use_legacy_interactions_schema 設定 |
| LITELLM_USER_AGENT | LiteLLM API 請求的自訂 user agent 字串。用於合作夥伴遙測歸因 |
| LITELLM_WORKER_STARTUP_HOOKS | 以逗號分隔的 module.path:function_name callable 清單,會在每個 worker process 啟動期間執行。於 worker 生命週期早期執行(在 config/DB 載入之前)。適合用來重新初始化像 gflags 這類每個 process 的狀態。詳情請參閱 Worker Startup Hooks |
| LITELLM_PRINT_STANDARD_LOGGING_PAYLOAD | 若為 true,則將標準記錄 payload 列印到主控台——有助於除錯 |
| LITELM_ENVIRONMENT | LiteLLM Instance 的環境。目前僅記錄到 DeepEval,用以判定 DeepEval 整合的環境。 |
| LITELLM_ASYNCIO_QUEUE_MAXSIZE | asyncio 佇列的最大大小(例如記錄佇列、花費更新佇列,以及 cookbook 範例中像 nova_sonic_realtime.py 的即時音訊)。限制記憶體成長以避免 OOM。預設為 1000。 |
| LOGFIRE_TOKEN | Logfire 記錄服務的 Token |
| LOGFIRE_BASE_URL | Logfire 記錄服務的基礎 URL(對自架部署有用) |
| LOGGING_WORKER_CONCURRENCY | asyncio event loop 上記錄 worker 的最大並行 coroutine 插槽數。預設為 100。設定過高會使記錄任務淹沒 event loop,進而降低請求的整體延遲。 |
| LOGGING_WORKER_MAX_QUEUE_SIZE | 記錄 worker 佇列的最大大小。當佇列滿時,worker 會積極清除任務以騰出空間,而不是丟棄記錄。預設為 50,000 |
| LOGGING_WORKER_MAX_TIME_PER_COROUTINE | 記錄 worker 中每個 coroutine 允許的最長時間(秒),逾時後結束。預設為 20.0 |
| LOGGING_WORKER_CLEAR_PERCENTAGE | 清除時要擷取的佇列百分比。預設為 50% |
| MAX_BASE64_LENGTH_FOR_LOGGING | 記錄 payload 中保留的 base64 字元最大數量。超過此值的 Data URI 會以大小佔位符取代。設為 0 可停用截斷。預設為 64 |
| MAX_COMPETITOR_NAMES | policy 範本擴充中允許的競品名稱最大數量。預設為 100 |
| MAX_EXCEPTION_MESSAGE_LENGTH | 例外訊息的最大長度。預設為 2000 |
| MAX_ITERATIONS_TO_CLEAR_QUEUE | 關閉時嘗試清除記錄 worker 佇列的最大迭代次數。預設為 200 |
| MAX_TIME_TO_CLEAR_QUEUE | 關閉時清除記錄 worker 佇列所花費的最長時間(秒)。預設為 5.0 |
| LOGGING_WORKER_AGGRESSIVE_CLEAR_COOLDOWN_SECONDS | 佇列滿時,在允許下一次積極清除操作前的冷卻時間(秒)。預設為 0.5 |
| MAX_STRING_LENGTH_PROMPT_IN_DB | 在清理請求本文時,spend logs 中字串的最大長度。超過此長度的字串會被截斷。預設為 1000 |
| MAX_IN_MEMORY_QUEUE_FLUSH_COUNT | 記憶體內佇列 flush 作業的最大次數。預設為 1000 |
| MAX_IMAGE_URL_DOWNLOAD_SIZE_MB | 從 URL 下載圖片時的最大大小(MB)。可防止下載過大的圖片造成記憶體問題。超過此限制的圖片會在下載前被拒絕。設為 0 可完全停用圖片 URL 處理(所有 image_url 請求都將被封鎖)。預設為 50MB(與 OpenAI 的限制 相同) |
| MAX_LONG_SIDE_FOR_IMAGE_HIGH_RES | 高解析度圖片長邊的最大長度。預設為 2000 |
| MAX_REDIS_BUFFER_DEQUEUE_COUNT | Redis 緩衝區出隊作業的最大次數。預設為 100 |
| MAX_REQUEST_BODY_SIZE_TO_REPAIR_MB | 當 LiteLLM 無法將請求本文解析為 JSON 時,會嘗試修復的最大請求本文大小(MB)。修復備援會對完整本文執行兩次 regex 掃描,以修正無效的 surrogate escape,而這會在大型錯誤 payload 上阻塞 event loop。超過此大小的本文會略過修復並立即回傳 400;小於或等於此大小的本文仍會修復。設為 0 可停用上限並一律嘗試修復。預設為 1(MB) |
| MAX_SHORT_SIDE_FOR_IMAGE_HIGH_RES | 高解析度圖片短邊的最大長度。預設為 768 |
| MAX_SIZE_IN_MEMORY_QUEUE | 記憶體內佇列的最大大小。預設為 10000 |
| MAX_SIZE_PER_ITEM_IN_MEMORY_CACHE_IN_KB | 記憶體快取中每個項目的最大大小(KB)。預設為 512 或 1024 |
| MAX_SPENDLOG_ROWS_TO_QUERY | 要查詢的 spend log 列最大數量。預設為 1,000,000 |
| MAX_TEAM_LIST_LIMIT | 要列出的團隊最大數量。預設為 20 |
| MAX_TILE_HEIGHT | 圖片 tile 的最大高度。預設為 512 |
| MAX_TILE_WIDTH | 圖片 tile 的最大寬度。預設為 512 |
| MAX_TOKEN_TRIMMING_ATTEMPTS | 修剪 token 訊息的最大嘗試次數。預設為 10 |
| MAXIMUM_TRACEBACK_LINES_TO_LOG | LiteLLM Logs UI 中要記錄的 traceback 最大行數。預設為 100 |
| MAX_RETRY_DELAY | 重試請求的最大延遲(秒)。預設為 8.0 |
| MAX_LANGFUSE_INITIALIZED_CLIENTS | 在 proxy 上要初始化的 Langfuse client 最大數量。預設為 50。這樣設定是因為每次初始化一個 client 時,langfuse 都會初始化 1 個 thread。過去曾發生過因為多次初始化 Langfuse 而導致 CPU 使用率達到 100% 的事件。 |
| MAX_MCP_SEMANTIC_FILTER_TOOLS_HEADER_LENGTH | MCP semantic filter tools 的最大標頭長度。預設為 150 |
| MAX_POLICY_ESTIMATE_IMPACT_ROWS | 估算 policy 影響時回傳的最大列數。預設為 1000 |
| MAX_PAYLOAD_SIZE_FOR_DEBUG_LOG | 完整 DEBUG 序列化允許的最大 payload 大小(位元組)。超過此值的 payload 會在記錄中截斷。預設為 102400(100 KB) |
| MIN_NON_ZERO_TEMPERATURE | 最小非零 temperature 值。預設為 0.0001 |
| MINIMUM_PROMPT_CACHE_TOKEN_COUNT | 可快取提示詞的最小 token 數。預設為 1024 |
| MISTRAL_API_BASE | Mistral API 的基礎 URL。預設為 https://api.mistral.ai |
| MISTRAL_API_KEY | Mistral API 的 API 金鑰 |
| MICROSOFT_AUTHORIZATION_ENDPOINT | Microsoft SSO 的自訂授權端點 URL(覆寫預設 Microsoft OAuth 授權端點) |
| MICROSOFT_CLIENT_ID | Microsoft 服務的 Client ID |
| MICROSOFT_CLIENT_SECRET | Microsoft 服務的 Client secret |
| MICROSOFT_GRAPH_ENDPOINT | 透過 SSO 同步 Entra ID 群組成員資格時所使用的 Microsoft Graph API 基礎 URL。預設為 https://graph.microsoft.com/v1.0。Azure Government Cloud(GCC High)請設為 https://graph.microsoft.us/v1.0 |
| MICROSOFT_SERVICE_PRINCIPAL_ID | Microsoft Enterprise Application 的 Service Principal ID。(這是進階功能,若您希望 litellm 根據 Microsoft Entra ID Groups 自動將成員指派到 Litellm Teams) |
| MICROSOFT_TENANT | Microsoft Azure 的 Tenant ID |
| MICROSOFT_TOKEN_ENDPOINT | Microsoft SSO 的自訂 token 端點 URL(覆寫預設 Microsoft OAuth token 端點) |
| MICROSOFT_USER_DISPLAY_NAME_ATTRIBUTE | Microsoft SSO 回應中使用者顯示名稱的欄位名稱。預設為 displayName |
| MICROSOFT_USER_EMAIL_ATTRIBUTE | Microsoft SSO 回應中使用者電子郵件的欄位名稱。預設為 userPrincipalName |
| MICROSOFT_USER_FIRST_NAME_ATTRIBUTE | Microsoft SSO 回應中使用者名字的欄位名稱。預設為 givenName |
| MICROSOFT_USER_ID_ATTRIBUTE | Microsoft SSO 回應中使用者 ID 的欄位名稱。預設為 id |
| MICROSOFT_USER_LAST_NAME_ATTRIBUTE | Microsoft SSO 回應中使用者姓氏的欄位名稱。預設為 surname |
| MICROSOFT_USERINFO_ENDPOINT | Microsoft SSO 的自訂 userinfo 端點 URL(覆寫預設 Microsoft Graph userinfo 端點) |
| MODEL_COST_MAP_MAX_SHRINK_RATIO | 驗證取得的 model cost map 與本地備份相比時,允許的最大縮減比例。若取得的 map 小於備份的此比例,將被拒絕。預設為 0.5 |
| MODEL_COST_MAP_MIN_MODEL_COUNT | 取得的 cost map 必須包含的最小模型數量,才視為有效。預設為 50 |
| NEW_RELIC_APP_NAME | New Relic AI Monitoring 整合的應用程式名稱 |
| NEW_RELIC_LICENSE_KEY | New Relic 驗證的授權金鑰 |
| NO_DOCS | 停用 Swagger UI 文件的旗標 |
| NO_OPENAPI | 停用 /openapi.json 端點的旗標 |
| NO_REDOC | 停用 Redoc 文件的旗標 |
| NO_PROXY | 要略過 proxy 的位址清單 |
| NON_LLM_CONNECTION_TIMEOUT | 非 LLM 服務連線的逾時時間(秒)。預設為 15 |
| OAUTH_TOKEN_INFO_ENDPOINT | OAuth token 資訊擷取端點 |
| OPENAI_BASE_URL | OpenAI API 的基礎 URL |
| OPENAI_API_BASE | OpenAI API 的基礎 URL。預設為 https://api.openai.com/ |
| OPENAI_API_KEY | OpenAI 服務的 API 金鑰 |
| OPENAI_CHATGPT_API_BASE | CHATGPT_API_BASE 的替代方案。ChatGPT API 的基礎 URL |
| OPENAI_FILE_SEARCH_COST_PER_1K_CALLS | OpenAI file search 每 1000 次呼叫的成本。預設為 0.0025 |
| OPENAI_ORGANIZATION | OpenAI 的組織識別碼 |
| OPENAPI_URL | OpenAPI JSON 端點的路徑。預設為 "/openapi.json" |
| OPENID_BASE_URL | OpenID Connect 服務的基礎 URL |
| OPENID_CLIENT_ID | OpenID Connect 驗證的 Client ID |
| OPENID_CLIENT_SECRET | OpenID Connect 驗證的 Client secret |
| OPENMETER_API_ENDPOINT | OpenMeter 整合的 API 端點 |
| OPENMETER_API_KEY | OpenMeter 服務的 API 金鑰 |
| OPENMETER_EVENT_TYPE | 傳送至 OpenMeter 的事件類型 |
| OPENMETER_TRUST_REQUEST_USER | 若為 false,則忽略請求本文 user,並從已驗證金鑰的 user_id 解析 OpenMeter subject。預設為 true |
| ONYX_API_BASE | Onyx Security AI Guard 服務的基礎 URL(預設為 https://ai-guard.onyx.security) |
| ONYX_API_KEY | Onyx Security AI Guard 服務的 API 金鑰 |
| ONYX_TIMEOUT | Onyx Guard server 請求的逾時時間(秒)。預設為 10 |
| OTEL_ENDPOINT | 用於 traces 的 OpenTelemetry 端點 |
| OTEL_EXPORTER_OTLP_ENDPOINT | 用於 traces 的 OpenTelemetry 端點 |
| OTEL_ENVIRONMENT_NAME | OpenTelemetry 的環境名稱 |
| OTEL_EXPORTER | OpenTelemetry 的 exporter 類型 |
| OTEL_EXPORTER_OTLP_PROTOCOL | OpenTelemetry 的 exporter 類型 |
| OTEL_HEADERS | OpenTelemetry 請求的標頭 |
| OTEL_MODEL_ID | OpenTelemetry tracing 的模型 ID |
| OTEL_EXPORTER_OTLP_HEADERS | OpenTelemetry 請求的標頭 |
| OTEL_SERVICE_NAME | OpenTelemetry 的服務名稱識別碼 |
| OTEL_TRACER_NAME | OpenTelemetry tracing 的 tracer 名稱 |
| OTEL_LOGS_EXPORTER | OpenTelemetry logs 的 exporter 類型(例如:console) |
| OTEL_IGNORE_CONTEXT_PROPAGATION | 當為 true 時,忽略父 span context 傳遞(傳入的 traceparent headers 與任何作用中的 span),使每個 LiteLLM trace 都成為自己的 root。預設 false |
| OTEL_INSTRUMENTATION_GENAI_CAPTURE_MESSAGE_CONTENT | 控制 prompts 與 completions 是否被擷取到 OpenTelemetry traces 中。可接受 NO_CONTENT(依規格預設)、SPAN_ONLY、EVENT_ONLY、SPAN_AND_EVENT,或布林形式(true 對應 EVENT_ONLY、false 對應 NO_CONTENT) |
| OTEL_SEMCONV_STABILITY_OPT_IN | 設為 gen_ai_latest_experimental 以依據最新的 OpenTelemetry GenAI semantic conventions 發出 spans。會將 LLM-call span 重新命名為 {operation} {model}、抑制 raw_gen_ai_request、加入 gen_ai.provider.name,並整合事件。依 OTEL 規格可用逗號分隔 |
| USE_OTEL_LITELLM_REQUEST_SPAN | 當 true 時,proxy 會針對每次 LLM call 發出一個獨立的 litellm_request span,作為 Received Proxy Server Request span 的子項。預設 false(自 v1.81.0 起);LLM-call 屬性直接設定在 proxy root span 上。請參閱 Why don't I see a litellm_request span? |
| OTEL_DEBUG | 當 true 時,將 exporter 與 span 建立診斷輸出至 stderr。當 traces 沒有送達後端時很有用。預設 false |
| DEBUG_OTEL | OTEL_DEBUG 的別名 |
| PAGERDUTY_API_KEY | PagerDuty Alerting 的 API 金鑰 |
| PANW_PRISMA_AIRS_API_KEY | PANW Prisma AIRS 服務的 API 金鑰 |
| PANW_PRISMA_AIRS_API_BASE | PANW Prisma AIRS 服務的基礎 URL |
| PHOENIX_API_KEY | Arize Phoenix 的 API 金鑰 |
| PHOENIX_COLLECTOR_ENDPOINT | Arize Phoenix 的 API 端點 |
| PHOENIX_COLLECTOR_HTTP_ENDPOINT | Arize Phoenix 的 API http 端點 |
| PILLAR_API_BASE | Pillar API Guardrails 的基礎 URL |
| PILLAR_API_KEY | Pillar API Guardrails 的 API 金鑰 |
| PILLAR_ON_FLAGGED_ACTION | 內容被標記時要採取的動作('block' 或 'monitor') |
| PKCE_STRICT_CACHE_MISS | 設為 true 時,若 PKCE code_verifier 不在快取中(例如跨 pod 發生 cache miss),SSO callback 會回傳 401 錯誤。當為 false(預設)時,會記錄警告並在沒有 code_verifier 的情況下繼續。 |
| POD_NAME | 伺服器的 pod 名稱,這將會 輸出至 datadog 記錄 作為 POD_NAME |
| POSTHOG_API_KEY | PostHog 分析整合的 API 金鑰 |
| POSTHOG_API_URL | PostHog API 的基礎 URL(預設為 https://us.i.posthog.com) |
| POSTHOG_MOCK | 啟用 PostHog 整合測試的 mock 模式。設為 true 時,會攔截 PostHog API 呼叫並回傳 mock 回應,而不進行實際網路請求。預設為 false |
| POSTHOG_MOCK_LATENCY_MS | 啟用 mock 模式時,PostHog API 呼叫的 mock 延遲(毫秒)。模擬網路往返時間。預設為 100ms |
| PRISMA_AUTH_RECONNECT_LOCK_TIMEOUT_SECONDS | Prisma auth 重新連線的鎖逾時時間(秒)。預設為 0.1 |
| PRISMA_AUTH_RECONNECT_TIMEOUT_SECONDS | Prisma auth 重新連線嘗試的逾時時間(秒)。預設為 2.0 |
| PRISMA_HEALTH_WATCHDOG_ENABLED | 啟用 Prisma DB 健康 watchdog,以監控連線中斷並在失去連線時重新連線。預設為 true |
| PRISMA_HEALTH_WATCHDOG_INTERVAL_SECONDS | Prisma health watchdog 探測的間隔秒數。預設為 30 |
| PRISMA_HEALTH_WATCHDOG_PROBE_TIMEOUT_SECONDS | 每次 Prisma health 探測的逾時時間(秒)。預設為 5.0 |
| PRISMA_RECONNECT_COOLDOWN_SECONDS | Prisma 重新連線嘗試之間的冷卻時間(秒)。預設為 15 |
| PRISMA_RECONNECT_ESCALATION_THRESHOLD | 在升級重新連線策略之前允許的連續重新連線失敗次數。預設為 3 |
| PRISMA_WATCHDOG_RECONNECT_TIMEOUT_SECONDS | Prisma watchdog 主動重新連線的逾時時間(秒)。預設為 30.0 |
| PREDIBASE_API_BASE | Predibase API 的基礎 URL |
| PRESIDIO_ANALYZER_API_BASE | Presidio Analyzer 服務的基礎 URL |
| PRESIDIO_ANONYMIZER_API_BASE | Presidio Anonymizer 服務的基礎 URL |
| PROMETHEUS_BUDGET_METRICS_PER_REQUEST_TIMEOUT | 在跳過之前,針對每個請求發出 Prometheus budget metrics 所允許花費的最長秒數;逾時時,該發送會被獨立丟棄,因此緩慢的 Redis/DB 查詢不會取消整個成功記錄事件。預設為 5.0 |
| PROMETHEUS_BUDGET_METRICS_REFRESH_INTERVAL_MINUTES | Prometheus budget metrics 的重新整理間隔(分鐘)。預設為 5 |
| PROMETHEUS_FALLBACK_STATS_SEND_TIME_HOURS | 將統計資料傳送至 Prometheus 的備援時間(小時)。預設為 9 |
| PROMETHEUS_URL | Prometheus 服務的 URL |
| PROMPTLAYER_API_KEY | PromptLayer 整合的 API 金鑰 |
| PROXY_ADMIN_ID | proxy server 的管理員識別碼 |
| PROXY_BASE_URL | proxy 服務的基礎 URL。也由 MCP OAuth authorize 端點在驗證瀏覽器提供的 redirect_uri 值時,作為 proxy 的公開 origin 使用——當 LiteLLM 透過 TLS 終止的 ingress 執行時,請將此設定為使用者在網址列中看到的確切 origin(例如 https://llm.example.com)。僅限完整 origin:scheme + host(若非預設則含 port),不得有尾端斜線,也不得有 path。設定後會優先於 X-Forwarded-* headers(僅在 use_x_forwarded_for 為 true 且 request peer 位於 mcp_trusted_proxy_ranges 中時才適用)。請參閱 MCP OAuth — Reverse proxy and ingress configuration。 |
| PROXY_BATCH_WRITE_AT | 等待後再將 spend logs 批次寫入資料庫的時間(秒)。預設為 10 |
| PROXY_BATCH_POLLING_INTERVAL | 等待後再輪詢批次以檢查是否完成的時間(秒)。預設為 6000s(1 小時) |
| PROXY_BATCH_POLLING_ENABLED | 設為 false 以完全停用 CheckBatchCost 與 CheckResponsesCost 背景輪詢工作。對於安裝中存在大量陳舊受管理物件時的緊急緩解很有用。預設為 true |
| MAX_OBJECTS_PER_POLL_CYCLE | 每個輪詢週期擷取的受管理物件(batches / responses)最大數量。可防止在具有許多陳舊資料列的安裝中發生 OOM。預設為 50 |
| MANAGED_OBJECT_STALENESS_CUTOFF_DAYS | 非終止狀態且超過此天數的受管理物件,會在每個輪詢週期開始時標記為 stale_expired 並略過。預設為 7 |
| PROXY_BUDGET_RESCHEDULER_MAX_TIME | 在檢查資料庫是否有預算重設前允許等待的最長時間(秒)。預設為 605 |
| PROXY_BUDGET_RESCHEDULER_MIN_TIME | 在檢查資料庫是否有預算重設前允許等待的最短時間(秒)。預設為 597 |
| PYTHON_GC_THRESHOLD | GC 閾值('gen0,gen1,gen2',例如 '1000,50,50');預設為 Python 的值。 |
| PROXY_LOGOUT_URL | 登出 proxy 服務的 URL |
| QDRANT_API_BASE | Qdrant API 的基礎 URL |
| QDRANT_API_KEY | Qdrant 服務的 API 金鑰 |
| QDRANT_SCALAR_QUANTILE | Qdrant 作業的 scalar quantile。預設為 0.99 |
| QDRANT_URL | Qdrant 資料庫的連線 URL |
| QDRANT_VECTOR_SIZE | Qdrant 作業的向量大小。預設為 1536 |
| REDIS_CONNECTION_POOL_TIMEOUT | Redis 連線池的逾時時間(秒)。預設為 5 |
| REDIS_CIRCUIT_BREAKER_ENABLED | 當為 false 時,Redis circuit breaker 會停用且永不開啟。預設為 true |
| REDIS_CIRCUIT_BREAKER_FAILURE_THRESHOLD | Redis circuit breaker 開啟前的連續失敗次數。預設為 5 |
| REDIS_CIRCUIT_BREAKER_RECOVERY_TIMEOUT | Redis circuit breaker 開啟後嘗試復原前的等待時間(秒)。預設為 60 |
| REDIS_CLUSTER_NODES | Redis Cluster 模式的 Redis cluster 啟動節點 JSON 格式清單。範例:[{"host": "node1", "port": 6379}] |
| REDIS_HOST | Redis 伺服器的主機名稱 |
| REDIS_PASSWORD | Redis 服務的密碼 |
| REDIS_PORT | Redis 伺服器的連接埠號 |
| REDIS_SOCKET_TIMEOUT | Redis socket 操作的逾時時間(秒)。預設為 0.1 |
| REDIS_GCP_SERVICE_ACCOUNT | 用於與 Redis 進行 IAM 驗證的 GCP service account。格式:"projects/-/serviceAccounts/name@project.iam.gserviceaccount.com" |
| REDIS_GCP_SSL_CA_CERTS | 用於安全 GCP Memorystore Redis 連線的 SSL CA 憑證檔案路徑 |
| REDOC_URL | Redoc Fast API 文件的路徑。預設為 "/redoc" |
| REPEATED_STREAMING_CHUNK_LIMIT | 重複串流區塊的限制,用於偵測迴圈。預設為 100 |
| REALTIME_WEBSOCKET_MAX_MESSAGE_SIZE_BYTES | 即時連線中 WebSocket 訊息的最大大小(位元組)。預設為 None。 |
| REPLICATE_MODEL_NAME_WITH_ID_LENGTH | 帶 ID 的 Replicate 模型名稱長度。預設為 64 |
| REPLICATE_POLLING_DELAY_SECONDS | Replicate 輪詢作業的延遲(秒)。預設為 0.5 |
| REQUEST_TIMEOUT | 請求的逾時時間(秒)。預設為 6000 |
| ROOT_REDIRECT_URL | 當 DOCS_URL 設為非 "/" 時,要將根路徑 (/) 重新導向到的 URL(DOCS_URL 預設為 "/") |
| ROUTER_MAX_FALLBACKS | router 的最大備援次數。預設為 5 |
| RUBRIK_API_KEY | 用於驗證 Rubrik webhook 服務的 bearer token |
| RUBRIK_BATCH_SIZE | flush 至 Rubrik 前要緩衝的記錄項目數。預設為 512 |
| RUBRIK_SAMPLING_RATE | 要記錄至 Rubrik 的請求比例(0.0 到 1.0)。預設為 1.0 |
| RUBRIK_WEBHOOK_URL | Rubrik webhook 服務的基礎 URL,用於工具封鎖與批次記錄 |
| RUNWAYML_DEFAULT_API_VERSION | RunwayML 服務的預設 API 版本。預設為 "2024-11-06" |
| RUNWAYML_POLLING_TIMEOUT | RunwayML 圖片生成輪詢的逾時時間(秒)。預設為 600(10 分鐘) |
| S3_VECTORS_DEFAULT_DIMENSION | S3 Vectors RAG 擷取的預設向量維度。預設為 1024 |
| S3_VECTORS_DEFAULT_DISTANCE_METRIC | S3 Vectors RAG 擷取的預設距離度量。選項:"cosine"、"euclidean"。預設為 "cosine" |
| SECRET_MANAGER_REFRESH_INTERVAL | secret manager 的重新整理間隔(秒)。預設為 86400(24 小時) |
| SERVER_ROOT_PATH | 伺服器應用程式的根路徑 |
| SEND_USER_API_KEY_ALIAS | 將使用者 API 金鑰別名傳送至 Zscaler AI Guard 的旗標。預設為 False |
| SEND_USER_API_KEY_TEAM_ID | 將使用者 API 金鑰 team ID 傳送至 Zscaler AI Guard 的旗標。預設為 False |
| SEND_USER_API_KEY_USER_ID | 將使用者 API 金鑰 user ID 傳送至 Zscaler AI Guard 的旗標。預設為 False |
| SET_VERBOSE | [已棄用] 請改用 LITELLM_LOG,值可為 "INFO"、"DEBUG" 或 "ERROR"。請參閱 debugging 文件 |
| SINGLE_DEPLOYMENT_TRAFFIC_FAILURE_THRESHOLD | 單一部署冷卻邏輯中,被視為「合理流量」所需的最小請求數。預設為 1000 |
| SLACK_DAILY_REPORT_FREQUENCY | 每日 Slack 報告的頻率(例如:daily、weekly) |
| SLACK_WEBHOOK_URL | Slack 整合的 webhook URL |
| SMTP_HOST | SMTP server 的主機名稱 |
| SMTP_PASSWORD | SMTP 驗證密碼(若 SMTP 不需要驗證,請勿設定) |
| SMTP_PORT | SMTP server 的連接埠號 |
| SMTP_SENDER_EMAIL | SMTP 交易中用作寄件者的電子郵件地址 |
| SMTP_SENDER_LOGO | 透過 SMTP 寄送的電子郵件中使用的 Logo |
| SMTP_TLS | 啟用或停用 SMTP 連線 TLS 的旗標 |
| SMTP_USE_SSL | 設為 "True" 以在任何連接埠上強制使用隱式 SSL(SMTP_SSL)。連接埠 465 不需要此設定,因為它會自動使用隱式 SSL;其他連接埠預設使用 STARTTLS(請參閱 SMTP_TLS) |
| SMTP_USERNAME | SMTP 驗證的使用者名稱(若 SMTP 不需要驗證,請勿設定) |
| SENDGRID_API_KEY | SendGrid 電子郵件服務的 API 金鑰 |
| RESEND_API_KEY | Resend 電子郵件服務的 API 金鑰 |
| SENDGRID_SENDER_EMAIL | 在 SendGrid 電子郵件交易中用作寄件者的電子郵件地址 |
| SPEND_LOGS_URL | 取得 spend logs 的 URL |
| SPEND_LOG_CLEANUP_BATCH_SIZE | 清理期間每批刪除的記錄數。預設為 1000 |
| STALE_OBJECT_CLEANUP_BATCH_SIZE | 每次清理週期更新的陳舊受管理物件最大數量。預設為 1000 |
| SSL_CERTIFICATE | SSL 憑證檔案的路徑 |
| SSL_ECDH_CURVE | SSL/TLS 金鑰交換的 ECDH curve(例如,'X25519' 以停用 PQC)。 |
| SSL_SECURITY_LEVEL | [BETA] SSL/TLS 連線的安全等級。例如 DEFAULT@SECLEVEL=1 |
| SSL_VERIFY | 啟用或停用 SSL 憑證驗證的旗標 |
| SSL_CERT_FILE | 自訂 CA bundle 的 SSL 憑證檔案路徑 |
| SUPABASE_KEY | Supabase 服務的 API 金鑰 |
| SUPABASE_URL | Supabase Instance 的基礎 URL |
| STORE_MODEL_IN_DB | 若為 true,則啟用在資料庫中儲存 model + credential 資訊。 |
| SYSTEM_MESSAGE_TOKEN_COUNT | system message 的 token 數。預設為 4 |
| TEST_EMAIL_ADDRESS | 用於測試的電子郵件地址 |
| TOGETHER_AI_4_B | Together AI 4B 模型的大小參數。預設為 4 |
| TOGETHER_AI_8_B | Together AI 8B 模型的大小參數。預設為 8 |
| TOGETHER_AI_21_B | Together AI 21B 模型的大小參數。預設為 21 |
| TOGETHER_AI_41_B | Together AI 41B 模型的大小參數。預設為 41 |
| TOGETHER_AI_80_B | Together AI 80B 模型的大小參數。預設為 80 |
| TOGETHER_AI_110_B | Together AI 110B 模型的大小參數。預設為 110 |
| TOGETHER_AI_EMBEDDING_150_M | Together AI 150M embedding model 的大小參數。預設為 150 |
| TOGETHER_AI_EMBEDDING_350_M | Together AI 350M embedding model 的大小參數。預設為 350 |
| TOOL_CHOICE_OBJECT_TOKEN_COUNT | tool choice objects 的 token 數。預設為 4 |
| TOOL_POLICY_CACHE_TTL_SECONDS | 快取 tool policy guardrail 結果的 TTL(秒)。預設為 60 |
| UI_LOGO_PATH | UI 中使用的 logo 圖片路徑 |
| UI_PASSWORD | 存取 UI 的密碼 |
| UI_USERNAME | 存取 UI 的使用者名稱 |
| UPSTREAM_LANGFUSE_DEBUG | 啟用上游 Langfuse 除錯的旗標 |
| UPSTREAM_LANGFUSE_HOST | 上游 Langfuse 服務的主機 URL |
| UPSTREAM_LANGFUSE_PUBLIC_KEY | 上游 Langfuse 驗證的 public key |
| UPSTREAM_LANGFUSE_RELEASE | 上游 Langfuse 的發行版本識別碼 |
| UPSTREAM_LANGFUSE_SECRET_KEY | 上游 Langfuse 驗證的 secret key |
| USE_AWS_KMS | 啟用 AWS Key Management Service 進行加密的旗標 |
| USE_PRISMA_MIGRATE | 使用 prisma migrate 而非 prisma db push 的旗標。建議用於 production 環境。 |
| VANTAGE_API_KEY | Vantage 成本匯入整合的 API 金鑰 |
| VANTAGE_BASE_URL | Vantage API 的基礎 URL。預設為 https://api.vantage.sh |
| VANTAGE_EXPORT_FREQUENCY | Vantage 的匯出頻率 — hourly(預設)、daily 或 interval |
| VANTAGE_EXPORT_INTERVAL_SECONDS | 當 VANTAGE_EXPORT_FREQUENCY 為 interval 時的間隔秒數 |
| VANTAGE_INTEGRATION_TOKEN | 成本匯入端點的 Vantage 整合 token |
| WANDB_API_KEY | Weights & Biases(W&B)記錄整合的 API 金鑰 |
| WANDB_HOST | Weights & Biases(W&B)服務的主機 URL |
| WANDB_PROJECT_ID | Weights & Biases(W&B)記錄整合的專案 ID |
| WEBHOOK_URL | 接收來自外部服務 webhooks 的 URL |
| SPEND_LOG_RUN_LOOPS | 設定 spend_log_cleanup 工作應執行多少次 1000 筆批次刪除的常數 |
| SPEND_LOG_CLEANUP_BATCH_SIZE | 清理期間每批刪除的記錄數。預設為 1000 |
| SPEND_LOG_PARTITION_INTERVAL | LiteLLM_SpendLogs 分割區的粒度(當資料表分割時):day、week 或 month。預設為 day |
| SPEND_LOG_PARTITION_PRECREATE_AHEAD | 每次清理執行時預先建立的未來 spend-log 分割區數量。預設為 7 |
| SPEND_LOG_QUEUE_POLL_INTERVAL | spend log 佇列的輪詢間隔(秒)。預設為 2.0 |
| SPEND_LOG_QUEUE_SIZE_THRESHOLD | 處理前的 spend log 佇列大小閾值。預設為 100 |
| SPEND_LOG_CLEANUP_MAX_CONSECUTIVE_BATCH_FAILURES | spend log 清理執行在中止前可容忍的連續批次失敗次數。預設為 3 |
| SPEND_LOG_CLEANUP_BATCH_FAILURE_BACKOFF_SECONDS | 失敗的 spend log 清理批次之間的 backoff 秒數。預設為 0.5 |
| SPEND_COUNTER_RESEED_LOCKS_MAX_SIZE | 每個計數器用於合併來自資料庫的並行 spend-counter reseed 的 LRU lock dict 最大大小,於強制執行路徑使用。預設為 10000。 |
| COROUTINE_CHECKER_MAX_SIZE_IN_MEMORY | CoroutineChecker 記憶體快取的最大大小。預設為 1000 |
| DEFAULT_SHARED_HEALTH_CHECK_TTL | 共用健康檢查模式下快取健康檢查結果的存活時間(秒)。預設為 300(5 分鐘) |
| DEFAULT_SHARED_HEALTH_CHECK_LOCK_TTL | 共用健康檢查模式下健康檢查鎖的存活時間(秒)。預設為 60(1 分鐘) |
| ZSCALER_AI_GUARD_API_KEY | Zscaler AI Guard 服務的 API 金鑰 |
| ZSCALER_AI_GUARD_POLICY_ID | Zscaler AI Guard guardrails 的 policy ID |
| ZSCALER_AI_GUARD_URL | Zscaler AI Guard API 的基礎 URL。預設為 https://api.us1.zseclipse.net/v1/detection/execute-policy |