跳至主要內容

DeepEval

什麼是 DeepEval?

DeepEval 是一個針對 LLM 的開源評估框架(Github)。

什麼是 Confident AI?

Confident AIdeepeval 平台)為團隊提供一個可觀測性平台,用於追蹤與監控 LLM 應用程式。可將其視為 LLM 應用程式的 Datadog。該平台可讓您:

  • 即時偵測並除錯 LLM 應用程式中的問題
  • 使用強大的篩選條件搜尋並分析歷史生成資料
  • 蒐集人類對模型回應的意見回饋
  • 執行評估以衡量並改善效能
  • 追蹤成本與延遲以最佳化資源使用

快速開始

import os
import time
import litellm


os.environ['OPENAI_API_KEY']='<your-openai-api-key>'
os.environ['CONFIDENT_API_KEY']='<your-confident-api-key>'

litellm.success_callback = ["deepeval"]
litellm.failure_callback = ["deepeval"]

try:
response = litellm.completion(
model="gpt-3.5-turbo",
messages=[
{"role": "user", "content": "What's the weather like in San Francisco?"}
],
)
except Exception as e:
print(e)

print(response)
資訊

您可以透過登入 Confident AI 平台來取得您的 CONFIDENT_API_KEY

支援與 Deepeval 團隊聯絡

🚅
LiteLLM Enterprise
為正式環境打造的 SSO/SAML、稽核記錄、支出追蹤、多團隊管理與防護欄。
深入瞭解 →