AI News HubLIVE
站內改寫1 分鐘閱讀

Enprompta – 生產級AI應用的提示詞註冊表、LLM評估與可觀測性平台

Enprompta 是一個專為 AI 團隊打造的評估與可觀測性平台,支持追蹤 LLM 調用、運行自動化評估,並在生產環境中迭代提示詞,確保每次發佈都能改進而非退化。

來源Hacker News AI作者: John_Igwebuike

Enprompta 是一款面向 AI 團隊的可觀測性與評估平台,旨在幫助團隊在生產環境中交付更可靠的 AI 應用。通過追蹤每一次 LLM 調用、運行自動化評估,並允許在不重新部署的情況下迭代提示詞,Enprompta 確保每一次發佈都能帶來改進,而非退化。

該平台與主流 AI 提供商集成,包括 OpenAI、Anthropic、Google AI、Mistral、Cohere 和 Llama,支持多模型測試。用户可以通過三種方式快速上手:觀察 AI 在生產中的行為、在發佈前捕獲錯誤答案,或在不重新部署的情況下修復實時提示詞。

核心功能

  • 可觀測性:追蹤每一次 LLM 調用的輸入、輸出、延遲、令牌消耗和成本,支持 OpenTelemetry、OpenInference 和 OpenLLMetry。
  • 評估:通過簡單的規則或 AI 評分器自動對每個答案進行質量、安全性和準確性評分,支持在 CI 和實時流量中運行。
  • 提示詞迭代:提供版本化的提示詞註冊表,應用可在運行時拉取最新版本,支持秒級更新和回滾。

定價 Enprompta 提供免費套餐(個人開發者,每月 5000 次可觀測性追蹤)、Pro 套餐(每席位每月 29 英鎊,200K 追蹤)和企業級定製方案。所有計劃均包含無限提示詞和增強功能。

Enprompta 還提供免費的瀏覽器擴展,用於改進 ChatGPT、Claude 和 Gemini 中的提示詞。團隊可通過 SDK、REST API 和 Webhooks 實現完全編程訪問。