Enprompta – 生产级AI应用的提示词注册表、LLM评估与可观测性平台
Enprompta 是一个专为 AI 团队打造的评估与可观测性平台,支持追踪 LLM 调用、运行自动化评估,并在生产环境中迭代提示词,确保每次发布都能改进而非退化。
Enprompta 是一款面向 AI 团队的可观测性与评估平台,旨在帮助团队在生产环境中交付更可靠的 AI 应用。通过追踪每一次 LLM 调用、运行自动化评估,并允许在不重新部署的情况下迭代提示词,Enprompta 确保每一次发布都能带来改进,而非退化。
该平台与主流 AI 提供商集成,包括 OpenAI、Anthropic、Google AI、Mistral、Cohere 和 Llama,支持多模型测试。用户可以通过三种方式快速上手:观察 AI 在生产中的行为、在发布前捕获错误答案,或在不重新部署的情况下修复实时提示词。
核心功能
- 可观测性:追踪每一次 LLM 调用的输入、输出、延迟、令牌消耗和成本,支持 OpenTelemetry、OpenInference 和 OpenLLMetry。
- 评估:通过简单的规则或 AI 评分器自动对每个答案进行质量、安全性和准确性评分,支持在 CI 和实时流量中运行。
- 提示词迭代:提供版本化的提示词注册表,应用可在运行时拉取最新版本,支持秒级更新和回滚。
定价 Enprompta 提供免费套餐(个人开发者,每月 5000 次可观测性追踪)、Pro 套餐(每席位每月 29 英镑,200K 追踪)和企业级定制方案。所有计划均包含无限提示词和增强功能。
Enprompta 还提供免费的浏览器扩展,用于改进 ChatGPT、Claude 和 Gemini 中的提示词。团队可通过 SDK、REST API 和 Webhooks 实现完全编程访问。