Vellum 使用介绍:功能、价格与上手指南
Vellum 是一款专为大语言模型(LLM)应用开发设计的 AI 工具平台,支持提示词工程、版本管理、自动化评估与团队协作。本文全面介绍 Vellum 的核心功能、价格方案(免费版、专业版、企业版),并提供从注册到部署提示词的上手指南,帮助开发者与产品团队高效构建可靠 AI 应用。
Vellum 是面向大语言模型(LLM)应用开发的 AI 工具平台,帮助团队从原型到生产快速构建可靠 AI 应用。本文介绍 Vellum 的核心功能、价格方案与上手指南。
Vellum 是什么?
Vellum 是一个 LLM 应用开发平台,提供提示词工程、版本管理、评估与部署功能。它让开发者、产品经理和领域专家在同一界面协作,管理从提示词编写到生产部署的全流程。
Vellum 解决的核心问题:
- 提示词散落各处,难以版本化与回滚
- 模型输出质量不稳定,缺乏系统评估
- 团队协作低效,非技术人员无法参与
- 从原型到生产部署流程割裂
Vellum 核心功能
1. 提示词工程与版本管理
- 可视化提示词编辑器,支持变量、条件分支与函数调用
- 自动保存版本历史,支持对比与回滚
- 提示词与代码分离,非开发者也可修改
2. 自动化评估(Evaluation)
- 支持基于规则、模型评分与人工标注的评估方式
- 可上传测试数据集,批量运行并生成报告
- 追踪不同提示词版本的质量变化,数据驱动决策
3. 模型与提供商支持
- 兼容 OpenAI、Anthropic、Cohere、Google Gemini 等主流模型
- 支持自定义模型端点与本地模型
- 可在同一提示词中切换模型对比效果
4. 工作流与部署
- 通过 API 或 SDK 将提示词部署到生产环境
- 支持 Webhook、流式响应与结构化输出
- 提供监控与日志,追踪线上表现
5. 团队协作
- 角色权限管理(管理员、编辑者、查看者)
- 评论与审批流程,适合跨职能团队
- 审计日志追踪变更记录
Vellum 价格方案
| 方案 | 价格 | 主要包含 |
|---|---|---|
| 免费版 | $0 | 3 个用户,100 次提示词执行/月,基础评估 |
| 专业版 | $50/用户/月 | 无限提示词,10,000 次执行/月,高级评估,API 访问 |
| 企业版 | 定制 | SSO、审计日志、私有部署、专属支持 |
价格可能调整,请以 Vellum 官网为准。
Vellum 上手指南
步骤 1:注册与创建项目
访问 Vellum 官网注册账号,创建新项目并选择空白模板。
步骤 2:编写第一个提示词
在提示词编辑器中输入内容,例如:
你是一位客服助手。根据用户问题:{{question}},给出礼貌且准确的回答。
使用 {{变量}} 定义动态输入。
步骤 3:测试与评估
点击运行,输入测试问题查看输出。创建测试数据集,添加多个用例,运行评估对比不同版本。
步骤 4:部署到生产
发布提示词,获取 API 端点。使用 Python SDK 调用:
from vellum import Vellum
client = Vellum(api_key="YOUR_KEY")
result = client.execute_prompt(prompt_id="...", inputs={"question": "如何退款?"})
print(result.outputs[0].value)
步骤 5:监控与迭代
在仪表板查看调用日志与延迟,根据评估结果持续优化提示词。
Vellum 适合谁?
- AI 开发者:需要系统化管理提示词与评估
- 产品团队:希望快速验证 LLM 功能
- 企业:需要合规、协作与私有部署
结论
Vellum 通过提示词工程、评估与部署一体化,降低 LLM 应用开发门槛。建议从免费版开始,熟悉工作流后按需升级。若团队需要高效协作与质量保障,Vellum 是值得尝试的 AI 工具。