OpenAI
提示词优化器
Checked 09/15/2026View original
AI translation, not an official translation. Refer to the original for technical details.
On this page
完整文档索引,请参阅 llms.txt。在页面 URL 后追加
.md即可获取文档页面的 Markdown 版本。
提示词优化器 是控制台中的一个对话界面,您在其中输入提示词,我们会根据当前最佳实践对其进行优化后返回给您。将提示词优化器与数据集配合使用,是自动改进提示词的强大方式。
OpenAI 正在将基于数据集的提示词优化器作为 Evals 平台的一部分予以弃用。Evals 将于 2026 年 10 月 31 日对现有用户变为只读,该平台计划于 2026 年 11 月 30 日关闭。请参阅弃用页面了解当前时间表。
准备数据
- 建立一个数据集,其中包含您想要优化的提示词以及评估数据集。
- 在数据集中创建至少三行包含响应结果的数据。
- 为每行数据创建至少一个评分器结果或人工标注。
提示词优化器可使用数据集中的以下内容来改进您的提示词:
- 标注(好/差,以及您添加的其他自定义标注列)
- 写在 output_feedback 中的文字评语
- 评分器的结果
为获得有效结果,请添加包含好/差评级的标注,_并附上_详细、具体的评语。创建能够精确捕捉您对提示词期望属性的评分器。
优化提示词
准备好数据集后,创建一次优化任务。
- 在提示词面板底部,点击优化。这将为优化结果创建一个新标签页,并在后台启动优化流程。
- 优化后的提示词准备就绪后,查看并测试新提示词。
- 重复操作。虽然单次优化运行可能已达到您的预期效果,但建议对新提示词重复进行优化流程——生成输出、标注输出、运行评分器,然后再次优化。
提示词优化的效果取决于您的评分器质量。我们建议针对您发现提示词表现不佳的每个期望输出属性,构建定义明确的专项评分器。
在将优化后的提示词用于生产环境之前,请务必对其进行评估和人工审查。尽管提示词优化器通常能严格提升提示词的有效性,但优化后的提示词在特定输入上的表现有可能不如原始提示词。
后续步骤
如需更多灵感,请访问 OpenAI Cookbook,其中包含示例代码及第三方资源链接,或进一步了解我们的评估工具:
[Cookbook:使用 Evals 构建健壮的提示词
Operate a flywheel of continuous improvement using evaluations.](https://developers.openai.com/cookbook/examples/evaluation/building_resilient_prompts_using_an_evaluation_flywheel)
[使用 Evals
Evaluate against external models, interact with evals via API, and more.](https://developers.openai.com/api/docs/guides/evals)
[评分器
Build sophisticated graders to improve the effectiveness of your evals.](https://developers.openai.com/api/docs/guides/graders)
[微调
Improve a model's ability to generate responses tailored to your use case.](https://developers.openai.com/api/docs/guides/model-optimization)