第七部分,高级与生产实践

安全上线与生产检查清单

用一份覆盖数据、权限、工具、评测、可靠性、成本和应急的清单完成生产发布。

发布前检查

  • 数据分类、保留和删除策略已经评审。
  • 密钥由服务端密钥系统管理并能快速轮换。
  • 工具权限最小化,高风险动作有人工批准。
  • 外部内容按不可信输入处理并测试提示注入。
  • 代表性评测、回归测试和安全测试通过。
  • 超时、重试、幂等、取消和降级已经实现。
  • 日志、指标、tracing 和告警能够定位失败。
  • 预算、速率、用户配额和异常成本告警生效。
  • 模型、提示、schema 和工具都有版本记录。
  • 回滚、停用和事件响应流程完成演练。

上线后的持续治理

小流量发布并观察真实分布,逐步扩大。把人工驳回、工具失败、用户投诉和高成本轨迹加入评测集。

定期审查不再使用的密钥、插件、MCP 连接和工具权限。模型或依赖升级都要走同样的评测与回滚流程。

最终原则

Codex 与 OpenAI SDK 能把模型能力连接到代码和系统,但工程质量仍来自明确契约、最小权限、可验证结果和持续评测。

从小任务开始建立证据链,再逐步增加工具、自动化和多代理。能力扩张应始终慢于治理和验证能力。

官方资料

本页由 xueai 根据 OpenAI 官方资料重新组织并用中文讲解。产品会持续更新,涉及版本、模型和命令时请同时核对下列官方页面。