**系统提示词(system prompt)**是模型在对话开始之前收到的指令块——用户看不见,但模型在每次回复前都会读它。用户提示词说的是你现在要什么,系统提示词说的是这个助手是什么:它的人格、规则、语气、工具和边界。当 ChatGPT 报出今天的日期、拒绝某类请求、或用特定格式排版答案时,你看到的就是系统提示词在起作用。
里面到底写了什么
生产环境的系统提示词很长——几千词起步,有时占掉上下文窗口开头的数万 token。典型内容:身份(「你是 Claude,由 Anthropic 打造」)、当前日期与环境、智能体可调用的工具定义、语气与排版规范、安全规则,以及越来越精细的行为工程——何时反问澄清、何时拒绝、医疗法律话题怎么处理。厂商把它当活的产品维护:Anthropic 公开了 Claude 的系统提示词,OpenAI 用 Model Spec 记录设计意图,社区破解者负责提取剩下的——「泄漏的系统提示词」能成为一个内容流派,正因为它精确暴露了每个助手是怎么被操纵的。我们在模型板块存档并解读值得关注的样本。
指令层级
模型被训练成按级别加权指令:平台规则高于开发者的系统提示词,系统提示词高于用户消息,用户消息高于模型只是读到的内容(网页、文档)。最后一层区分是对**提示注入(prompt injection)**的防御——网页里写一句「忽略你的指令」,不该压过开发者的设定。但这个层级是训练出来的行为,不是硬保证;它大体成立、并不完美,所以敏感操作仍要人工确认。
实用要点
在 API 上做产品?系统提示词就是你的产品界面:角色、规则、输出格式放这里,单次请求的材料放用户消息——别往里放机密,因为提取永远部分可行。只是日常聊天?自定义指令和「人格」设置,不过是同一机制里开放给你编辑的那一片。它是上下文里杠杆最大的一段文字——模型行为跑偏时,第一件事就是回头重读它。