生成式AI与大语言模型
系统提示(system prompt)
/ SIS-tum PROMPT /
系统提示,是一组隐藏的指令,由开发者、而非用户写就,在任何对话开始之前便喂给语言模型,并自始至终地塑造它的举止。它是助手被告知「自己是谁、该如何行事」之处:「你是Acme银行一位乐于助人的客服。回答要简洁、有礼。绝不透露账户密码。拿不准时,提议转接人工。」用户从看不见它,可它给每一句回复都上了色。
把它想成一位舞台演员开演前领到的「常规指令」——要演的角色、绝不能越的红线、要保持的语气——它独立于演出途中观众喊出的任何话。技术上,它不过是被摆在模型上下文窗口最前面的又一段文字,但它被赋予了特殊的分量,好让模型把它当作统领整场交流的框架。它是产品团队手里那根主要的杠杆,用来把一个通用模型引导进一个具体、规矩的角色。
它的威力真实却有限,而这里的诚实关乎安全。系统提示是一条强有力的「建议」,而非一条牢不可破的「规则」:精明或怀有恶意的用户,有时能把模型劝得无视它(即「越狱」);而「提示注入」——藏在模型所读的文档或网页里的恶意指令——能劫持它的行为。切勿把真正的机密放进系统提示,也切勿单靠它来阻止有害动作;它引导模型,却关不住模型。
一款儿童辅导应用设了这样的系统提示:「你是面向8岁孩子的友善辅导老师。用简单的词,绝不谈论吓人或成人的话题,并始终给予鼓励。回答不超过三句话。」每个孩子的提问,都透过这副镜片来回答——而孩子从不必写下这些规则。
开发者那组隐藏的常规指令,塑造着每一句回复。
系统提示是「引导」,不是「强制执行」。它可能被精巧的「越狱」措辞推翻,或被模型所读文字中的提示注入劫持。把它当作对行为的引导,绝不要当作一道安全屏障、或一个存放机密的安全之所。
又称
另见