本节摘要:生成式引擎优化(GEO)的核心机制是三位一体:提示工程当舵,决定「怎么问、往哪说」;知识增强当锚,把检索、图谱、工具结果钉进上下文;约束控制当尺,用解码约束、后验过滤和策略规则挡住越界。三者必须互相看见,否则会出现有文采的胡编、正确但不可用的条款,或被提示注入一票否决的系统。
阅读完本节,你应当能够:
提示工程被神话之后,团队会把 GEO 理解成「会写提示的人」。提示确实是舵:角色、格式、思维步骤、少样本示范,都能显著改口吻和结构。原文集把它叫语义之舵——精微调控。它擅长的是把意图层已经定义好的「好」翻译成模型听得懂的生成条件。
但它有硬边界。提示不能发明你知识库里没有的药剂量。提示不能在采样过程中看见自己正在编造。提示也不能在用户把「忽略以上指令」塞进输入时,单靠礼貌系统消息长期获胜。把舵拧到最大、船上没有锚和尺,就是 1.1 里那篇「最全攻略」:写得很会说话,编辑室仍不敢署名。
一个可复现的失败:给模型「你是严谨的法律助手,只根据给定材料回答」。材料其实是营销页,没有条款编号。模型为了满足「严谨」,会补造一条「根据合同法相关规定」——这是舵在没有锚时的典型幻觉:它完成了语气,伪造了依据。法庭证人如果只被要求「请用专业口吻陈述」,却没被允许看卷宗,专业口吻会变成伪证催化剂。
⚠️ 常见坑:用更长的系统提示治疗幻觉。加长之后,模型更会表演合规,不一定更会核对。先问锚在哪,再问提示写得够不够文学。
知识增强是锚。常见三路,不要混成一个「我们有 RAG」。
检索增强:把文档切块、向量化、按问句召回,垫进上下文。失败模式是切块切碎了表格、召回了过期版本、重排序只看相似度不看权威。公开网页 GEO 和内部知识库在这里同源:都是给生成提供可引用片段。内部多一个版本号问题——召回了上季度退款政策,答案会流畅地错。
图谱与结构化查询:适合「谁对谁、剂量上限、互斥条款」。失败模式是图谱不更新,或生成时根本没被调用,只当领导参观用。工具调用:计算器、库存、工单状态。失败模式是模型用训练记忆代替工具,或工具超时后默默改用记忆。原文集把工具调度和检索并列,不是装饰:没有工具的「实时」都是演的。
问:这款药能和感冒药一起吃吗 舵:用医患沟通语气,先给结论再给条件 锚:药品说明书图谱 + 最新相互作用表 尺:禁止给出未在说明书出现的联合用药建议
约束是尺,分三个时刻。
生成前:把禁止项写进策略,不让这类任务进自由生成。例如投资建议必须走持牌模板。生成中:约束解码、词表屏蔽、强制引用格式(必须输出资料编号)。生成后:分类器扫歧视、泄露、绝对化承诺;事实核对器把句子对回锚。尺如果只存在于事后敏感词,你会得到「删掉几个词的假合规」。
原文集还强调行为之尺的多维:品牌语气、合规、安全、格式,经常互斥。客服要共情,法律要无歧义,共情形容词可能被法务看成承诺。编排层必须能按场景切尺的优先级,而不是一张全球敏感词表打天下。
| 机制 | 它能强制的 | 它强制不了的 |
|---|---|---|
| 提示 | 结构、角色、推理步骤 | 事实是否存在 |
| 检索增强 | 提供候选证据 | 证据是否被真正使用 |
| 图谱/工具 | 实时或关系型事实 | 用户是否接受该结论 |
| 约束解码 | 格式、禁用词、必须引用 | 整体是否满足业务目标 |
| 后验过滤 | 明显违规出场 | 高级误导和遗漏 |
协同的意思是互相看见。生成后发现引用编号对不上,应回编排层:或重检索,或降低置信改口,而不是再写一句更长的道歉。短期反馈若显示「插入表情」对某年龄段有用、对另一段有害,改的是提示模板分群,不是把表情写进全站约束。长期若发现「强调低价」伤害客单价,改的是意图层目标,尺要跟着加「禁止贬低自身品质」这类新规则。三位一体不是一次配置,是三条回路的接口约定。
💡 关键直觉:检查一份输出时问三个问题——它在模仿谁说话(舵),它凭哪条材料(锚),它踩了哪条红线没有(尺)。有一个答不上,就不要上线。
最小协同可以从一条客服工单做起。意图层规定:退款问题必须引用现行政策编号,禁止承诺法外例外。编排配方:解析订单状态工具 → 检索该订单适用政策块 → 生成「结论+条件+下一步」→ 核对编号是否出现在检索块中。提示只负责语气和结构。若工具返回「订单不存在」,尺应禁止编造物流故事,改出口径「我这边查不到,请提供编号」。这条链路比再雇一个「提示词专家」有用。
版本是锚的隐形部分。知识块必须带生效时间和适用地区。生成时把这两项写进可见引用,用户和审计才能追。这和 1.1 要求公开内容声明「基于某季度数据、适用某类读者」是同一纪律,只是内部系统用字段而不是散文。
提示注入要舵和尺一起防。意图双重解析是尺;把检索语料和用户输入在拼上下文时做分隔标记,避免用户句子被当成系统提示,是舵的卫生。只做其中一件,另一件会漏。
评估必须分别打分,否则你会优化成「平均还行」。引用覆盖看锚有没有被用;违规拦截看尺;任务完成看舵有没有把结构带对。第 5 章会把这些变成工具链。本节先禁止用单一流畅分代替三机制体检。
要。参数里的知识过期且不可追。GEO 的引用承诺建立在「这段话能指回材料」。参数只当语言能力,不当证据。
会,如果你把营销和医疗共用一把尺。分层策略:顶层决定这是促销还是告知,中层调语气,底层才锁词。创意放在被允许的层,红线放在尺上。
检索增强最常见的隐形失败是切块切碎表。产品对比表被切成「我们列」和「对方列」两段,生成时只看见一半,引用覆盖看起来有、主张却是残的。修法是按表为块,或把表渲染成带表头的纯文本再索引。权威重排若只看向量相似度,会把高相似的营销软文排到指南前面。公开网页 GEO 改不了别人的重排,只能让自己的块带更硬的实体和时间;内部引擎可以改重排,却常常懒得改。
图谱失败是边不更新。药品说明书改了禁忌,图还是旧的,生成会流畅地给出过期联合用药建议。工具失败是超时后改用记忆:物流轨迹被「补」出来。这三种看起来都是「幻觉」,根因分别在切块、过期、超时策略,用更长提示治疗会全部无效。原文集把工具调度和检索并列,就是怕团队以为上了检索就有了实时。
提示与约束的卫生同样具体。拼上下文时用户句子和系统条件、检索块必须有分隔,否则用户可以把自己的话写成「系统说」。约束解码优先锁「必须出现编号」「必须从候选引用集合选」,而不是锁整段法律全文的词序——后者会把句子写残。后验过滤若只删脏话,会放过「我们一定特批」这种无脏话的违法承诺。尺的词表要按任务分层,客服共情词在法律任务里可能是雷。
协同验收用一次会诊:舵、锚、尺各发言一次。答不上锚,任务不准上线。这比再开一次提示词工作坊便宜。
现场复盘时把一次错误回答拆成三列:提示有没有把任务说清,检索块有没有被真正写进句子,约束有没有挡住法外承诺。三列分开记,才能停止用「再写长一点的系统消息」治疗所有病。切块切碎表格、图谱边过期、工具超时改用记忆,看起来都叫幻觉,修理位置完全不同。拼上下文时用户输入必须和系统条件、检索块分开,否则用户可以把自己的句子打扮成系统指令。约束优先锁「必须出现编号」和「必须从候选引用里选」,不要锁整段法规的词序,词序锁死会把句子写残。验收标准很土:答不上凭哪条材料,任务不准上线。
再强调一次卫生:用户句子、系统条件、检索块在拼装时必须可区分。不可区分的系统,提示注入不需要高明。知识增强的三种病分开挂号,不要都开给提示词医生。答不上材料来源的任务,维持不上线比维持演示更重要。
下一章把「意图」从口号变成可建模对象,并把受控生成写成可调的策略、后处理与在线学习。
材料来源答不上就停,比演示日过关更接近生产。