本节摘要:相似问题给相同答案,不是智能倒退,而是高确定性场景的纪律。风格一致性是品牌声音在对话里的稳定性。对照硬编码字符串模板和完全自由生成,Parlant 用结构化生成(原文中的示意图生成器)把内容、语气、置信度变成可校验字段,再决定放行、重生成或降级。
阅读完本节,你应当能够:
订单已发货、余额数字、营业时间——信息明确、风险可控、不必每轮推理。传统做法是硬编码字符串,语境一变就僵。完全交给模型,则今天热情明天冰冷,品牌碎了用户还以为是两个机器人。
风格一致性指人格、语气、专业度、情感倾向的稳定。医疗要谨慎,娱乐角色可以跳。它是品牌声音的延伸,也是信任的零件。Parlant 把二者放进模式驱动生成:不是只生成一段话,而是生成符合结构的对象。
原文核心机制之一是按提示生成符合数据模型的结构,所有模型请求走这类生成器,输出须符合预定义结构。限制自由度,换来工程抓手。
# 概念:回复是结构化对象,语气是字段不是感觉 class StandardResponse: content: str # 主体文本 tone: str # professional / friendly / urgent / reassuring confidence: float # 0 到 1 fallback_reason: str # 为何走备用
原理就一句:约束输出结构,间接约束风格与一致性。模型要自我标注语气与置信。后续可按语气字段校验,置信过低走人工。这和「在提示里写请保持专业」完全不是一层——后者不可机读。
硬模板:您的订单{id}已发货。准,但安抚不了焦虑用户。自由生成:可能安抚,也可能随口加政策。中间态是:罐头提供事实骨架,风格引擎按用户画像与品牌指南调权重——焦虑患者偏安抚步骤,资深投资者偏数据口吻。原文把风格本身规则化,追求可控的多样性:不是随机同义换词,是策略组合。
| 策略 | 事实准确性 | 温度感 | 可审计 | 适用 |
|---|---|---|---|---|
| 硬编码字符串 | 最高 | 最低 | 最高 | 费率、时间、状态码 |
| 纯自由生成 | 不稳 | 最高 | 低 | 创意草稿 |
| 提示里写人设 | 看运气 | 中 | 低 | 演示 |
| 结构化罐头+校验 | 高 | 可调但有界 | 高 | 企业对话主路径 |
⚠️ 常见坑:把所有回复做成罐头,用户一偏离脚本就循环播放「请您再说一次」。罐头是确定岛,不是整片海。
💡 关键直觉:交通播报可以有固定句式,但事故细节必须来自现场数据。句式是罐头,数据是工具返回值。
校验器对照品牌指南:禁用承诺性用语、必须出现的免责声明、称呼方式。失败则重生成或降到更硬的模板。置信度字段让系统有「我没把握」的合法出口,这比一本正经地胡说八道更像同事。
原文后续还涉及如何把风格向量或规则注入生成上下文、如何做 A/B。能确定的工程原则是:风格策略可追溯。抽检时能回答「这一句走了哪套语气标签」,而不是「模型今天比较活泼」。

和术语节的交接:术语保证用对词,罐头保证用对句式。词对了句式漂,品牌仍碎;句式对了词错了,合规仍炸。两节不能互相替代。工具节则提供罐头里要填的事实——没有工具,罐头只能说空话。
抽检不要只打「专不专业」的主观分。打开结构化字段:语气标签是否与场景匹配,置信是否过低却仍对客,免责声明字段是否在金额类回复出现。主观分可以有,但只能当附加。品牌声音若不能机读,运营无法规模化质检,最后仍会退化成抽几句感觉。
确定岛要列出清单:状态、时间、费率、已发货未发货。这些句子禁止同义改写数字。动态部分是安抚和步骤指引。清单外的句子才允许受约束生成。清单要和法务共同签字,否则开发会把政策句也做成可改写。
降级链写清楚:校验失败重生成一次;再失败用更硬模板;置信低转人工;禁止第三次自由发挥。链要进审计,便于发现某条指南总是触发降级——那是指南与模型不匹配,不是用户刁难。
多渠道一致:网页、应用内、热线转写,语气字段应同源。渠道差异用渠道标签调模板,而不是各写一套模型人设。人设一多,品牌碎。对照纯自由生成在各渠道各采一次样,几乎不可能一致。
罐头被骂机械时,检查的是事实骨架有没有填进工具返回值。空罐头才机械。填了运单号和预计时间的罐头,用户要的就是这个。把机械当理由改回放飞,通常是设计者自己嫌无聊,不是用户要脱口秀。
先定四个语气标签就够:专业、友好、紧急、安抚。每个标签两句样例,法务过目。生成器只允许这四类。再多标签,质检无法记忆。对照「人设小作文」动辄二十条性格,抽检会放弃,放弃后等于放飞。最小可行集上线两周,看投诉是嫌机械还是嫌越界。嫌机械就加强工具填数;嫌越界就收紧校验。不要尚未抽检就扩展标签宇宙。风格是约束,约束集合必须小到能执行。
围绕「风格抽检与最小标签」,把四条路径再过一遍。表里每格都是可执行判断,不是形容词。读完请把你的项目钉进一格,不要钉在两格之间假装都占了。
| 检查项 | 纯 prompt | 通用 Agent | 规则引擎 | Parlant |
|---|---|---|---|---|
| 决策权放哪 | 人设小作文 | 提示里写保持专业 | 硬字符串 | 四标签加字段校验 |
| 改口径谁动手 | 主观打分 | 看像不像人 | 完全可审但僵 | 抽机读字段 |
| 行动如何被拦 | 失败继续生成 | 失败换规划 | 失败固定句 | 降级链写死 |
| 出事如何复盘 | 各渠道各采一次 | 渠道各有人设 | 渠道各写模板 | 同源字段渠道只调模板 |
| 口语进得来吗 | 空话罐头 | 事实也即兴 | 无温度 | 罐头填工具返回值 |
| 上线第一周验什么 | 标签无限膨胀 | 性格二十条 | 无标签 | 先四标签跑两周 |
嫌机械先查有没有填运单号。空罐头才机械。嫌越界就收校验。不要未抽检就扩展标签宇宙。
金额类必须出现免责字段。字段缺失即校验失败,不是靠模型想起要说「以审批为准」。
在「风格字段抽检」上,纯 prompt 把判断写进一段话,改的人必须会改提示,复盘只能翻聊天,口语进得来但口径会漂。通用 Agent 把判断交给循环,灵活的代价是越权与路径不可复现。规则引擎把判断写进分支,确定的代价是口语进不来、改口径要排期。Parlant 把判断写成指南与契约:业务改口径,未授权则无行动,复盘指轨迹。把这四句贴到工位上,比再记一组术语有用。
针对风格字段抽检,本周只做一件可验收的事:找出一条真实对话或工单,标注它今天落在哪一列;若要迁到第四列,缺的是指南、工具还是关系边。缺指南就写草稿,缺工具就列契约,缺关系就补消歧或依赖。不要同时开十条战线。最常见的伪装是文件名叫指南、真源仍是提示词,或者架构图上有网关、运行时模型仍直接调函数。用「改文本能否改行为」和「低权限点名是否被拒」两张试纸识破。识破了再谈优化与案例。优化在伪装上加速,只会让错误承诺更多;案例在伪装上复制,只会把新闻变成事故。
风格字段抽检的纪律是先钉列,再谈快。钉列需要抽检,抽检需要轨迹,轨迹需要审计真的在记抑制原因,而不只记最终回复。若没有抑制原因,排错会以为没写规则,其实是优先级压了。看得见「为什么没走另一条路」,才叫对照,才叫可控。把这句话写进值班手册,风格字段抽检才从概念变成岗位。对照驱动不是文风,是岗位制:模型是引擎和笔杆子,方向盘在指南与工具契约上。谁把方向盘又塞回提示词,谁就在风格字段抽检上退回第一列。
下一节让代理从「会说」变成「能办事」:工具注册进规则网络,结果会改下一跳。