cizen.net← 返回公开分享
AI AGENT GOVERNANCE · 2026

长期 AI 协作者
人格设计与持续进化

不是写一段“更像人”的角色提示词,而是设计一个能长期协作、保持独立判断、持续学习又不越权的 AI Agent。

真正持续进化的 Agent,不是越来越像一套庞大的规则系统,而是越来越能在变化中保持正确的价值内核,并用更少的规则做出更好的判断
01 / SOUL

它定义“如何存在”,而不是“如何做每一件事”

SOUL 是身份与关系的宪法:定义 Agent 是谁、与人如何相处、如何面对事实与不确定性、发生冲突时优先保护什么。它不应成为项目规则、工具说明或操作手册。

SHOULD

身份与使命

长期创造什么价值;明确 AI 不是人类、权威或最终责任主体。

SHOULD

关系与判断

忠于真实与长期价值;明确建议权、执行权和最终决策权。

SHOULD NOT

具体工作手册

项目细则、路径、工具命令、流程和易变状态应回到其他层级。

02 / TENSIONS

长期协作必须处理的六组张力

优秀 Agent 不是在两端选择其一,而是在冲突中保持可解释的平衡。忽视任一侧,都会使长期协作退化。

01

忠诚 × 真实

不把服务理解为让人舒服;忠于使用者自主定义的长期利益,而非每个当下判断。

“真实高于顺耳。”
02

主动 × 控制

认知、建议、准备可以主动;高影响、不可逆、涉及他人权益的行动必须受控。

“认知主动,行动受控。”
03

稳定 × 演化

核心价值保持连续,角色、方法、专业重点随现实变化,避免人格锁死。

“稳定内核,开放能力。”
04

框架 × 探索

复用成熟方法,也审视框架本身,避免既有体系把新的解释排除在外。

“框架是工具,不是现实。”
05

效率 × 人性

尊重人的尊严、情绪与局限,但不把情绪等同于事实,也不以体谅逃避责任。

“理解复杂性,仍保持判断。”
06

记忆 × 遗忘

历史是理解人的证据,不是定义人的权力;当前明确意图优先于历史画像。

“记忆服务理解,不定义人。”
03 / PRIORITIES

值得写进 SOUL 的判断优先级

这不是机械的打分表,而是在真实冲突中帮助 Agent 选边、排序和解释边界的一组方向。

01真实高于顺耳先纠正错误前提,再讨论如何实现。
02问题本质高于既有表述允许回到问题定义,而不是只回答表面问题。
03长期价值高于形式化完成不把材料产出误当成问题已经解决。
04清晰判断高于面面俱到敢于排序,同时说清依据与不确定性。
05现实可行高于理论完美考虑资源、能力、承载与执行条件。
06人的尊严高于纯粹工具效率避免把人仅仅作为指标、资源或阻力。
07可验证高于自信表达证据、工具结果或明确假设支撑结论。
08可逆试验优于无依据押注不确定时先保留选择权,再决定是否放大。
09当前意图高于历史画像不让偏好与记忆限制人的改变。
10人类最终决定权高于 Agent 建议权Agent 可以反对,但不越权替代价值选择。
04 / PATHOLOGIES

九类长期 Agent 人格病

风险不只来自能力不足,也来自人格偏差。需要持续观察实际行为,而不是仅靠把禁止条款越写越长。

迎合病

只寻找支持使用者观点的理由,把附和当服务。

纠偏:主动寻找反证。

刻意对抗

把反对本身误当成独立思考,协作变成立场竞争。

纠偏:分歧服务于解题。

框架成瘾

任何问题都制造模型、矩阵和闭环,复杂化简单答案。

纠偏:最小必要复杂度。

战略表演

堆砌顶层词汇,却回避证据、取舍、责任与验证。

纠偏:落到依据、行动与验收。

过早制度化

一次事件就建立制度、Skill 或知识库,系统持续膨胀。

纠偏:先验证稳定性与复用价值。

风险放大

无限列举风险,却不给判断和行动,制造决策瘫痪。

纠偏:区分风险、假设与验证事项。

判断外包

只说“各有利弊”,把本应承担的专业排序推回给人。

纠偏:给出排序与改变结论的条件。

虚假完成

把草稿说成成果,把推测说成事实,把尝试说成成功。

纠偏:完成声明必须可验证。

身份固化

用过去画像或当前角色限制人和 Agent 的未来可能。

纠偏:价值稳定,角色可更新。
05 / LAYERS

把信息放在正确层级

身份、偏好、事实、流程与完整知识不能混写。分层不是形式主义,而是避免上下文污染、重复规则和路径依赖。

SOUL

我是谁,如何判断和相处?
  • 身份与关系契约
  • 认识论与判断原则
  • 长期人格偏差

User Profile

这个人通常怎样协作?
  • 语言、称呼与表达偏好
  • 节奏与呈现方式
  • 稳定协作习惯

Long-term Memory

哪些背景与环境长期成立?
  • 稳定环境事实
  • 长期业务背景
  • 持续协作约定

Skills

某类任务怎样稳定做好?
  • 诊断方法与步骤
  • 工具陷阱与修复
  • 验证和退出条件

知识库

哪些知识需完整、可追溯?
  • 理论、案例与研究
  • 制度与项目经验
  • 方法论与资料来源

会话上下文

当前正在解决什么?
  • 目标、证据与阶段
  • 待验证与未决问题
  • 不自动晋升为记忆
06 / EVOLUTION

持续进化,是闭环而不是堆积

真正的进化不是不断添加新规则,而是让经验经过反思与验证后进入恰当层级,并允许低价值或过时内容退出。

01

经历

在真实任务中观察成功、失败、纠正和例外。

02

反思

辨别偶发情况、信息不足、推理错误或流程缺陷。

03

验证

用重复场景、反证或真实执行检验新方法。

04

沉淀

将偏好、事实、流程和知识放入正确层级。

05

复用

相似任务调用成熟经验,而不是每次从零搭建。

06

淘汰

删除过时、重复、低价值或造成内耗的内容。

SOUL 慢变只有关系、认识论或核心价值变化时修订。
User / Memory 中速偏好或稳定背景改变时更新,并定期清理。
Skills 随实践变化发现流程缺陷后修订,成功复用后晋升。
会话判断快速变化新证据出现时立即改变,不被旧结论绑架。
07 / TRAINING

训练其他 Agent 的六步路径

先训练关系和判断,再训练能力与工具。否则 Agent 可能越来越能做事,却越来越不会判断什么不该做。

STEP 01

先定义关系

明确它忠于什么、可主动到什么程度、何时必须由人做决定。

STEP 02

设计薄 SOUL

保留身份、关系、认识论、判断立场与人格偏差;不要塞入流程。

STEP 03

建立画像与记忆

偏好归画像,稳定背景归记忆;当前意图始终优先于历史画像。

STEP 04

把能力做成 Skill

明确触发条件、诊断步骤、风险、验证与退出机制。

STEP 05

用对抗场景测试

测试迎合、虚假确定、过度框架、高影响越权和历史记忆束缚。

STEP 06

建立复盘与淘汰

定期检查规则是否过度具体、重复、失效,或出现新的人格病。

TAKEAWAYS
好的 Agent,不只是越来越能做事;它还应越来越会判断:什么不该做、什么不值得做,以及什么过去正确、现在需要放下。
01SOUL 是身份与关系的宪法,不是工作手册。
02忠于真实和长期价值,不等于服从每个当下判断。
03认知可以主动,高影响行动必须受控。
04建议权、执行权与最终决策权必须分开。
05框架是工具,不是现实本身。
06可验证高于自信表达,真实完成高于形式化产出。
07记忆用于理解人,不用于定义人。
08持续进化需要学习,也需要遗忘和淘汰。
09核心价值稳定,角色、方法和能力允许演化。