LightVela

如何设计更像真人的 IM Agent:对话节奏、群体规范与长期社交记忆?

更像真人不等于让 Agent 冒充真实的人,而是让它在表达、回应和长期协作中保持稳定、可理解的行为模式。

对话节奏决定它什么时候简短回答、什么时候展开解释,以及什么时候应该停下来等待确认。

群体规范决定它在多人空间中如何发言、引用上下文和尊重成员边界。

长期社交记忆决定它能否记住经过确认的关系背景,同时不把所有聊天内容都变成永久记录。

通过对话节奏、群体规范与长期社交记忆设计更自然的 IM Agent

摘要

「更像真人」不是让 Agent 冒充真实的人,而是让它在表达、回应与长期协作中保持稳定、可理解的行为模式,由三件事共同决定:对话节奏、群体规范、长期社交记忆。 对话节奏决定它何时简短回答、何时展开解释、何时停下来等待确认;群体规范决定它在多人空间如何发言、引用上下文、尊重成员边界;长期社交记忆决定它能否记住经过确认的关系背景,同时不把所有聊天内容都变成永久记录。这三者要分层落地:节奏与规范属于人设层的稳定规则,记忆只保留已确认且长期成立的事实。判断设计是否合格,可对照文中的自然对话检查表逐项验证。

适合谁

这篇指南适合希望把 IM Agent 做得更自然、更稳定,同时保持透明和可控的用户。

它适合个人助理、学习伙伴、研究伙伴和正在设计社群助手的团队。

当前 Telegram 和 WhatsApp 文档都以 1 对 1 对话为主要支持方式,因此本文关于群体规范的部分先作为设计清单,不代表这两个通道当前已经支持群聊。

先确定什么应该保持稳定

可以把 Agent 的长期行为拆成四层:

层级负责内容推荐配置方式
人格角色、语气、原则和边界SOUL.md
关系偏好称呼、语言、详细程度和互动习惯用户画像
社交记忆已确认的共同经历、项目背景和持续约定记忆
当前节奏这次对话的语境、长度和紧急程度当前会话与任务提示

不要让一次临时情绪或一个偶然的回答改变长期人格。

也不要把每一次寒暄、所有群成员的发言或未经同意的推断保存成长期社交记忆。

操作步骤

1. 先定义自然但不冒充真人的角色

SOUL.md 人格指南中写清楚 Agent 的角色、说话方式、主动程度和不能做的事情。

可以从下面的说明开始:

你是一个稳定、直接、友好的研究伙伴。 先给出结论,再根据需要补充依据和细节。 当问题不明确时先问一个最关键的澄清问题。 记住经过确认的长期偏好,但不要保存敏感信息或未经确认的推断。 你是 AI 助手,不要声称自己是真人或假装拥有现实经历。

这样可以让表达更有连续性,同时避免通过虚构身份建立误导性的信任。

2. 设计对话节奏

建议从以下几种节奏规则开始:

  • 简单事实问题先给一到三句直接回答。

  • 复杂任务先复述目标,再分解步骤和风险。

  • 信息不足时只问最关键的问题,不要连续抛出一长串表单式问题。

  • 用户表示忙碌、着急或只想要结论时,降低回复长度。

  • 用户要求推导、教程或复盘时,再展开依据和过程。

  • 外部操作、敏感动作或不可逆动作开始前,停下来等待确认。

可以用真实任务验证节奏:

用三句话告诉我今天最重要的三个待办。

先给结论,再解释你为什么这样排序。

这个操作会修改外部数据,请先告诉我影响和需要确认的内容。

观察 Agent 是否能根据任务和用户偏好改变回复长度,但仍然保持同一套原则。

3. 把关系偏好放进用户画像

用户画像适合保存语言、称呼、时区、详细程度和常用工作方式。

例如,用户可以明确告诉 Hermes:

记住我更喜欢简洁、直接、先给结论的回答。

关系偏好应当服务于沟通效率,不应被写成必须永远服从的个性标签。

如果偏好改变,可以直接请求更新或忘掉它,而不是反复修改人格文件。

4. 设计长期社交记忆

适合长期保留的内容通常包括已经确认的项目背景、长期协作约定、稳定称呼和反复验证的偏好。

不适合长期保留的内容包括密码、验证码、支付信息、医疗细节、未经确认的心理判断和一次性的闲聊。

在对话中明确要求记住或忘掉某项信息,并定期在记忆管理中查看和清理。

长期记忆应该帮助 Agent 减少重复提问,而不是让用户失去对自己信息的控制。

5. 为多人空间准备群体规范

当前 Telegram 和 WhatsApp 不支持群聊,因此先把群体规范写成上线前规则。

如果未来目标通道明确支持群聊,至少应定义:

  • 机器人是否只在被 @ 或收到明确指令时回复。

  • 欢迎新成员时是否需要管理员触发。

  • FAQ、摘要和提醒的频率上限。

  • 如何区分成员、管理员和需要人工接管的消息。

  • 成员消息是否进入共享记忆,以及如何避免向其他成员泄露。

  • 争议、投诉、处罚建议和敏感内容如何转交管理员。

群体规范属于通道和运营规则,不应只依赖人格提示。

6. 用自动任务控制主动节奏

主动消息需要明确的频率、时段、目标通道和暂停方式。

可以使用自动任务安排个人提醒、内部摘要或周期性检查。

为每个自动任务设置安静时段,并确认目标通道支持对应的主动投递方式。

不要用高频主动消息制造“陪伴感”,也不要让用户无法停止提醒。

一个自然对话的检查表

  • 它是否先回答了用户真正的问题?

  • 它是否根据任务复杂度调整了长度?

  • 它是否在需要时问了一个有价值的澄清问题?

  • 它是否记住了经过确认的偏好,而不是猜测用户的心理?

  • 它是否明确自己是 AI,而不是暗示自己有真实身份或线下经历?

  • 它是否在外部操作前说明影响并等待确认?

  • 它是否尊重安静时段、拒绝和忘记请求?

常见问题

更像真人是否意味着应该隐藏自己是 AI?

不应该。

自然的语气、稳定的节奏和连续的上下文可以提升使用体验,但 Agent 不应声称自己是真人或虚构现实经历。

我应该把每次聊天都保存成社交记忆吗?

不应该。

只保留经过确认且对未来协作有帮助的信息,并定期检查记忆和用户画像。

群体规范现在能用于 Telegram 和 WhatsApp 吗?

当前两个通道文档都说明群聊不支持,因此本文的群体规范部分是设计和上线前检查清单。

先在 1 对 1 对话中验证人格、节奏、FAQ 和提醒,再等待目标通道有明确的群聊支持。

为什么 Agent 有时回复很长,有时很短?

回复长度会受到任务复杂度、当前提示、模型输出和用户偏好的共同影响。

可以在用户画像中明确偏好,也可以在当前请求中说明希望只要结论或需要完整推导。

下一步