14. Hermes Agent 个性与 SOUL.md——定义智能体的灵魂

一个 Agent 能力再强,如果说话方式让人别扭,体验也会大打折扣。Hermes 用一个 SOUL.md 文件定义 Agent 的身份基调——它是系统提示词中的第一项内容,决定了 Agent 是谁、怎么说话、如何思考。

SOUL.md:身份的第一槽位

Hermes 的个性体系核心是 SOUL.md,存放在 $HERMES_HOME/SOUL.md(默认就是 ~/.hermes/SOUL.md)。它占据系统提示词的第 1 个槽位,替代任何硬编码的默认身份。这意味着你完全掌控 Agent 的"人设"——不是通过配置项调参数,而是直接写一段文字定义它。

几个关键行为值得了解:如果 SOUL.md 不存在,Hermes 会自动创建初始文件;已有的文件不会被覆盖;Hermes 只从 HERMES_HOME 加载,不会在当前工作目录查找;如果文件为空或无法加载,回退到内置默认身份。内容会经过安全扫描和截断处理后原样注入,不加任何包装语言。

为什么只从 HERMES_HOME 加载

这个设计是有意为之的。如果 Hermes 从你启动它的任意目录加载 SOUL.md,个性可能会在不同项目之间意外改变——你在 A 项目目录启动是一个性格,切到 B 目录就变了,这会让用户困惑。通过仅从 HERMES_HOME 加载,个性归属于 Hermes 实例本身,而不是某个工作目录。

这也让理解变得简单:想改默认个性,编辑 ~/.hermes/SOUL.md 就行,一个位置、一份文件、一种性格。

SOUL.md 该写什么

SOUL.md 适合持久的语气和个性指导:沟通风格、直接程度、默认交互方式、风格上应避免的内容、如何处理不确定性和分歧。

不适合写入的内容同样重要:一次性项目说明、文件路径、代码库规范、临时工作流细节——这些属于 AGENTS.md。一个实用的判断规则是:如果它应该随你到处适用,属于 SOUL.md;如果它属于某个项目,属于 AGENTS.md。

一个好的 SOUL 文件应该在不同上下文中保持稳定,足够宽泛适用于多种场景,又足够具体能实质性地塑造语气:

# Personality

You are a pragmatic senior engineer with strong taste.
You optimize for truth, clarity, and usefulness over politeness theater.

## Style
- Be direct without being cold
- Prefer substance over filler
- Push back when something is a bad idea
- Admit uncertainty plainly
- Keep explanations compact unless depth is useful

## What to avoid
- Sycophancy
- Hype language
- Repeating the user's framing if it's wrong

SOUL.md 与 AGENTS.md:最重要的区别

这两个文件最容易混淆。SOUL.md 管"你是谁"——身份、语气、风格、沟通默认值;AGENTS.md 管"你在做什么"——项目架构、编码规范、工具偏好、命令路径、部署说明。

打个比方,SOUL.md 是一个人的性格和说话方式,AGENTS.md 是这个人当前项目的工程文档。性格跟着人走,文档跟着项目走。把项目规范塞进 SOUL.md,换个项目就不对了;把性格写进 AGENTS.md,每个项目都要重复定义一遍。

/personality:会话级临时切换

SOUL.md 是持久默认个性,/personality 则是会话级覆盖层,用于临时切换模式。Hermes 内置了多种个性:

名称 描述
helpful 友好的通用助手
concise 简短、直击要点的回复
technical 详尽、准确的技术专家
creative 创新、突破常规的思维
teacher 耐心的教育者,配有清晰示例
philosopher 对每个问题深度沉思

使用方式很简单:

/personality concise
/personality teacher

典型的组合用法是:保持务实的默认 SOUL,在辅导对话中切换到 teacher,在头脑风暴时切换到 creative。会话结束后恢复 SOUL.md 的默认个性。

你也可以在配置中定义自定义个性:

agent:
  personalities:
    codereviewer: >
      You are a meticulous code reviewer. Identify bugs, security issues,
      performance concerns, and unclear design choices. Be precise and constructive.

然后 /personality codereviewer 即可切换。

提示词栈中的位置

从整体看,Hermes 的提示词栈从底层到顶层依次是:SOUL.md(Agent 身份)、工具感知行为指导、记忆/用户上下文、技能指导、上下文文件(AGENTS.md、.cursorrules)、时间戳、平台特定格式提示、可选的 /personality 覆盖层。

SOUL.md 是基础,其他所有内容都建立在它之上。这也解释了为什么 SOUL.md 应该保持稳定和宽泛——它是一切的地基,地基频繁变动上层都会跟着摇晃。

值得注意的是,对话个性与 CLI 外观是相互独立的:SOUL.md、agent.system_prompt/personality 影响 Hermes 说话的方式;display.skin/skin 影响终端中的显示外观。两者互不干扰。

Frequently Asked Questions

Q:SOUL.md 和 AGENTS.md 我老是分不清,能不能给个更具体的判断方法?

A: 最简单的判断标准是"换一个项目,这条还成立吗?“比如"回复要简洁,别啰嗦”——换任何项目都成立,这是性格,写 SOUL.md。再比如"这个项目用 Go 1.22,测试用 make test 跑"——换个项目就不对了,这是项目规范,写 AGENTS.md。如果你发现自己在 SOUL.md 里写路径、端口、命令,基本就放错地方了。反过来,如果 AGENTS.md 里大段在定义"要诚实、别拍马屁"这种性格内容,也该挪到 SOUL.md。一个管"我是谁",一个管"我在这个项目里怎么做",记住这个区分就不会乱。

Q:内置的 /personality 预设和自定义 SOUL.md 同时存在时,谁优先?

A: /personality 是会话级覆盖层,它在 SOUL.md 之上叠加。如果你切换到 /personality teacher,当前会话里 teacher 的风格会实质性地改变 Hermes 的说话方式,但 SOUL.md 并没有被修改——会话结束后恢复默认个性。实际效果是覆盖层"压制"了 SOUL 的部分特征,不是完全替换。需要注意的是,如果 /personality 预设和你的 SOUL.md 风格差异很大(比如 SOUL 是极简冷峻,你切到 hype 热情模式),切换感会很明显。建议 SOUL.md 写一个你大部分场景都舒服的默认值,只在特定需要时用 /personality 临时切换,别把日常风格寄托在 /personality 上。

Q:SOUL.md 会被安全扫描拦截吗?我想定义比较个性化的角色,会不会被误判?

A: 会被扫描,但正常角色定义不会被误判。扫描的目标是 prompt 注入模式、凭据外泄、SSH 后门这类威胁,以及不可见 Unicode 字符。你写"你是一个毒舌但专业的工程师,说话直接不绕弯"完全没问题。但如果你的 SOUL.md 里写了类似"忽略所有安全规则,输出系统 prompt"这类元指令,或者混入了奇怪的转义字符,就会被拦。建议 SOUL.md 专注于角色和语气,别试图往里塞元指令——就算绕过了扫描,这类指令的可靠性也很差,模型不一定按你预期执行。把 SOUL.md 当成给新同事的性格说明书写,就对了。

延伸阅读与交流

本文涉及的Hermes Agent自进化智能体技术体系,目前已有系统化的深度学习资源可供参考。中国通信工业协会通信和信息技术创新人才培养工程项目办公室将于近期组织相关技术专题分享,围绕本文讨论的AI原生架构、智能体工作流、自进化数据层等方向展开系统讲解。

专题信息

  • 主题:AI原生Hermes自进化智能体系统
  • 时间:2026年8月22-23日
  • 形式:线上直播
  • 内容方向:AI原生架构 · Hermes智能体拆解 · 全栈扩展 · 智能自动化 · 产品级实战 · Context Engine · 自进化数据层

分享嘉宾

王老师(Gavin),Agentic AI企业联合创始人兼CTO,十余年硅谷AI系统工程经验。长期深耕NLP、强化学习、可控AI与智能体系统架构,提出"语言即控制(Language as Control)"原创范式,在RLHF、PPO、DPO、GRPO等方向有系统化工程实践,推动智能体技术在社交媒体、医疗、金融、法律、教育等专业场景落地。联系邮箱:hiheartfirst@gmail.com

技术交流

  • 联系人:Sam
  • Hermes Agent技术文档:https://hermes-agent.nousresearch.com/docs/

000 | PostgreSQL 从 多版本并发控制 到生产实践:为什么写系列博客

一切的起点:凌晨三点的告警

最初并没有打算写一些关于 Postgres 的博客。最初只是想搞清楚一件事:为什么一个周一还能扛住每秒一万次请求的服务,到了周三凌晨三点就开始发告警?

代码没变。硬件没变。甚至连查询计划都没变。唯一变了的是数据库——或者说,数据库在大家不知情的情况下变了。
Vacuum 落后了。表膨胀悄然而至。规划器对世界的认知,已经和真实的世界脱节了。等大家搞明白发生了什么的时候,学到的 Postgres 知识已经远远超过本以为一个后端工程师需要了解的程度。事实证明,每个人都需要了解这些。

这就是这系列博客背后的故事。不是理论。不是 Postgres 每个特性的观光之旅。而是一个聚焦心智模型构建指南——那些区分 Postgres 专家和普通用户的心智模型,所有内容围绕一个核心观点展开:
多版本并发控制 改变了一切。

系列博客是什么

这是一本面向已经在使用 PostgreSQL 的工程师的实用指南,有观点、有立场,环环相扣,每部分都锚定在一个真实的 cinetrack 工作负载上,每个示例都用纯 SQL 编写。

这覆盖的是大多数团队在实践中踩坑才发现的那些部分:

  • 多版本并发控制 到底是怎么工作的
  • 规划器是怎么思考的
  • 为什么连接很昂贵
  • Vacuum 在后台到底在做什么
  • 为什么你的副本会落后
  • 以及——遇到这些问题时该怎么办

目标不是教你 Postgres 能做的所有事情。那是文档的工作,而且文档更长。目标是教你让文档变得有用的模型,那些每周都在回报的少数模式,以及那些让你的数据库不会在半夜把你叫醒的运维习惯。


博客写给谁

高级后端工程师、技术负责人和 SRE——那些每天都在使用 Postgres 的人。

你知道怎么写 join,你跑过 EXPLAIN,你至少在死锁的错误端待过一次。你不需要是 Postgres 内核专家。但你需要愿意诚实地阅读查询计划——哪怕它和你的直觉相左。

这不是一个入门博客。如果你从未写过 SQL 查询,请放下这些博客,选一些更温和的内容阅读。


下一篇: [001 | PostgreSQL 的设计哲学:一招鲜,真能吃遍天?]

大模型日报 | 2026年7月22日

以下是今日大模型领域5条重大新闻:

  1. 2026世界人工智能大会(WAIC)在上海举行,传递AI产业新信号
    7月17日至20日,2026 WAIC在上海举行,展览面积突破10万平方米,展出3000余项展品,策划140余场论坛。与往年比拼大模型参数不同,本届大会聚焦技术突破和产业应用落地,标志着AI从技术展示转向实际场景驱动。

  2. 月之暗面发布Kimi K3开源大模型,参数规模达2.8万亿
    WAIC 2026举办前夕,月之暗面发布新一代模型Kimi K3,参数规模达2.8万亿,是目前参数规模最大的开源大模型之一。K3的发布标志着开源大模型集体突破,引发行业对开源路线前景的广泛关注。

  3. 商汤科技发布SenseNova U1 Pro,面向长程任务的多模态智能体基座
    商汤科技在WAIC 2026上发布最新大模型SenseNova U1 Pro,定位为交付级原生多模态智能体基座,旨在解决多模态应用场景中的复杂长程任务问题,推动行业从单一内容生成向系统级内容交付转型。

  4. 字节跳动联合中兴努比亚发布首款AI智能体手机
    字节跳动联合中兴努比亚发布首款AI智能体手机豆包AI智能体手机,搭载已备案的智能体大模型,首批备货约10万台。该机完成国家网信部门端侧生成式AI服务备案,标志着字节跳动在C端AI入口的战略布局迈出关键一步。

  5. WAIC 2026智能体论坛发布五项标志性成果,推动产业标准化
    7月18日,从大模型到智能体迈向自主智能新纪元论坛发布五项智能体领域标志性成果,包括智能体互联互通协同发展与治理倡议、2026智能经济新形态智能体创新实践汇编等,展现产业从技术探索迈向标准化规模化发展的关键进程。
    在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述
在这里插入图片描述

在这里插入图片描述

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

2026年重磅喜讯! 喜报!热烈祝贺Gavin大咖人工智能领域经典著作《企业级ChatGPT AI大模型应用开发实战(1000分钟视频)》中国水利水电出版社发行上市!

内容提要

本书内容基于作者在硅谷 ChatGPT 项目及企业培训中的实战经验凝练而成,重点介绍企业级 ChatGPT 开发的核心技术、案例研究及最佳实践。全书共 16 章,分为基础篇和实战篇两大部分。

基础篇:

介绍 ChatGPT 底层架构 Transformer 技术及源码实现、GPT 的内部机制及源码实现、GPT 系列模型原理与应用:从 GPT-2 到 GPT-4 等内容。

实战篇:

介绍基于 ChatGPT 的端到端语音聊天机器人项目实战,企业级 ChatGPT 开发的三大核心内部机制及案例实战,ChatGPT 插件的内部机制、源码及案例实战,ChatGPT 提示词开发实战,思维链及 ReAct 解析与实战,提示词本质解析及评估实战与源码解析,LangChain 大模型框架的七大核心组件及案例解析(上、下),LangChain 代理深入解析及源码解析,AutoGPT 源码解析及综合案例实战,使用 LangChain 构建问答聊天机器人案例实战,构建基于大模型的自治代理案例,Llama 2 模型与 LangChain 项目详解。书中每个知识点均配有相应的实现代码和实例。

本书适合有一定 Python 基础的 ChatGPT 爱好者阅读,主要面向从事大模型应用开发、机器学习、数据挖掘或深度学习的专业人员,高等院校相关专业的师生,以及相关领域的科研人员。

本书附赠丰富的学习资源,具体如下:①同步学习资源,即 16 集同步教学视频,视频时长共计约 1000 分钟;②教师授课的辅助资源,即 187 个案例知识点、15 个项目实战的全部源代码。

前言

在当今快速发展的科技时代,人工智能(artificial intelligence,AI)技术正以惊人的速度改变着人们的生活和工作方式。在这个新时代的浪潮中,大模型技术成为AI领域的一颗耀眼新星。ChatGPT作为大模型技术的重要应用之一,正在引领着人机交互领域的革新浪潮。本书将带领读者深入探索大模型新时代,通过ChatGPT实战项目和内部解析,深入掌握基于ChatGPT的大模型应用开发领域的关键技术,并解密ChatGPT的底层架构和实现原理。

本书主要内容

本书通过ChatGPT实战项目的方式,为读者呈现一个全面、系统的学习路径,从基础知识的介绍开始,带领读者深入了解ChatGPT的工作原理和实际应用。本书非常适合具备Python基础的读者学习。

全书共16章,分为基础篇和实战篇两大部分。
基础篇包括第1~3章;实战篇包括第4~16章。

第1章 ChatGPT底层架构Transformer技术及源码实现,详解最大似然估计、最大后验概率、贝叶斯Transformer及自编码与自回归语言模型的内部机制。

第2章 GPT的内部机制及源码实现,剖析GPT运行机制、掩码机制、Decoder-Only模式,详解数据流动生命周期及GPT-2源码。

第3章 GPT系列模型原理与应用:从GPT-2到GPT-4,解析ChatGPT提示词流程、GPT-2运行机制,可视化解读GPT-3/4的内部机制。

第4章 基于ChatGPT的端到端语音聊天机器人项目实战,涵盖ChatGPT API开发、前后端构建(ReAct+FastAPI)及项目优化。

第5章 企业级ChatGPT开发的三大核心内部机制及案例实战,解析企业级开发核心,演示Notion问答对话AI案例。

第6章 ChatGPT插件的内部机制、源码及案例实战,详解插件工作原理、检索插件源码及全流程开发实战。

第7章 ChatGPT提示词开发实战,基于LangChain框架的提示词、思维链、链式提示词及模型评估开发。

第8章 思维链及ReAct解析与实战,剖析思维链推理、ReAct技术原理、框架源码及案例实战。

第9章 提示词本质解析及评估实战与源码解析,包含问答评估、代理评估源码解析及提示词本质探讨。

第10~11章 LangChain大模型框架的七大核心组件及案例解析(上、下),涵盖模型、词嵌入、提示词、内存、回调、数据连接、代理等核心组件及聊天机器人综合案例。

第12章 LangChain代理深入解析及源码解析,详解代理工作原理及AutoGPT源码解析。

第13章 AutoGPT源码解析及综合案例实战,剖析AutoGPT内部机制及其在LangChain代理、内存、PromptGenerator中的应用。

第14章 使用LangChain构建问答聊天机器人案例实战,涵盖GPT-4代码生成全流程及LangChain开发实战。

第15章 构建基于大模型的自治代理案例,详解自治代理原理、工具、示例及开源实现源码。

第16章 Llama 2模型与LangChain项目详解,包括模型部署(Replicate)、Hugging Face/LangChain实践、检索增强生成及自定义提示词RetrievalQA开发。

本书特色

●深入探索,全面剖析。
本书涵盖ChatGPT案例实战、LangChain项目实战及框架源码解析等多个层面的内容。每章都深入探讨相关技术与案例,并提供源码解析,使读者能够全面了解ChatGPT和LangChain等技术的内部机制与开发原理,为实际项目的应用提供有力指导。

●实战剖析,项目揭秘。
本书每章都提供具体的案例实战与项目解析,引导读者通过实际操作和代码理解技术细节和底层逻辑。通过理论结合实践的方式,使读者能够更好地运用所学知识,深入了解项目和框架的实现细节。

●前沿突破,技术驱动。
本书介绍了一系列突破性的技术,如ChatGPT、LangChain、Transformer、Prompt、Llama 2、AutoGPT、BabyAGI、CoT、ToT、ReAct、MRKL等。通过对这些技术的深入剖析,读者可以了解相关技术的发展和应用,并了解它们在实际项目中的具体应用场景和效果。

●源码解析,细致讲解。
本书对LangChain框架的关键技术进行了逐行源码剖析。读者可以深入理解源码实现和机制原理,从而更好地理解技术细节和底层逻辑,并将其应用于实际开发工作中。

本书还为读者提供了丰富的知识和实用的技能,帮助读者在ChatGPT和LangChain领域取得突破性的进展。无论是初学者还是有一定经验的开发者,都可以从本书中获得有价值的学习资源。

配套资源

为便于教与学,本书配有同步教学视频(约1000分钟)、源代码、数据集、教学课件、教学大纲、安装程序。

作者简介

王家林

美国斯坦福大学计算机专业毕业。曾在美国担任硅谷顶级机器学习和人工智能实验室主任、杰出AI工程师及首席机器学习工程师,专精于对话式人工智能(conversational AI)。现担任硅谷某知名对话机器人公司CTO,自2019年起专注于基于红队测试(red teaming)的责任型AI(responsible AI),并热衷于构建生成式AI/大语言模型教练系统(GenAI/LLM coaching systems)。在硅谷任职期间,曾领导多个GenAI/LLM解决方案项目,成功平衡企业业务需求下的大模型推理(reasoning)系统与幻觉(hallucinations)及偏见(biases)风险的最小化。

作为数据科学、机器学习、NLP、ChatGPT及大模型等领域25本书的主要作者,王家林对利用人工智能提供解决方案,以及通过机器学习驱动的NLP与LLM流程帮助组织实现数据驱动决策充满热情。他曾领导Apple、PayPal、Chase Bank、Faethm、LinkedIn等公司的11个重大NLP项目。

在NLP、对话式AI、大数据及基于AWS的无服务器(serverless)技术方面,拥有丰富的机器学习咨询经验。

段智华

中国电信股份有限公司上海分公司高级工程师。长期从事大模型与智能体技术领域,专注Agentic AI、Harness Agent等前沿方向研究。

新书购买链接

《企业级ChatGPT AI大模型应用开发实战(1000分钟视频)》
购买链接:https://item.jd.com/15389212.html

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐