从零安装到5个真实工作流,含 DeepSeek / 通义千问 / Kimi 国内模型接入,10分钟上手
Hermes 是一个开源的 AI Agent 框架,可以理解为一个「能装插件的 ChatGPT」。它的核心优势:
产品经理、运营、独立开发者、内容创作者 — 任何想让 AI 帮你干活但不想花钱订阅的人。尤其适合国内用户,搭配 DeepSeek API 使用体验极好。
你需要准备以下环境(15 分钟搞定):
如果 npm install 很慢,先设置国内镜像:npm config set registry https://registry.npmmirror.com
Hermes 支持接入几乎所有主流 AI 模型。以下按推荐优先级排列,国内用户首选 DeepSeek。
国内最强开源模型,V4-Pro 参数 1.6T,中文能力顶级,OpenAI API 格式完全兼容。
获取步骤:
sk-xxxxxxxx)免费额度:注册即送 $5,每天 50 次免费调用。日常轻度使用基本不花钱。
价格:V4-Flash 输入 $0.14/百万 token,输出 $0.28/百万 token — 是 GPT-4 的 1/100。
API 地址:https://api.deepseek.com | 模型名:deepseek-chat (V4) / deepseek-reasoner (R1推理)
Kimi 以超长上下文著称(128K),适合分析长篇文档、论文、合同等场景。
获取步骤:
API 地址:https://api.moonshot.cn/v1 | 模型名:moonshot-v1-8k / moonshot-v1-128k
阿里云百炼平台,企业版每月 10 万次免费调用,稳定性高,有丰富的 SDK 支持。
获取步骤:
API 地址:https://dashscope.aliyuncs.com/compatible-mode/v1 | 模型名:qwen-plus / qwen-max
清华系,GLM 模型在多模态和代码能力上有优势。
获取步骤:
API 地址:https://open.bigmodel.cn/api/paas/v4 | 模型名:glm-4 / glm-4-flash
字节跳动旗下,Doubao 模型价格极低,适合大批量调用场景。
获取步骤:
API 地址:https://ark.cn-beijing.volces.com/api/v3 | 模型名:doubao-pro-32k
如果你有海外网络条件,也可以直接接 GPT-4o 或 Claude 模型:
主力:DeepSeek V4(日常编码、写作、分析,国产便宜快)
长文档:Kimi(处理大型文档、合同、论文)
重活:OpenAI GPT-4o(有海外网络时,复杂推理场景用)
看到 "Hermes is running!" 就说明安装成功了 🎉
第一次启动时会下载一些依赖包,可能等 1-2 分钟。如果卡住了可以 Ctrl+C 后重新 hermes start。
这是小红书上篇爆款笔记(50赞/110收藏)的完整版,每个 Skill 附带安装命令和踩坑记录:
语义 + 图谱 + 时间三维检索,让 Hermes 记住所有对话,再也不失忆。
31 个可组合技能 + 129 个设计系统,不用开 Figma 就能出设计稿。
说人话就能生成流程图 / UML / 架构图,自动输出 draw.io 格式。
写完小红书/公众号正文跑一遍,AI 痕迹全消。做内容的必备。
同时跑多个 Hermes 实例,可视化调度,像看仪表盘一样管它们。
装多了会打架?帮你整理、去重、自动进化。
不想敲命令行的直接装,浏览器里聊天 + 终端 + Skill 管理三合一。
754 个结构化网安技能,完整映射 MITRE ATT&CK,安全从业者一个包搞定。
先装 hindsight + drawio-skill,跑通再加其他的。别一次装超过 5 个,有些 Skill 会冲突。用 SkillClaw 自动检测冲突。
上篇笔记只是简介,这里是完整操作步骤:
前提:hindsight 已运行至少 3 天,积累足够的对话记忆。
头 3 天 hindsight 啥都记不住,因为还没积累足够的对话。别急,坚持用就行。另外,它不会主动记录你在终端里打的命令,需要你在聊天里提一句「我刚跑了 git push」。
字体有时会乱码,手动在 HTML 里换成本地字体就行。复杂布局(比如 Dashboard)生成质量一般,简单页面效果最好。
超过 20 个节点的复杂图会丢连线,建议拆成多个小图分别生成。另外生成的 XML 文件需要 draw.io 桌面版打开,网页版可能加载失败。
同时开超过 4 个 Agent 电脑会卡,特别是做图那个比较吃资源。API 调用量也会成倍增加,注意费用。
过度去味会变成口水话,跑一遍就够,别跑两遍。实测数据显示:去味前收藏率 ~2%,去味后能到 ~8%。
| 对比项 | Hermes + Skill | Cursor Pro | Claude Max |
|---|---|---|---|
| 月费 | 免费(API 按量) | $20/月 | $200/月 |
| 代码补全 | ✅ hermes-code | ✅ 原生 | ✅ 原生 |
| 项目重构 | ✅ refactor-agent | ✅ 原生 | ✅ 但需手动 |
| Code Review | ✅ hermes-review | ⚠️ 有限 | ✅ 原生 |
| 生成测试 | ✅ hermes-test | ⚠️ 有限 | ✅ 原生 |
| 生成文档 | ✅ doc-generator | ❌ | ✅ 手动 |
| 生成设计 | ✅ open-design | ❌ | ❌ |
| 画流程图 | ✅ drawio-skill | ❌ | ❌ |
| 长期记忆 | ✅ hindsight | ❌ | ⚠️ 项目级 |
| 去 AI 味 | ✅ avoid-ai-writing | ❌ | ❌ |
| 国内直连 | ✅ DeepSeek/Qwen | ❌ 需代理 | ❌ 需代理 |
日常编码 → Cursor 足够;需要更多 Agent 能力(记忆、设计、流程图)→ Hermes 性价比最高;预算充足 → Claude Max 体验最好。国内用户强烈建议 Hermes + DeepSeek 组合。
头 3 天正常,它需要积累对话数据。多用它聊天就行。如果一周后还不行,检查 hintight 是否在 skill list 里显示为 "active"。
Hermes 的 Skill 本质就是一个 Markdown 文件 + 可选的 JS 脚本:
写 Skill 最重要的不是代码,是 trigger 触发条件 写清楚。触发条件越精准,Skill 越不容易被误调用。建议参考社区高星 Skill 的 SKILL.md 写法。