上篇文章我写了一份完整的 Hermes 使用教程,从安装到接模型到接飞书都讲了一遍。文章发出去之后,有朋友私信我说,他按教程把 Hermes 装好了,用起来什么都好,就是有个毛病:每次在终端敲下 hermes 两个字,聊天界面要等好几秒才弹出来,有时候甚至要等二十秒,这体验也太难受了。

其实我自己刚装好那阵子也遇到过一模一样的问题,后来让 Hermes 自己排查了半天,找到根因,把问题解决了。我还把整套排查方法和解决方案做成了一个技能(Hermes 里叫 skill),你如果也遇到启动慢的情况,直接装我这个 skill 就能搞定。

一、为什么启动慢

让 Hermes 给自己做了一次体检,发现它每次启动,都会向 https://models.dev/api.json 这个地址发一个请求,拿各家模型供应商的元数据。问题就出在这个域名上:它在国内网络环境下,DNS 和 TCP 全都连不通,而代码里的超时设置是 5 秒加 10 秒,两次连接尝试各等 5 秒,正好硬卡 10 秒。

换句话说,启动慢不是电脑配置不行,是它在傻等一个永远连不上的网站。

验证起来很简单,在终端跑:

1
curl -s -m 8 https://models.dev/api.json

返回 exit=28,连接超时,实锤了。你如果也碰到启动慢,先跑这一条命令,是超时的话基本就是同一个原因。

二、处理方案

逻辑很简单:它要的网络数据拿不到,那我们就帮它把数据准备好放在本地,让它启动的时候直接读本地文件,跳过网络请求。

在 Hermes 的主目录下建一个文件 models_dev_cache.json,Linux 和 macOS 是 ~/.hermes/,Windows 是 ~/AppData/Local/hermes/,不确定的话用 hermes config path 查一下 config.yaml 的位置,缓存文件和它同级。内容格式如下,以 DeepSeek 为例,其他供应商结构相同:

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
{
"id": "deepseek",
"env": [
"DEEPSEEK_API_KEY"
],
"npm": "@ai-sdk/openai-compatible",
"api": "https://api.deepseek.com",
"name": "DeepSeek",
"doc": "https://api-docs.deepseek.com/quick_start/pricing",
"models": {
"deepseek-v4-flash": {
"id": "deepseek-v4-flash",
"name": "DeepSeek V4 Flash",
"description": "Official DeepSeek V4 Flash release with enhanced agentic capabilities and integrated DSpark speculative decoding",
"family": "deepseek-flash",
"attachment": false,
"reasoning": true,
"reasoning_options": [
{
"type": "toggle"
},
{
"type": "effort",
"values": [
"low",
"high",
"max"
]
}
],
"tool_call": true,
"interleaved": {
"field": "reasoning_content"
},
"structured_output": true,
"temperature": true,
"knowledge": "2025-05",
"release_date": "2026-07-31",
"last_updated": "2026-07-31",
"modalities": {
"input": [
"text"
],
"output": [
"text"
]
},
"open_weights": true,
"limit": {
"context": 1000000,
"output": 384000
},
"cost": {
"input": 0.14,
"output": 0.28,
"reasoning": 0.28,
"cache_read": 0.0028
}
}
}
}

只留你常用的那几个供应商就行,不用求全。有三个关键点:

1、文件必须是合法的 JSON,而且不能是空对象 {},空对象会被当成没有缓存,照样走网络请求。

2、只用一个供应商的话,上面这一整段就够用了,用其他家的就按这个结构补上对应条目,OpenAI 的 api 字段留 null 就行,Kimi 的 api 是 https://api.kimi.com/coding/v1。

3、路径别放错,放错位置等于没放。

放好之后重新计时,同一条命令,从 20 秒降到 7 到 11 秒,提速一半还多。

三、把这个方案做成 skill

问题解决了,但我寻思,过段时间要是再犯,或者朋友再问,还得重新查一遍,太麻烦。干脆把整套排查流程和解决方案整理成一个 skill,以后谁遇到启动慢,直接装上就能用。

skill 的安装方式有两种,都很快。

直接把这个链接:https://ai.haobin.org/skill/hermes-startup-fix.md 丢给Agent,然后跟它说帮我安装这个skill

修复完成后,hermes的启动速度应该有质的提升。