Hermes Agent 更新:读取速度最高提升60倍
Hermes Agent 这次主要优化了 网页读取能力:读取速度最高提升 60 倍,成本最高降低 49 倍。 核心做法是先清洗网页内容,把大型网页保存下来,再由 Agent 按需分页读取,而不是一次性把整页内容全部塞给模型。 这样可以减少无效 Token、降低上下文压力,也让 Agent 在做网页研究、资料整理和长文总结时更快、更省。 简单来说:这次优化的不是模型本身,而是 Agen
最近 Hermes Agent 更新了一个看起来很“底层”,但我觉得很重要的能力:
网页读取速度最高提升 60 倍,成本最高降低 49 倍。
这并不只是简单的:
“打开网页更快了。”
它真正优化的是 AI Agent 在做研究、总结、资料整理时非常高频的一步:
怎么把网页内容高效地交给模型。
Agent 读网页,为什么这么麻烦?
以前很多 Agent 在读取网页时都会遇到几个问题:
- 网页很长,混杂导航、广告、脚本等无关内容;
- 模型需要处理大量无意义的 Token;
- 大网页一次性塞进上下文,又慢又贵;
- 同一份网页内容可能还会被重复处理。
结果就是:
模型真正需要的信息可能只有一小部分,却要为整张网页付出 Token 和时间成本。
Hermes 是怎么优化的?
这次 Hermes 的思路可以简单理解成三步:
1. 先清洗网页
由抓取后端直接输出更干净的网页内容,减少 Agent 重复处理。
2. 大网页保存到本地
不再把超长网页一次性全部塞进模型上下文。
3. 按需读取
Agent 需要哪一部分内容,再分页读取哪一部分。
简单来说就是:
不是把整张网页一股脑塞给模型,而是先整理成一个可读取的资料库,再让 Agent 按需查看。
为什么这件事很重要?
因为 Agent 和普通 Chatbot 的工作方式并不一样。
普通 Chatbot 更像是:
你问一句,它回答一句。
但 Agent 经常需要:
查网页 → 读文档 → 调工具 → 整理资料 → 推理 → 执行任务
所以真正决定 Agent 体验的,不只是:
模型聪不聪明。
还包括:
- 能不能快速拿到干净的信息;
- 能不能高效处理长网页;
- 能不能减少 Token 浪费;
- 能不能管理好上下文;
- 能不能平衡速度、成本和质量。
Agent 开始卷“基础设施”了
我觉得这类更新其实反映了一个很明显的趋势:
AI Agent 接下来卷的不只是模型,而是整个执行系统。
模型当然很重要。
但如果:
网页读取、文档处理、工具调用、上下文管理
这些底层能力做得不好,那么即使接入最强的模型,Agent 的实际体验也可能很差。
Hermes 这次把网页读取做得更快、更便宜,本质上是在补齐 Agent 的基础设施能力。
未来选 AI,可能不能只看模型了
以前我们使用 AI 工具,最常问的是:
“它接了哪个模型?”
未来可能还要继续问:
“它怎么读资料?”
“它怎么管理上下文?”
“它怎么控制 Token 和成本?”
“它怎么调用工具?”
“它怎么把外部信息变成最终结果?”
因为真正的 Agent,并不只是一个套着 UI 的大模型。
它更像是一整套:
模型 + 工具 + 上下文 + 数据处理 + 执行环境
组成的系统。
模型决定它能想多聪明,基础设施决定它能不能真正把事情做好。

声明:Web前端小站 - 前端博客 - 王搏的个人博客|版权所有,违者必究|如未注明,均为原创
转载:转载请注明原文链接 - Hermes Agent 更新:读取速度最高提升60倍