Hermes Agent 更新:读取速度最高提升60倍

Hermes Agent 这次主要优化了 网页读取能力:读取速度最高提升 60 倍,成本最高降低 49 倍。 核心做法是先清洗网页内容,把大型网页保存下来,再由 Agent 按需分页读取,而不是一次性把整页内容全部塞给模型。 这样可以减少无效 Token、降低上下文压力,也让 Agent 在做网页研究、资料整理和长文总结时更快、更省。 简单来说:这次优化的不是模型本身,而是 Agen

63 热度
21 浏览

最近 Hermes Agent 更新了一个看起来很“底层”,但我觉得很重要的能力:

网页读取速度最高提升 60 倍,成本最高降低 49 倍。

这并不只是简单的:

“打开网页更快了。”

它真正优化的是 AI Agent 在做研究、总结、资料整理时非常高频的一步:

怎么把网页内容高效地交给模型。


Agent 读网页,为什么这么麻烦?

以前很多 Agent 在读取网页时都会遇到几个问题:

  • 网页很长,混杂导航、广告、脚本等无关内容;
  • 模型需要处理大量无意义的 Token;
  • 大网页一次性塞进上下文,又慢又贵;
  • 同一份网页内容可能还会被重复处理。

结果就是:

模型真正需要的信息可能只有一小部分,却要为整张网页付出 Token 和时间成本。


Hermes 是怎么优化的?

这次 Hermes 的思路可以简单理解成三步:

1. 先清洗网页

由抓取后端直接输出更干净的网页内容,减少 Agent 重复处理。

2. 大网页保存到本地

不再把超长网页一次性全部塞进模型上下文。

3. 按需读取

Agent 需要哪一部分内容,再分页读取哪一部分。

简单来说就是:

不是把整张网页一股脑塞给模型,而是先整理成一个可读取的资料库,再让 Agent 按需查看。


为什么这件事很重要?

因为 Agent 和普通 Chatbot 的工作方式并不一样。

普通 Chatbot 更像是:

你问一句,它回答一句。

但 Agent 经常需要:

查网页 → 读文档 → 调工具 → 整理资料 → 推理 → 执行任务

所以真正决定 Agent 体验的,不只是:

模型聪不聪明。

还包括:

  • 能不能快速拿到干净的信息;
  • 能不能高效处理长网页;
  • 能不能减少 Token 浪费;
  • 能不能管理好上下文;
  • 能不能平衡速度、成本和质量。

Agent 开始卷“基础设施”了

我觉得这类更新其实反映了一个很明显的趋势:

AI Agent 接下来卷的不只是模型,而是整个执行系统。

模型当然很重要。

但如果:

网页读取、文档处理、工具调用、上下文管理

这些底层能力做得不好,那么即使接入最强的模型,Agent 的实际体验也可能很差。

Hermes 这次把网页读取做得更快、更便宜,本质上是在补齐 Agent 的基础设施能力


未来选 AI,可能不能只看模型了

以前我们使用 AI 工具,最常问的是:

“它接了哪个模型?”

未来可能还要继续问:

“它怎么读资料?”
“它怎么管理上下文?”
“它怎么控制 Token 和成本?”
“它怎么调用工具?”
“它怎么把外部信息变成最终结果?”

因为真正的 Agent,并不只是一个套着 UI 的大模型。

它更像是一整套:

模型 + 工具 + 上下文 + 数据处理 + 执行环境

组成的系统。

模型决定它能想多聪明,基础设施决定它能不能真正把事情做好。

Hermes Agent 更新:读取速度最高提升60倍

声明:Web前端小站 - 前端博客 - 王搏的个人博客|版权所有,违者必究|如未注明,均为原创

转载:转载请注明原文链接 - Hermes Agent 更新:读取速度最高提升60倍

评论 (0)

0/50
暂无评论,快来抢沙发吧~