动态

Hermes Agent网页读取提速60倍降本49倍,支持多种后端提供商。

Hermes Agent网页读取提速60倍降本49倍,支持多种后端提供商。
Teknium 🪽
RT @IBuzovskyi: HERMES AGENT 现在可以读取网页,速度提升60倍,成本降低49倍。将干净内容直接传递给agent。大页面按需分页。

@NousResearch

抓取后端过去返回原始内容,这些内容在到达agent之前被冗余处理。那个流程已不复存在。

现在:后端直接传递干净内容。大页面本地保存并按需分页。相同质量,时间和成本的一小部分。

WEB_EXTRACT 如何处理大页面:

基于大小的处理,不浪费token。

小于5000字符:
→ 原样返回,无LLM调用。完整markdown到达agent。

5000到500,000字符:
→ 通过辅助模型单次摘要,输出上限约5000字符。保留引用、代码块、关键事实。

500,000到2,000,000字符:
→ 分块为100K字符片段,每块并行摘要,最终合成约5000字符。

超过2,000,000字符:
→ 拒绝并提示使用web_crawl及聚焦提取指令。

摘要是内容压缩器,不是改写器。如果摘要失败,Hermes回退到原始内容的前5000字符。没有无用的错误消息。

将提取路由到廉价模型:

默认情况下,web_extract使用你的主要模型。在Opus上,每个长页面都会消耗高级token进行摘要。

在桌面应用、仪表板或config.yaml中设置:

auxiliary:
web_extract:
provider: openrouter
model: google/gemini-3-flash-preview
timeout: 360

在Gemini Flash上进行提取摘要,推理保留在高级模型上。仅此一项即可大幅降低网页研究成本。

8个后端提供商:

Firecrawl(默认):搜索+提取+抓取,每月500免费额度。
SearXNG:免费,自托管,仅搜索,无需API密钥。
Brave Search:每月2000免费查询,仅搜索。
DDGS(DuckDuckGo):免费,无需密钥,仅搜索。
Tavily:搜索+提取+抓取,每月1000免费搜索。
Exa:搜索+提取,每月1000免费搜索。
Parallel:搜索+提取,付费。
xAI(Grok):仅搜索,通过Grok生成LLM结果。

仅搜索提供商与Firecrawl/Tavily/Exa配对以实现提取能力。

按能力拆分:

为搜索和提取使用不同提供商:

SearXNG(免费)用于搜索,Firecrawl用于提取。

免费搜索,仅按需付费提取。通过hermes tools或config.yaml配置。

免费自托管搜索(SearXNG):

零API成本,零速率限制。尊重隐私的元搜索,覆盖70+引擎。

docker compose up -d

在.env中设置SEARXNG_URL。在settings.yml中启用JSON格式。Hermes自动连接。

与Firecrawl配对进行提取,即可免费搜索,仅按需付费提取。

NOUS PORTAL 订阅者:

通过Tool Gateway的托管Firecrawl提供网页搜索和提取。无需API密钥,无需单独计费。hermes setup --portal启用一切。

当你需要原始内容时:

如果LLM摘要遗漏了重要字段(结构化数据、表格、特定格式):

请改用browser_navigate + browser_snapshot。返回实时可访问性树,无需辅助模型重写。

完整Hermes架构深度解析见文章👇
动态Teknium 🪽2026-07-01原文

相关内容