Hermes Agent网页读取提速60倍降本49倍,支持多种后端提供商。
RT @IBuzovskyi: HERMES AGENT 现在可以读取网页,速度提升60倍,成本降低49倍。将干净内容直接传递给agent。大页面按需分页。
@NousResearch
抓取后端过去返回原始内容,这些内容在到达agent之前被冗余处理。那个流程已不复存在。
现在:后端直接传递干净内容。大页面本地保存并按需分页。相同质量,时间和成本的一小部分。
WEB_EXTRACT 如何处理大页面:
基于大小的处理,不浪费token。
小于5000字符:
→ 原样返回,无LLM调用。完整markdown到达agent。
5000到500,000字符:
→ 通过辅助模型单次摘要,输出上限约5000字符。保留引用、代码块、关键事实。
500,000到2,000,000字符:
→ 分块为100K字符片段,每块并行摘要,最终合成约5000字符。
超过2,000,000字符:
→ 拒绝并提示使用web_crawl及聚焦提取指令。
摘要是内容压缩器,不是改写器。如果摘要失败,Hermes回退到原始内容的前5000字符。没有无用的错误消息。
将提取路由到廉价模型:
默认情况下,web_extract使用你的主要模型。在Opus上,每个长页面都会消耗高级token进行摘要。
在桌面应用、仪表板或config.yaml中设置:
auxiliary:
web_extract:
provider: openrouter
model: google/gemini-3-flash-preview
timeout: 360
在Gemini Flash上进行提取摘要,推理保留在高级模型上。仅此一项即可大幅降低网页研究成本。
8个后端提供商:
Firecrawl(默认):搜索+提取+抓取,每月500免费额度。
SearXNG:免费,自托管,仅搜索,无需API密钥。
Brave Search:每月2000免费查询,仅搜索。
DDGS(DuckDuckGo):免费,无需密钥,仅搜索。
Tavily:搜索+提取+抓取,每月1000免费搜索。
Exa:搜索+提取,每月1000免费搜索。
Parallel:搜索+提取,付费。
xAI(Grok):仅搜索,通过Grok生成LLM结果。
仅搜索提供商与Firecrawl/Tavily/Exa配对以实现提取能力。
按能力拆分:
为搜索和提取使用不同提供商:
SearXNG(免费)用于搜索,Firecrawl用于提取。
免费搜索,仅按需付费提取。通过hermes tools或config.yaml配置。
免费自托管搜索(SearXNG):
零API成本,零速率限制。尊重隐私的元搜索,覆盖70+引擎。
docker compose up -d
在.env中设置SEARXNG_URL。在settings.yml中启用JSON格式。Hermes自动连接。
与Firecrawl配对进行提取,即可免费搜索,仅按需付费提取。
NOUS PORTAL 订阅者:
通过Tool Gateway的托管Firecrawl提供网页搜索和提取。无需API密钥,无需单独计费。hermes setup --portal启用一切。
当你需要原始内容时:
如果LLM摘要遗漏了重要字段(结构化数据、表格、特定格式):
请改用browser_navigate + browser_snapshot。返回实时可访问性树,无需辅助模型重写。
完整Hermes架构深度解析见文章👇
@NousResearch
抓取后端过去返回原始内容,这些内容在到达agent之前被冗余处理。那个流程已不复存在。
现在:后端直接传递干净内容。大页面本地保存并按需分页。相同质量,时间和成本的一小部分。
WEB_EXTRACT 如何处理大页面:
基于大小的处理,不浪费token。
小于5000字符:
→ 原样返回,无LLM调用。完整markdown到达agent。
5000到500,000字符:
→ 通过辅助模型单次摘要,输出上限约5000字符。保留引用、代码块、关键事实。
500,000到2,000,000字符:
→ 分块为100K字符片段,每块并行摘要,最终合成约5000字符。
超过2,000,000字符:
→ 拒绝并提示使用web_crawl及聚焦提取指令。
摘要是内容压缩器,不是改写器。如果摘要失败,Hermes回退到原始内容的前5000字符。没有无用的错误消息。
将提取路由到廉价模型:
默认情况下,web_extract使用你的主要模型。在Opus上,每个长页面都会消耗高级token进行摘要。
在桌面应用、仪表板或config.yaml中设置:
auxiliary:
web_extract:
provider: openrouter
model: google/gemini-3-flash-preview
timeout: 360
在Gemini Flash上进行提取摘要,推理保留在高级模型上。仅此一项即可大幅降低网页研究成本。
8个后端提供商:
Firecrawl(默认):搜索+提取+抓取,每月500免费额度。
SearXNG:免费,自托管,仅搜索,无需API密钥。
Brave Search:每月2000免费查询,仅搜索。
DDGS(DuckDuckGo):免费,无需密钥,仅搜索。
Tavily:搜索+提取+抓取,每月1000免费搜索。
Exa:搜索+提取,每月1000免费搜索。
Parallel:搜索+提取,付费。
xAI(Grok):仅搜索,通过Grok生成LLM结果。
仅搜索提供商与Firecrawl/Tavily/Exa配对以实现提取能力。
按能力拆分:
为搜索和提取使用不同提供商:
SearXNG(免费)用于搜索,Firecrawl用于提取。
免费搜索,仅按需付费提取。通过hermes tools或config.yaml配置。
免费自托管搜索(SearXNG):
零API成本,零速率限制。尊重隐私的元搜索,覆盖70+引擎。
docker compose up -d
在.env中设置SEARXNG_URL。在settings.yml中启用JSON格式。Hermes自动连接。
与Firecrawl配对进行提取,即可免费搜索,仅按需付费提取。
NOUS PORTAL 订阅者:
通过Tool Gateway的托管Firecrawl提供网页搜索和提取。无需API密钥,无需单独计费。hermes setup --portal启用一切。
当你需要原始内容时:
如果LLM摘要遗漏了重要字段(结构化数据、表格、特定格式):
请改用browser_navigate + browser_snapshot。返回实时可访问性树,无需辅助模型重写。
完整Hermes架构深度解析见文章👇