Agent-Reach:为代理准备并诊断网页读取工具
测量 Agent-Reach 读取质量与运营成本
固定获准来源样本,分别评估提取完整性、摘要正确性、诊断价值和上游用量。
测量 Agent-Reach 读取质量与运营成本知识学习CN编辑简报更新 2026-09-18
你将学会
- 固定公开来源样本
- 测量完整流程
- 限定比较范围
开始前需要
- 基本命令行与配置阅读能力
- 能够在独立且获准的环境中试验
把渠道健康、实际获取和答案验收关联起来,保留日期但不收集账号秘密。
先看结论
- 可访问内容仍可能不完整。
- 上游服务有独立费用。
- 可用性需要日期。
固定公开来源样本
选择答案已知的公开网页与 feed,记录时间,并加入提取时可能遗漏表格或背景的页面。保留原始来源,才能区分抓取丢失信息与摘要模型误解信息。
每个样本保存获取结果、读取工具和答案完整性,将 doctor 的 ok 状态放在另一个字段。渠道健康不能替代读者真正要求的文档证据。
测量完整流程
记录依赖准备时间、读取延迟、宿主模型用量和人工修正分钟数,按实际使用补充转录、搜索或托管费用。公开来源和工具许可不能决定所有下游账单。
失败与重试也要计入,包括能访问但内容不完整的结果。快速摘要若缺少关键段落,可能不如较慢但足以准确回答问题的提取有价值。
限定比较范围
比较后端时固定来源、宿主模型和评估规则,并记录获取日期,因为平台和页面都会变化。旧检查曾经健康,不代表渠道之后始终保持可用。
本次没有执行在线基准,示例未知值保持 null。未来结果必须带上样本和账号条件,不能把个别试验改写成所有平台永久免费可读的承诺。
如何选择
| 比较维度 | 方案 A | 方案 B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
实施步骤
- 1
给获准样本标注答案。
- 2
分开评估读取和摘要。
- 3
计入准备、重试及修正工作。
可复制示例
json
{
"experimentProposal": true,
"sources": null,
"retrievalMs": null,
"completeAnswers": null,
"modelUsage": null,
"correctionMinutes": null,
"executed": false
}常见问题
免费软件代表全流程免费吗?
模型、基础设施和外部服务仍可能收费。
只看延迟够吗?
还要检查内容是否真正回答问题。
资料来源
- Agent-Reach / README.md来源核查 2026-09-18
- Agent-Reach / agent_reach/doctor.py来源核查 2026-09-18