Technology

TinyFish + Monid:免费搜索不等于无限可靠,Agent 上网要先看证据链

给 Agent 接入搜索,成本只是第一道门槛。更难的问题是:结果是否来自实时页面,动态站点能否正确渲染,返回内容是否足够干净,以及当服务限速或页面结构变化时,工作流有没有退路。

Monid 的 TinyFish 页面把 Search 和 Fetch 作为免费能力介绍,TinyFish 官方文档则提供 MCP 接入说明。免费并不自动意味着无限吞吐、永久承诺或适合所有生产负载;速率限制、服务条款、目标网站授权和结果质量仍需由调用方验证。

Search 与 Fetch 解决的是两类问题

Search 用来发现候选页面,Fetch 用来读取指定 URL。对 JavaScript 较重的 SPA,浏览器渲染比简单 HTTP 请求更接近用户看到的页面;但渲染成功也不代表抽取内容完整,登录墙、地区限制、反自动化策略和个性化结果仍可能影响输出。

把结果送给模型前,应该保留 URL、抓取时间、状态和原始返回,必要时抽样对照页面。不要因为 Markdown 看起来干净,就把其中的价格、政策或新闻判断直接当成已核实事实。

接入方式要按权限选择

Monid 页面提供通过技能文件让 Agent 自发现工具的路径,TinyFish 官方文档还说明了 MCP 等集成方式。自动安装远程 SKILL.md 前,应先阅读文件内容,确认它请求哪些权限、调用哪些域名,以及是否包含写操作。MCP 配置也要限制到实际需要的工具,不要把整个工具目录无差别暴露给生产代理。

curl -L https://docs.tinyfish.ai/mcp-integration

上面的命令只用于查看官方接入文档;真正配置时以当前文档、客户端格式和账户状态为准。

免费额度之外的工程成本

  • 速率限制会让批量研究和监控出现排队,需要退避、缓存和断点续跑;
  • 动态页面变化会造成抽取字段漂移,关键字段必须做 schema 校验;
  • 外部网页是不可信输入,模型上下文要防提示注入和恶意链接;
  • 监控任务要保存差异证据,而不是只记录“页面变了”;
  • 生产链路应准备第二个抓取通道,避免免费服务成为单点。

适合先做低风险验证

可以先用公开文档、产品更新页和自有站点测试:记录同一 URL 的结果一致性、延迟、失败率、正文覆盖率和限速行为,再决定是否接入竞品监控或自动研究。免费搜索降低了试验成本,但没有替你完成事实核验、合规审查和系统设计。

官方入口:Monid TinyFish 说明;接入细节:TinyFish MCP 文档