Technology
TinyFish + Monid:免费搜索不等于无限可靠,Agent 上网要先看证据链
给 Agent 接入搜索,成本只是第一道门槛。更难的问题是:结果是否来自实时页面,动态站点能否正确渲染,返回内容是否足够干净,以及当服务限速或页面结构变化时,工作流有没有退路。
Monid 的 TinyFish 页面把 Search 和 Fetch 作为免费能力介绍,TinyFish 官方文档则提供 MCP 接入说明。免费并不自动意味着无限吞吐、永久承诺或适合所有生产负载;速率限制、服务条款、目标网站授权和结果质量仍需由调用方验证。
Search 与 Fetch 解决的是两类问题
Search 用来发现候选页面,Fetch 用来读取指定 URL。对 JavaScript 较重的 SPA,浏览器渲染比简单 HTTP 请求更接近用户看到的页面;但渲染成功也不代表抽取内容完整,登录墙、地区限制、反自动化策略和个性化结果仍可能影响输出。
把结果送给模型前,应该保留 URL、抓取时间、状态和原始返回,必要时抽样对照页面。不要因为 Markdown 看起来干净,就把其中的价格、政策或新闻判断直接当成已核实事实。
接入方式要按权限选择
Monid 页面提供通过技能文件让 Agent 自发现工具的路径,TinyFish 官方文档还说明了 MCP 等集成方式。自动安装远程 SKILL.md 前,应先阅读文件内容,确认它请求哪些权限、调用哪些域名,以及是否包含写操作。MCP 配置也要限制到实际需要的工具,不要把整个工具目录无差别暴露给生产代理。
curl -L https://docs.tinyfish.ai/mcp-integration上面的命令只用于查看官方接入文档;真正配置时以当前文档、客户端格式和账户状态为准。
免费额度之外的工程成本
- 速率限制会让批量研究和监控出现排队,需要退避、缓存和断点续跑;
- 动态页面变化会造成抽取字段漂移,关键字段必须做 schema 校验;
- 外部网页是不可信输入,模型上下文要防提示注入和恶意链接;
- 监控任务要保存差异证据,而不是只记录“页面变了”;
- 生产链路应准备第二个抓取通道,避免免费服务成为单点。
适合先做低风险验证
可以先用公开文档、产品更新页和自有站点测试:记录同一 URL 的结果一致性、延迟、失败率、正文覆盖率和限速行为,再决定是否接入竞品监控或自动研究。免费搜索降低了试验成本,但没有替你完成事实核验、合规审查和系统设计。
官方入口:Monid TinyFish 说明;接入细节:TinyFish MCP 文档。