如何自动化一个没有 API 的网站
在没有接口的情况下,使用网站已有的界面:供应商门户、管理后台、遗留系统和内部工具,智能体都可以直接操作。
当一个网站没有 API 时,界面本身就是集成入口。浏览器智能体会读取页面、执行和人一样的操作,并验证结果,这让供应商门户、管理后台和遗留内部工具都可以被自动化,而不必等待一个可能永远不会出现的接口。
永远不会到来的集成
大多数商业软件的 API 覆盖率充其量也只是部分。你真正需要的那个工作流,往往就藏在一张表格、一个管理界面、一个供应商门户或一个遗留内部工具背后,而对应的接口要么根本不存在,要么没有文档,要么有速率限制,要么被锁在你没有的套餐层级之后。
浏览器是贯穿这一切的共同层。凡是人能在标签页里完成的事情都可以自动化,这让浏览器成为最后的集成入口,而且往往是唯一可用的那一个。
- 没有公开 API 的供应商和合作伙伴门户
- API 遗漏了你需要的具体操作的管理后台
- 没人会去重新搭建的遗留内部系统
- 把 API 访问权限锁在更高套餐层级之后的 SaaS 产品
负责任地使用
能够访问浏览器,不代表可以无视网站的规则。只在你获得授权的地方使用智能体,并遵守服务条款、适用的 robots 指令、速率限制、隐私义务和相关法律。这是一个用于正当工作的工具,不是绕开访问控制或反爬虫防护的手段。
在实践中,这意味着:使用你自己的账号、你自己的供应商门户、你所在组织有权使用的系统,并且由人来审核任何有实际影响的操作。
让它可靠
给智能体设定能完成任务的最小作用范围,从目标页面开始,而不是让它自己去找网站,并且在写入操作前要求审批。像人一样验证结果:操作之后重新读取页面,确认变化确实发生了。
- 从已经打开对应记录的标签页开始
- 除非任务确实涉及多个标签页,否则将作用范围保持在「当前标签页」
- 在提交、发布、付款或删除前进行审批
- 要求它提供证据,而不只是结论
常见问题
这和网页抓取是一回事吗?
相关,但范围更广。抓取只是读取,而浏览器智能体还能执行操作:填写表单、更新记录、在系统之间搬运信息。两者都负有同样的责任,需要遵守条款和法律。
供应商重新设计门户时它会失效吗?
远比选择器脚本更少失效,因为智能体瞄准的是含义而不是 DOM 结构。一次会让脚本失效的改版,对智能体来说通常只是重新读取一次页面而已。
它能在登录之后的页面上工作吗?
可以。它运行在你真实的浏览器中、在你连接的标签页上,因此会直接使用你已登录的会话。它绝不会输入密码。
