跳转到内容

浏览网络的代理

一些代理通过实际操作浏览器来工作:加载页面、读取呈现内容、跟随链接、截图或生成 PDF。这是它们处理用 JavaScript 构建内容的网站的方式。

您将通过浏览器代理、浏览器功能或丰富作业的浏览模式来体验这一点。

公共网站,通过 HTTP 和 HTTPS。没有其他。

浏览器在某个没有访问任何私人内容的地方运行——不仅我们的内部服务,您自己的网络中的任何内容也无法访问。对私有或保留地址的请求在边界被拒绝,拒绝是基于实际连接的地址,而不是基于之前的检查。当一个主机名在检查时解析为公共地址,而在使用时解析为私有地址时,仍然会被拒绝。

出于两个原因,这一点值得了解:

  • 内部 URL 不会工作。 将浏览代理指向您自己内联网中的某个内容、私有 IP 或 localhost 将失败。没有设置可以更改这一点。
  • 这是一个边界,而不是过滤器。 它不依赖于代理的表现,因此即使提示代理尝试,它仍然无法通过。

代理会被明确告知,并被告知不要重试:

被浏览器出口边界阻止……请不要重试——这是政策,而不是暂时失败。

这种措辞是故意的。没有它,失败看起来像超时,代理会浪费剩余的步骤重试永远不会成功的内容。拒绝是快速的——大约十分之一秒——所以被阻止的目标几乎不会给您造成成本。

在普通 HTTP 上,您可能会看到页面报告返回状态 403。原因相同。

您看到的内容 通常是什么
被浏览器出口边界阻止 目标是私有的、保留的或不允许的
在您期望正常工作的 URL 上状态 403 与上述相同,在普通 HTTP 上
导航超时 网站确实很慢,或在等待未到达的内容
空白或部分页面 网站未呈现任何有用的内容,或需要登录
代理在几次尝试后停止 它有步数预算;需要许多交互的网站可能会耗尽它

浏览器工作以浏览器秒计量——这是一个与模型令牌不同的单位,因为页面所需的时间与模型读取的内容无关。请参见 计费单位参考

被拒绝的页面仍然会产生拒绝所花费的时刻,这微不足道。一个挂起直到超时的页面则会产生超时的费用。