详解puppeteer使用代理


Posted in Javascript onDecember 27, 2018

背景

在使用puppeteer进行访问页面的时候,有时候需要用到代理。

环境: centos 7

chrome 安装

puppeteer使用chrome。 参考chrome的命令行使用方式。 在官网中没看到说明,不过一般的执行文件都是支持help的。
在服务器上安装chrome :

vim /etc/yum.repos.d/google-chrome.repo

添加内容

[google-chrome]
name=google-chrome
baseurl=http://dl.google.com/linux/chrome/rpm/stable/$basearch
enabled=1
gpgcheck=1
gpgkey=https://dl-ssl.google.com/linux/linux_signing_key.pub

安装浏览器

yum -y install google-chrome-stable

说明: yum search chrome 可以查看供安装的包

chrome 命令行代理

在shell中执行命令:

google-chrome -h

即可看到所有的命令选项,其中 OPTION 下面有代理添加的介绍以及示例:

--proxy-server=host:port
    Specify the HTTP/SOCKS4/SOCKS5 proxy server to use for requests.
    This overrides any environment variables or settings picked via
    the options dialog. An individual proxy server is specified
    using the format:

    [<proxy-scheme>://]<proxy-host>[:<proxy-port>]

    Where <proxy-scheme> is the protocol of the proxy server, and is
    one of:

    "http", "socks", "socks4", "socks5".

    If the <proxy-scheme> is omitted, it defaults to "http". Also
    note that "socks" is equivalent to "socks5".

    Examples:

    --proxy-server="foopy:99"
     Use the HTTP proxy "foopy:99" to load all URLs.

    --proxy-server="socks://foobar:1080"
     Use the SOCKS v5 proxy "foobar:1080" to load all URLs.

    --proxy-server="socks4://foobar:1080"
     Use the SOCKS v4 proxy "foobar:1080" to load all URLs.

    --proxy-server="socks5://foobar:66"
     Use the SOCKS v5 proxy "foobar:66" to load all URLs.

    It is also possible to specify a separate proxy server for dif?
    ferent URL types, by prefixing the proxy server specifier with a
    URL specifier:

    Example:

    --proxy-server="https=proxy1:80;http=socks4://baz:1080"
     Load https://* URLs using the HTTP proxy "proxy1:80". And
    load http://*
     URLs using the SOCKS v4 proxy "baz:1080".


  --no-proxy-server
    Disables the proxy server. Overrides any environment variables
    or settings picked via the options dialog.


  --proxy-auto-detect
    Autodetect proxy configuration. Overrides any environment vari?
    ables or settings picked via the options dialog.


  --proxy-pac-url=URL
    Specify proxy autoconfiguration URL. Overrides any environment
    variables or settings picked via the options dialog.

其中 ?proxy-server= 的值的格式是 [<proxy-scheme>://]<proxy-host>[:<proxy-port>]

其中 http 代理是不需要加 proxy-scheme ,以上的示例中显示 socks 代理是需要添加scheme。

比如:

在本机建立一个 socks5 代理服务器, 本地端口是 1088

google-chrome --headless --disable-gpu --proxy-server="socks5://127.0.0.1:1088" --print-to-pdf https://www.chromestatus.com/

上面的示例中并没有 需要密码(用户)验证的。

puppeteer 添加代理

在以上命令行中, 代理 option 添加方式是:

--proxy-server="socks5://127.0.0.1:1088"

在 puppeteer 中,启动浏览器时添加代理:

const browser = await puppeteer.launch({headless:true, args:['--no-sandbox','--proxy-server=socks5://127.0.0.1:1088']});

具体puppeteer使用参考网上实例。

说明

有关使用账户密码credentials 的代理使用:

1 新建代理
可以在本地新建一个不用密码的代理,该代理访问有密码的代理。 然后puppeteer 中使用该无密码代理

2 页面添加代理
具体使用可以参考: https://github.com/GoogleChrome/puppeteer/blob/master/docs/api.md#pageauthenticatecredentials

自己还没使用过.

参考文章:

chrome 安装 https://3water.com/article/153596.htm

puppeteer api 说明 https://github.com/GoogleChrome/puppeteer/blob/master/docs/api.md

代理问题 https://github.com/GoogleChrome/puppeteer/issues/336

puppeteer 官方文档 https://pptr.dev/#?product=Puppeteer&version=v1.5.0&show=api-class-page

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持三水点靠木。

Javascript 相关文章推荐
关于javascript DOM事件模型的两件事
Jul 22 Javascript
JQuery操作三大控件(下拉,单选,复选)的方法
Aug 06 Javascript
页面装载js及性能分析方法介绍
Mar 21 Javascript
JQuery设置获取下拉菜单某个选项的值(比较全)
Aug 05 Javascript
JS和JQ的event对象区别分析
Nov 24 Javascript
浅谈$(document)和$(window)的区别
Jul 15 Javascript
js仿新浪微博消息发布功能
Feb 17 Javascript
Vue实现web分页组件详解
Nov 28 Javascript
vue-cli 引入、配置axios的方法
May 08 Javascript
vue3.0 CLI - 1 - npm 安装与初始化的入门教程
Sep 14 Javascript
JavaScript在web自动化测试中的作用示例详解
Aug 25 Javascript
Vue使用NProgress的操作过程解析
Oct 10 Javascript
Angular(5.2-&gt;6.1)升级小结
Dec 27 #Javascript
详解angular2 控制视图的封装模式
Dec 27 #Javascript
JavaScript原型对象原理与应用分析
Dec 27 #Javascript
angular6 填坑之sdk的方法
Dec 27 #Javascript
react+ant design实现Table的增、删、改的示例代码
Dec 27 #Javascript
React降级配置及Ant Design配置详解
Dec 27 #Javascript
详解Ant Design of React的安装和使用方法
Dec 27 #Javascript
You might like
php生成二维码
2015/08/10 PHP
JavaScript中常见陷阱小结
2010/04/27 Javascript
Ext 今日学习总结
2010/09/19 Javascript
IE6中使用position导致页面变形的解决方案(js代码)
2011/01/09 Javascript
40个有创意的jQuery图片和内容滑动及弹出插件收藏集之二
2011/12/31 Javascript
javascript算法题 求任意一个1-9位不重复的N位数在该组合中的大小排列序号
2012/07/21 Javascript
中国地区三级联动下拉菜单效果分析
2012/11/15 Javascript
js判断60秒以及倒计时示例代码
2014/01/24 Javascript
jquery判断输入密码两次是否相等
2020/04/22 Javascript
JavaScript弹出对话框的三种方式
2016/03/23 Javascript
详解vue.js的devtools安装
2017/05/26 Javascript
vue cli使用绝对路径引用图片问题的解决
2017/12/06 Javascript
jquery实现侧边栏左右伸缩效果的示例
2017/12/19 jQuery
Angular简单验证功能示例
2017/12/22 Javascript
使用Vue开发一个实时性时间转换指令
2018/01/17 Javascript
vue中实现图片和文件上传的示例代码
2018/03/16 Javascript
Angular异步变同步处理方法
2018/08/13 Javascript
Vue.js的复用组件开发流程完整记录
2018/11/29 Javascript
如何在Node和浏览器控制台中打印彩色文字
2020/01/09 Javascript
Vue elementui字体图标显示问题解决方案
2020/08/18 Javascript
js实现筛选功能
2020/11/24 Javascript
vue基于Echarts的拖拽数据可视化功能实现
2020/12/04 Vue.js
[48:22]VGJ.S vs VG 2018国际邀请赛小组赛BO2 第一场 8.16
2018/08/17 DOTA
深入Python函数编程的一些特性
2015/04/13 Python
PyQt5打开文件对话框QFileDialog实例代码
2018/02/07 Python
对python 各种删除文件失败的处理方式分享
2018/04/24 Python
python 生成器和迭代器的原理解析
2019/10/12 Python
Python BeautifulReport可视化报告代码实例
2020/04/13 Python
简单了解python shutil模块原理及使用方法
2020/04/28 Python
html5 利用canvas实现超级玛丽简单动画
2013/09/06 HTML / CSS
HTML5 SEO优化的一些建议
2020/08/27 HTML / CSS
意大利专业化妆品品牌:KIKO MILANO
2017/02/01 全球购物
加拿大在线旅游公司:Flighthub
2019/03/11 全球购物
农业大学毕业生的个人自我评价
2013/10/11 职场文书
银行业务授权委托书
2014/10/10 职场文书
java多态注意项小结
2021/10/16 Java/Android