PyQt5内嵌浏览器注入JavaScript脚本实现自动化操作的代码实例


Posted in Python onFebruary 13, 2019

概要

应同学邀请,演示如何使用 PyQt5 内嵌浏览器浏览网页,并注入 Javascript 脚本实现自动化操作。

下面测试的是一个廉价机票预订网站(http://www.flyscoot.com/),关键点如下

  1. 使用 QWebEngineView 加载网页,并显示进度。
  2. 在默认配置(QWebEngineProfile)中植入 Javascript 内容,这样脚本会在所有打开的网页中执行,不论跳转到哪个网址。
  3. Javascript 脚本使用网址中的路径名,判断当前网页位置,从而决定执行哪种操作。

python 代码示例

#!/usr/bin/env python3
# -*- coding: utf-8 -*-
'''使用 PyQt5 内嵌浏览器浏览网页,并注入 Javascript 脚本实现自动化操作。'''
import os
import sys
from datetime import datetime
from PyQt5.QtWidgets import (
  QWidget, QApplication, QVBoxLayout, QHBoxLayout,
  QDesktopWidget, QTextEdit, QLabel, QLineEdit, QPushButton,
  QFileDialog, QProgressBar,
)
from PyQt5.QtCore import QUrl, pyqtSlot
from PyQt5.QtWebEngineWidgets import QWebEngineView, QWebEngineProfile, QWebEngineScript, QWebEnginePage
class Browser(QWidget):
  def __init__(self):
    super().__init__()
    self.init_ui()
    # 脚本
    self.profile = QWebEngineProfile.defaultProfile()
    self.script = QWebEngineScript()
    self.prepare_script()
  def init_ui(self):
    self.webView = QWebEngineView()
    self.logEdit = QTextEdit()
    self.logEdit.setFixedHeight(100)
    self.addrEdit = QLineEdit()
    self.addrEdit.returnPressed.connect(self.load_url)
    self.webView.urlChanged.connect(
      lambda i: self.addrEdit.setText(i.toDisplayString()))
    self.jsEdit = QLineEdit()
    self.jsEdit.setText('inject.js')
    loadUrlBtn = QPushButton('加载')
    loadUrlBtn.clicked.connect(self.load_url)
    chooseJsBtn = QPushButton('选择脚本文件')
    chooseJsBtn.clicked.connect(self.choose_js_file)
    # 导航/工具
    top = QWidget()
    top.setFixedHeight(80)
    topBox = QVBoxLayout(top)
    topBox.setSpacing(0)
    topBox.setContentsMargins(5, 0, 0, 5)
    progBar = QProgressBar()
    progBox = QHBoxLayout()
    progBox.addWidget(progBar)
    topBox.addLayout(progBox)
    naviBox = QHBoxLayout()
    naviBox.addWidget(QLabel('网址'))
    naviBox.addWidget(self.addrEdit)
    naviBox.addWidget(loadUrlBtn)
    topBox.addLayout(naviBox)
    naviBox = QHBoxLayout()
    naviBox.addWidget(QLabel('注入脚本文件'))
    naviBox.addWidget(self.jsEdit)
    naviBox.addWidget(chooseJsBtn)
    topBox.addLayout(naviBox)
    self.webView.loadProgress.connect(progBar.setValue)
    # 主界面
    layout = QVBoxLayout(self)
    layout.addWidget(self.webView)
    layout.addWidget(top)
    layout.addWidget(self.logEdit)
    self.show()
    self.resize(1024, 900)
    self.center()
  def center(self):
    qr = self.frameGeometry()
    cp = QDesktopWidget().availableGeometry().center()
    qr.moveCenter(cp)
    self.move(qr.topLeft())
  @pyqtSlot()
  def load_url(self):
    url = self.addrEdit.text().strip()
    if not url.lower().startswith('http://') \
        and not url.lower().startswith('https://'):
      url = 'http://{}'.format(url)
    self.load(url)
  @pyqtSlot()
  def choose_js_file(self):
    f, _ = QFileDialog.getOpenFileName(filter="Javascript files(*.js)")
    if os.path.isfile(f):
      self.jsEdit.setText(f)
      self.prepare_script()
  def prepare_script(self):
    path = self.jsEdit.text().strip()
    if not os.path.isfile(path):
      self.log('invalid js path')
      return
    self.profile.scripts().remove(self.script)
    with open(path, 'r') as f:
      self.script.setSourceCode(f.read())
    self.profile.scripts().insert(self.script)
    self.log('injected js ready')
  def log(self, msg, *args, **kwargs):
    m = msg.format(*args, **kwargs)
    self.logEdit.append('{} {}'.format(
      datetime.now().strftime('%H:%M:%S'), m))
  def load(self, url):
    self.log(f'loading {url}')
    self.addrEdit.setText(url)
    self.webView.load(QUrl(url))
if __name__ == '__main__':
  app = QApplication(sys.argv)
  b = Browser()
  b.load('http://www.flyscoot.com/')
  sys.exit(app.exec_())

Javascript 脚本示例

// 简单起见,这里只演示部分页面,脚本内容摘自 Heng丶原贴文。
function handle(path) {
  // 首页
  if (path == '/zh') {
    document.getElementsByClassName('radio-inline')[1].click();
    document.getElementById('oneway_from').value='广州 (CAN)';
    document.getElementById('oneway_to').value='新加坡 (SIN)';
    document.getElementById('oneway_departuredate').value='2018年9月10日';
    document.getElementsByClassName('btn--booking')[1].click();
    return;
  }
  // 选择航班
  if (path == '/Book/Flight') {
    document.getElementsByClassName('price--sale')[0].click();
    document.getElementsByClassName('heading-4')[0].click();
    document.getElementsByClassName('btn-submit')[0].click();
    return;
  }
  // 乘客信息
  if (path == '/BookFlight/Passengers') {
    document.getElementsByClassName('fname1')[0].value = "匿名";
  }
}
let host = document.location.hostname;
if (host.endsWith('.flyscoot.com')) {
  handle(document.location.pathname);
}

总结

以上就是这篇文章的全部内容了,希望本文的内容对大家的学习或者工作具有一定的参考学习价值,谢谢大家对三水点靠木的支持。如果你想了解更多相关内容请查看下面相关链接

Python 相关文章推荐
python实现dict版图遍历示例
Feb 19 Python
黑科技 Python脚本帮你找出微信上删除你好友的人
Jan 07 Python
python3使用matplotlib绘制散点图
Mar 19 Python
对python3中的RE(正则表达式)-详细总结
Jul 23 Python
Django 反向生成url实例详解
Jul 30 Python
python爬虫 正则表达式解析
Sep 28 Python
wxPython:python首选的GUI库实例分享
Oct 05 Python
Django框架ORM数据库操作实例详解
Nov 07 Python
wxPython色环电阻计算器
Nov 18 Python
Python基于Dlib的人脸识别系统的实现
Feb 26 Python
python获取本周、上周、本月、上月及本季的时间代码实例
Sep 08 Python
python3 字符串str和bytes相互转换
Mar 23 Python
Python实现Event回调机制的方法
Feb 13 #Python
Python socket实现多对多全双工通信的方法
Feb 13 #Python
对python文件读写的缓冲行为详解
Feb 13 #Python
python单线程文件传输的实例(C/S)
Feb 13 #Python
Python 实现文件打包、上传与校验的方法
Feb 13 #Python
使用python3构建文件传输的方法
Feb 13 #Python
对python 自定义协议的方法详解
Feb 13 #Python
You might like
Yii2框架dropDownList下拉菜单用法实例分析
2016/07/18 PHP
PHP实现函数内修改外部变量值的方法示例
2018/12/28 PHP
jQuery动画效果-slideUp slideDown上下滑动示例代码
2013/08/28 Javascript
jquery 中的each()跳出循环的语句
2014/05/23 Javascript
node.js中使用socket.io的方法
2014/12/15 Javascript
JavaScript实现邮箱地址自动匹配功能代码
2016/11/28 Javascript
Js中async/await的执行顺序详解
2017/09/22 Javascript
基于Vue 实现一个中规中矩loading组件
2019/04/03 Javascript
vue实现拖拽的简单案例 不超出可视区域
2019/07/25 Javascript
使用js实现单链解决前端队列问题的方法
2020/02/03 Javascript
解决Can't find variable: SockJS vue项目的问题
2020/09/22 Javascript
理解生产者消费者模型及在Python编程中的运用实例
2016/06/26 Python
Python 遍历列表里面序号和值的方法(三种)
2017/02/17 Python
Python读取图片为16进制表示简单代码
2018/01/19 Python
Python使用matplotlib绘制余弦的散点图示例
2018/03/14 Python
python正则表达式之对号入座篇
2018/07/24 Python
python numpy元素的区间查找方法
2018/11/14 Python
对python中矩阵相加函数sum()的使用详解
2019/01/28 Python
python读取图片的方式,以及将图片以三维数组的形式输出方法
2019/07/03 Python
在Django admin中编辑ManyToManyField的实现方法
2019/08/09 Python
python实现单链表的方法示例
2019/09/03 Python
python实现Oracle查询分组的方法示例
2020/04/30 Python
手把手教你从PyCharm安装到激活(最新激活码),亲测有效可激活至2089年
2020/11/25 Python
python mongo 向数据中的数组类型新增数据操作
2020/12/05 Python
HTML5 通信API 跨域门槛将不再高、数据推送也不再是梦
2013/04/25 HTML / CSS
美国现代家具购物网站:LexMod
2019/01/09 全球购物
马来西亚排名第一的宠物用品店:Pets Wonderland
2020/04/16 全球购物
银行毕业实习自我鉴定
2013/09/19 职场文书
应届生服务员求职信
2013/10/31 职场文书
领导党性分析材料
2014/02/15 职场文书
2014年社会实践活动总结范文
2014/04/29 职场文书
个人承诺书怎么写
2014/05/24 职场文书
2014年房产经纪人工作总结
2014/12/08 职场文书
亮剑精神观后感
2015/06/05 职场文书
小学班长竞选稿
2015/11/20 职场文书
入党申请书怎么写?
2019/06/11 职场文书