python爬取抖音视频的实例分析


Posted in Python onJanuary 19, 2021

现在抖音的火爆程度,大家都是有目共睹的吧,之前小编在网络上发现好玩的事情,就是去爬取一些网站,因此,也考虑能否进行抖音上的破案去,在实际操作以后,真的实现出来了,利用自动化工具,就可以轻松实现了,后有小伙伴提出把appium去掉瘦身之后也是可以实现的,那么看下详细操作内容吧。

1、mitmproxy/mitmdump抓包

import requests
path = 'D:/video/'
num = 1788
def response(flow):
 global num
 target_urls = ['url']
 for url in target_urls:
   if flow.request.url.startswith(url):
      filename = path + str(num) + '.mp4
   res = requests.get(flow.request.url, stream=True)
    with open(filename, 'ab') as f:
    f.write(res.content)
    f.flush()
    print(filename + '下载完成')
   num += 1

2、Appium对手机进行模拟操作

利用Start Server按钮即可启动appium服务

python爬取抖音视频的实例分析

再点击Start Session即可启动Android手机上的抖音app并进入到启动页面

3、python脚本来驱动app,直接在pycharm运行即可

实例扩展:

import requests
import json
import re
import os
from pprint import pprint as pp
import queue


class DouYin:
 header = {
  'accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/webp,image/apng,*/*;q=0.8',
  'accept-encoding': 'gzip, deflate, br',
  'accept-language': 'zh-CN,zh;q=0.9',
  'cache-control': 'max-age=0',
  'upgrade-insecure-requests': '1',
  'user-agent': 'Mozilla/5.0 (iPhone; CPU iPhone OS 11_0 like Mac OS X) AppleWebKit/604.1.38 (KHTML, like Gecko) Version/11.0 Mobile/15A372 Safari/604.1',
 }

 def __init__(self, url=None):
  self.url = self.get_RealAddress(url)
  # 获取用户视频的url
  self.user_video_url = 'https://www.douyin.com/aweme/v1/aweme/post/?{0}'
  self.user_id = re.search(r'user/(.*)\?', self.url).group(1)		# 用户id
  requests.packages.urllib3.disable_warnings()
  self.session = requests.Session()
  self.target_folder = ''		# 创建文件的路径
  self.queue = queue.Queue()		# 生成一个队列对象

 def user_info(self):
  self.mkdir_dir()
  p = os.popen('node fuck.js %s' % self.user_id) # 获取加密的signature
  signature = p.readlines()[0]

  user_video_params = {
   'user_id': str(self.user_id),
   'count': '21',
   'max_cursor': '0',
   'aid': '1128',
   '_signature': signature
  }

  # 获取下载视频的列表
  def get_aweme_list(max_cursor=None):
   if max_cursor:
    user_video_params['max_cursor'] = str(max_cursor)
   user_video_url = self.user_video_url.format(
    '&'.join([key + '=' + user_video_params[key] for key in user_video_params])) # 拼接参数
   response = requests.get(
    url=user_video_url, headers=self.header, verify=False)
   contentJson = json.loads(response.content.decode('utf-8')) # 将返回的进行utf8编码
   aweme_list = contentJson.get('aweme_list', [])
   for aweme in aweme_list:
    video_name = aweme.get(
     'share_info', None).get('share_desc', None)  # 视频的名字
    video_url = aweme.get('video', None).get('play_addr', None).get(
     'url_list', None)[0].replace('playwm', 'play')  # 视频链接
    self.queue.put((video_name, video_url)) # 将数据进队列
   if contentJson.get('has_more') == 1: # 判断后面是不是还有是1就是还有
    return get_aweme_list(contentJson.get('max_cursor')) # 有的话获取参数max_cursor
  get_aweme_list()

 # 下载视频
 def get_download(self):
  while True:
   video_name, video_url = self.queue.get()
   file_name = video_name + '.mp4'
   file_path = os.path.join(self.target_folder, file_name)
   if not os.path.isfile(file_path):
    print('download %s form %s.\n' % (file_name, video_url))
    times = 0
    while times < 10:
     try:
      response = requests.get(
       url=video_url, stream=True, timeout=10, verify=False) # 开启流下载
      with open(file_path, 'wb') as f:
       for chunk in response.iter_content(1024): # 返回迭代对象
        f.write(chunk)
       print('下载成功')
      break
     except:
      print('下载失败')
     times += 1

 # 创建对应的文件夹

 def mkdir_dir(self):
  current_folder = os.getcwd()
  self.target_folder = os.path.join(
   current_folder, 'download/%s' % self.user_id)
  if not os.path.isdir(self.target_folder):
   os.mkdir(self.target_folder)

 # 短链接转长地址
 def get_RealAddress(self, url):
  if url.find('v.douyin.com') < 0:
   return url
  response = requests.get(
   url=url, headers=self.header, allow_redirects=False) # allow_redirects 允许跳转
  return response.headers['Location']

if __name__ == '__main__':
 douyin = DouYin(url='http://v.douyin.com/J2B9Sk/')
 douyin.user_info()
 douyin.get_download()

到此这篇关于python爬取抖音视频的实例分析的文章就介绍到这了,更多相关如何使用python爬取抖音视频内容请搜索三水点靠木以前的文章或继续浏览下面的相关文章希望大家以后多多支持三水点靠木!

Python 相关文章推荐
python判断端口是否打开的实现代码
Feb 10 Python
在python的WEB框架Flask中使用多个配置文件的解决方法
Apr 18 Python
python下载文件时显示下载进度的方法
Apr 02 Python
python模拟事件触发机制详解
Jan 19 Python
python3写的简单本地文件上传服务器实例
Jun 04 Python
Python中的函数式编程:不可变的数据结构
Oct 08 Python
python中yield的用法详解——最简单,最清晰的解释
Apr 04 Python
使用Python检测文章抄袭及去重算法原理解析
Jun 14 Python
Python字典生成式、集合生成式、生成器用法实例分析
Jan 07 Python
Python 的 __str__ 和 __repr__ 方法对比
Sep 02 Python
用python对excel查重
Dec 07 Python
python实现图片转字符画
Feb 19 Python
python中的插入排序的简单用法
Jan 19 #Python
Python实现淘宝秒杀功能的示例代码
Jan 19 #Python
Python爬虫后获取重定向url的两种方法
Jan 19 #Python
详解Python+Selenium+ChromeDriver的配置和问题解决
Jan 19 #Python
VSCODE配置Markdown及Markdown基础语法详解
Jan 19 #Python
python+selenium自动化实战携带cookies模拟登陆微博
Jan 19 #Python
selenium携带cookies模拟登陆CSDN的实现
Jan 19 #Python
You might like
php用户注册页面利用js进行表单验证具体实例
2013/10/17 PHP
浅谈PHP中其他类型转化为Bool类型
2016/03/28 PHP
PHP实现上一篇下一篇的方法实例总结
2016/09/22 PHP
详解PHP发送邮件知识点
2018/05/06 PHP
PHP使用SOAP调用API操作示例
2018/12/25 PHP
lib.utf.js
2007/08/21 Javascript
javascript 动态加载 css 方法总结
2009/07/11 Javascript
JavaScript开发规范要求(规范化代码)
2010/08/16 Javascript
jquery 全局AJAX事件使用代码
2010/11/05 Javascript
JS获取iframe中marginHeight和marginWidth属性的方法
2015/04/01 Javascript
javascript常用功能汇总
2015/07/05 Javascript
JQ选择器_选择同类元素的第N个子元素的实现方法
2016/09/08 Javascript
JavaScript 闭包机制详解及实例代码
2016/10/10 Javascript
详谈for循环里面的break和continue语句
2017/07/20 Javascript
jQuery实现锚点向下平滑滚动特效示例
2017/08/29 jQuery
jQuery实现滑动星星评分效果(每日分享)
2019/11/13 jQuery
JavaScript的console命令使用实例
2019/12/03 Javascript
element-ui table行点击获取行索引(index)并利用索引更换行顺序
2020/02/27 Javascript
js实现3D旋转相册
2020/08/02 Javascript
Python 自动安装 Rising 杀毒软件
2009/04/24 Python
Python正则表达式分组概念与用法详解
2017/06/24 Python
在Python的一段程序中如何使用多次事件循环详解
2017/09/07 Python
python+opencv实现高斯平滑滤波
2020/07/21 Python
Django Aggregation聚合使用方法解析
2019/08/01 Python
Python操作redis和mongoDB的方法
2019/12/19 Python
python requests模拟登陆github的实现方法
2019/12/26 Python
python和opencv构建运动检测器的实现
2021/03/03 Python
Lookfantastic法国官网:英国知名美妆购物网站
2017/10/28 全球购物
Zooplus葡萄牙:欧洲领先的网上宠物商店
2018/07/01 全球购物
应届医学毕业生求职信分享
2013/12/02 职场文书
初中考试作弊检讨书
2014/02/01 职场文书
《猴子种树》教学反思
2014/02/14 职场文书
2015年采购员工作总结
2015/04/27 职场文书
班干部学习委员竞选稿
2015/11/20 职场文书
Android自定义ScrollView实现阻尼回弹
2022/04/01 Java/Android
vue elementUI表格控制对应列
2022/04/13 Vue.js