Python 多进程并发操作中进程池Pool的实例


Posted in Python onNovember 01, 2017

在利用Python进行系统管理的时候,特别是同时操作多个文件目录,或者远程控制多台主机,并行操作可以节约大量的时间。当被操作对象数目不大时,可以直接利用multiprocessing中的Process动态成生多个进程,10几个还好,但如果是上百个,上千个目标,手动的去限制进程数量却又太过繁琐,这时候进程池Pool发挥作用的时候就到了。

Pool可以提供指定数量的进程,供用户调用,当有新的请求提交到pool中时,如果池还没有满,那么就会创建一个新的进程用来执行该请求;但如果池中的进程数已经达到规定最大值,那么该请求就会等待,直到池中有进程结束,才会创建新的进程来它。这里有一个简单的例子:

#!/usr/bin/env python
#coding=utf-8
"""
Author: Squall
Last modified: 2011-10-18 16:50
Filename: pool.py
Description: a simple sample for pool class
"""

from multiprocessing import Pool
from time import sleep

def f(x):
  for i in range(10):
    print '%s --- %s ' % (i, x)
    sleep(1)


def main():
  pool = Pool(processes=3)  # set the processes max number 3
  for i in range(11,20):
    result = pool.apply_async(f, (i,))
  pool.close()
  pool.join()
  if result.successful():
    print 'successful'


if __name__ == "__main__":
  main()

先创建容量为3的进程池,然后将f(i)依次传递给它,运行脚本后利用ps aux | grep pool.py查看进程情况,会发现最多只会有三个进程执行。pool.apply_async()用来向进程池提交目标请求,pool.join()是用来等待进程池中的worker进程执行完毕,防止主进程在worker进程结束前结束。但必pool.join()必须使用在pool.close()或者pool.terminate()之后。其中close()跟terminate()的区别在于close()会等待池中的worker进程执行结束再关闭pool,而terminate()则是直接关闭。result.successful()表示整个调用执行的状态,如果还有worker没有执行完,则会抛出AssertionError异常。

利用multiprocessing下的Pool可以很方便的同时自动处理几百或者上千个并行操作,脚本的复杂性也大大降低。

——————————————————————————————————

Python多进程并发(multiprocessing)

由于Python设计的限制(我说的是咱们常用的CPython)。最多只能用满1个CPU核心。

Python提供了非常好用的多进程包multiprocessing,你只需要定义一个函数,Python会替你完成其他所有事情。借助这个包,可以轻松完成从单进程到并发执行的转换。

1、新建单一进程

如果我们新建少量进程,可以如下:

import multiprocessing
import time

def func(msg):
for i in xrange(3):
print msg
time.sleep(1)

if __name__ == "__main__":
p = multiprocessing.Process(target=func, args=("hello", ))</ 
p.start()
p.join()
print "Sub-process done."

2、使用进程池

是的,你没有看错,不是线程池。它可以让你跑满多核CPU,而且使用方法非常简单。

注意要用apply_async,如果落下async,就变成阻塞版本了。

processes=4是最多并发进程数量。

import
multiprocessing
import
time
 
def
func(msg):
  for
i
in
xrange(3):
    print
msg
    time.sleep(1)
 
if
__name__
==
"__main__":
  pool
=
multiprocessing.Pool(processes=4)
  for
i
in
xrange(10):
    msg
=
"hello
 %d"
%(i)
    pool.apply_async(func,
(msg,
))
  pool.close()
  pool.join()
  print
"Sub-process(es)
 done."

3、使用Pool,并需要关注结果

更多的时候,我们不仅需要多进程执行,还需要关注每个进程的执行结果,如下:

import multiprocessing

import time



def func(msg):

for i in xrange(3):

print msg

time.sleep(1)

return "done " + msg



if __name__ == "__main__":

pool = multiprocessing.Pool(processes=4)

result = []

for i in xrange(10):

msg = "hello %d" %(i)

result.append(pool.apply_async(func, (msg, )))

pool.close()

pool.join()

for res in result:

print res.get()

print "Sub-process(es) done."

2014.12.25更新

根据网友评论中的反馈,在Windows下运行有可能崩溃(开启了一大堆新窗口、进程),可以通过如下调用来解决:

multiprocessing.freeze_support()

简易worker multiprocessing.Pool

多任务模型设计是一个比较复杂的逻辑,但是python对于多任务的处理却有种种方便的类库,不需要过多的纠结进程/线程间的操作细节。比如multiprocessing.Pool就是其中之一。

官方给的范例也很简单。

from multiprocessing import Pool

def f(x):
  return x*x

if __name__ == '__main__':
  pool = Pool(processes=4)       # start 4 worker processes
  result = pool.apply_async(f, [10])  # evaluate "f(10)" asynchronously
  print result.get(timeout=1)      # prints "100" unless your computer is *very* slow
  print pool.map(f, range(10))     # prints "[0, 1, 4,..., 81]"

并未做太多的详细解释。正好我手头有一段代码,需要请求几百个url,解析html页面获取一些信息,单线程for循环效率极低,因此看到了这个模块,想用这个实现多任务分析,参考代码如下:

from multiprocessing import Pool

def analyse_url(url):
  #do something with this url
  return analysis_result

if __name__ == '__main__':
  pool = Pool(processes=10)
  result = pool.map(analyse_url, url_list)

确实比以前单线程for循环url_list列表,一个个请求analyse_url要快得多,但是带来的问题就是一旦pool.map没执行完就ctrl-c中断程序,程序就会异常,永远无法退出,参考stackoverflow的这个帖子,修改为以下代码:

#result = pool.map(analyse_url, url_list)
result = pool.map_async(analyse_url, url_list).get(120)

至此问题完美解决。

以上这篇Python 多进程并发操作中进程池Pool的实例就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持三水点靠木。

Python 相关文章推荐
python实现哈希表
Feb 07 Python
python中常用的各种数据库操作模块和连接实例
May 29 Python
python复制列表时[:]和[::]之间有什么区别
Oct 16 Python
解决pycharm运行程序出现卡住scanning files to index索引的问题
Jun 27 Python
django框架事务处理小结【ORM 事务及raw sql,customize sql 事务处理】
Jun 27 Python
PyQt Qt Designer工具的布局管理详解
Aug 07 Python
解决django-xadmin列表页filter关联对象搜索问题
Nov 15 Python
Django集成celery发送异步邮件实例
Dec 17 Python
使用Python 自动生成 Word 文档的教程
Feb 13 Python
python随机模块random的22种函数(小结)
May 15 Python
基于python实现删除指定文件类型
Jul 21 Python
Python中对象的比较操作==和is区别详析
Feb 12 Python
python 3.0 模拟用户登录功能并实现三次错误锁定
Nov 01 #Python
python 简单搭建阻塞式单进程,多进程,多线程服务的实例
Nov 01 #Python
Python编程实现双链表,栈,队列及二叉树的方法示例
Nov 01 #Python
Python栈算法的实现与简单应用示例
Nov 01 #Python
Python scikit-learn 做线性回归的示例代码
Nov 01 #Python
机器学习python实战之手写数字识别
Nov 01 #Python
Python定时器实例代码
Nov 01 #Python
You might like
关于PHP中的Class的几点个人看法
2006/10/09 PHP
PHP CodeBase:将时间显示为&quot;刚刚&quot;&quot;n分钟/小时前&quot;的方法详解
2013/06/06 PHP
在WordPress中使用wp_count_posts函数来统计文章数量
2016/01/05 PHP
简单谈谈php浮点数精确运算
2016/03/10 PHP
WordPress分页伪静态加html后缀
2016/06/08 PHP
php 调用ffmpeg获取视频信息的简单实现
2017/04/03 PHP
jQuery的显示和隐藏方法与css隐藏的样式对比
2013/10/18 Javascript
javascript中的原型链深入理解
2014/02/24 Javascript
extjs每个组件要设置唯一的ID否则会出错
2014/06/15 Javascript
javascript中的Base64、UTF8编码与解码详解
2015/03/18 Javascript
JavaScript实现数组随机排序的方法
2015/06/26 Javascript
基于jQuery通过jQuery.form.js插件实现异步上传
2015/12/13 Javascript
浅析JavaScript中命名空间namespace模式
2016/06/22 Javascript
JS调用某段SQL语句的方法
2016/10/20 Javascript
Vue实现百度下拉提示搜索功能
2017/06/21 Javascript
浅谈react受控组件与非受控组件(小结)
2018/02/09 Javascript
微信小程序实现多选功能
2018/11/04 Javascript
vue - vue.config.js中devServer配置方式
2019/10/30 Javascript
JavaScript数值类型知识汇总
2019/11/17 Javascript
JavaScript实现简单随机点名器
2019/11/21 Javascript
在vue中使用Echarts画曲线图的示例
2020/10/03 Javascript
Python中有趣在__call__函数
2015/06/21 Python
python开发之tkinter实现图形随鼠标移动的方法
2015/11/11 Python
Python解惑之True和False详解
2017/04/24 Python
Python实现的求解最大公约数算法示例
2018/05/03 Python
Python3标准库之functools管理函数的工具详解
2020/02/27 Python
Python 中如何写注释
2020/08/28 Python
Python实现对word文档添加密码去除密码的示例代码
2020/12/29 Python
HTML5 中新的全局属性(整理)
2013/07/31 HTML / CSS
美国礼品卡交易网站:Cardpool
2018/08/27 全球购物
咨询公司各岗位职责
2013/12/02 职场文书
公务员上班玩游戏检讨书
2014/09/17 职场文书
担保贷款承诺书
2015/04/30 职场文书
员工年度工作总结2015
2015/05/18 职场文书
浅谈Python3中datetime不同时区转换介绍与踩坑
2021/08/02 Python
根德5570型九灯四波段立体声收音机是电子管收音机的楷模 ? 再论5570
2022/04/05 无线电