python进程池的使用注意
python进程池的使用注意
1、使用注意
(1)使用池时,如果未指定进程数,则默认为CPU核心数。
(2)核心数量对应于计算机的逻辑处理器数量(任务管理器-性能),而不是核心数量(我的计算机有2个核心和4个逻辑处理器,因此这里默认使用4个进程)
(3)进程数可以是几十万,并不意味着开放进程的数量是4。只要使用池(10),就可以同时打开10个进程进行爬网。
(4)但是需要注意的是,无论多线程还是多进程,打开过多都会导致切换耗时,降低效率,所以创建过多的多线程和进程是谨慎的。
2、实例
importrequests
frombs4importBeautifulSoup
frommultiprocessingimportPool,current_process
defget_title(i):
print('start',current_process().name)
title_list=[]
url='https://movie.douban.com/top250?start={}&filter='.format(i*25)
r=requests.get(url)
soup=BeautifulSoup(r.content,'html.parser')
lis=soup.find('ol',class_='grid_view').find_all('li')
forliinlis:
title=li.find('span',class_="title").text
#returntitle
title_list.append(title)
print(title)
return(title_list)if__name__=='__main__':
pool=Pool()
foriinrange(10):
pool.apply_async(get_title,(i,))
pool.close()
pool.join()
print('finish')
以上就是python进程池的使用注意,希望能对大家有所帮助。更多Python学习教程请关注IT培训机构:千锋教育。
猜你喜欢LIKE
相关推荐HOT
更多>>python中mat是什么意思?
python中mat是什么意思?本文教程操作环境:windows7系统、Python3.9.1,DELLG3电脑。python的numpy库提供矩阵运算的功能,因此我们在需要矩阵运...详情>>
2023-11-10 23:22:48python上下文管理的使用场景
python上下文管理的使用场景本文教程操作环境:windows7系统、Python3.9.1,DELLG3电脑。1、上下文管理的使用场景凡是要在代码块前后插入代码的...详情>>
2023-11-10 20:07:44python常量折叠是什么
python常量折叠是什么1、概念所谓常量折叠,指的是在编译时就查找并计算常量表达式,而不是在运行时再对其进行计算,从而会使运行时更加精简和...详情>>
2023-11-10 19:11:50pythonTCP与UDP的不同点分析
python中TCP与UDP的不同点分析(推荐操作系统:windows7系统、Python3.9.1、DELLG3电脑。)1、不同点面向连接(确认有创建三方交握,连接已创建才...详情>>
2023-11-10 18:16:05