python进程池的使用注意
发布时间:2024-08-27 13:45:20

1、使用注意
(1)使用池时,如果没有指定流程数,则默认为CPU核心数。
(2)核心数量对应于计算机的逻辑处理器数量(任务管理器-性能),而不是核心数量(我的计算机有两个核心和四个逻辑处理器,所以默认在这里使用四个过程)
(3)进程数可以是几十万,不代表开放进程数是4。只要使用池(10),可以同时打开10个进程爬网。
(4)但需要注意的是,无论是多线程还是多过程,打开过多都会导致切换耗时,降低效率,所以创建过多的多线程和过程是谨慎的。
2、实例
importrequests
frombs4importBeautifulSoup
frommultiprocessingimportPool,current_process
defget_title(i):
print('start',current_process().name)
title_list=[]
url='https://movie.douban.com/top250?start={}&filter='.format(i*25)
r=requests.get(url)
soup=BeautifulSoup(r.content,'html.parser')
lis=soup.find('ol',class_='grid_view').find_all('li')
forliinlis:
title=li.find('span',class_="title").text
#returntitle
title_list.append(title)
print(title)
return(title_list)if__name__='__main__':
pool=Pool()
foriinrange(10):
pool.apply_async(get_title,(i,))
pool.close()
pool.join()
print('finish')以上是py注意使用thon进程池,希望对大家有所帮助。更多Python学习指导:python基础教程
本文教程操作环境:windows7系统Python 3.9.1,DELL G3电脑。
