python進程池的使用注意
1、使用注意
(1)使用池時,如果未指定進程數(shù),則默認為CPU核心數(shù)。
(2)核心數(shù)量對應于計算機的邏輯處理器數(shù)量(任務管理器-性能),而不是核心數(shù)量(我的計算機有2個核心和4個邏輯處理器,因此這里默認使用4個進程)
(3)進程數(shù)可以是幾十萬,并不意味著開放進程的數(shù)量是4。只要使用池(10),就可以同時打開10個進程進行爬網(wǎng)。
(4)但是需要注意的是,無論多線程還是多進程,打開過多都會導致切換耗時,降低效率,所以創(chuàng)建過多的多線程和進程是謹慎的。
2、實例
importrequests
frombs4importBeautifulSoup
frommultiprocessingimportPool,current_process
defget_title(i):
print('start',current_process().name)
title_list=[]
url='https://movie.douban.com/top250?start={}&filter='.format(i*25)
r=requests.get(url)
soup=BeautifulSoup(r.content,'html.parser')
lis=soup.find('ol',class_='grid_view').find_all('li')
forliinlis:
title=li.find('span',class_="title").text
#returntitle
title_list.append(title)
print(title)
return(title_list)if__name__=='__main__':
pool=Pool()
foriinrange(10):
pool.apply_async(get_title,(i,))
pool.close()
pool.join()
print('finish')
以上就是python進程池的使用注意,希望能對大家有所幫助。更多Python學習教程請關注IT培訓機構:千鋒教育。