AVt天堂网 手机版,亚洲va久久久噜噜噜久久4399,天天综合亚洲色在线精品,亚洲一级Av无码毛片久久精品

當前位置:首頁 > 科技  > 軟件

一篇文章帶你了解Python的分布式進程接口

來源: 責編: 時間:2024-04-11 17:29:38 190觀看
導讀一、前言在Thread和Process中,應當優選Process,因為Process更穩定,而且,Process可以分布到多臺機器上,而Thread最多只能分布到同一臺機器的多個CPU上。Python的multiprocessing模塊不但支持多進程,其中managers子模塊還支持

一、前言

3AN28資訊網——每日最新資訊28at.com

在Thread和Process中,應當優選Process,因為Process更穩定,而且,Process可以分布到多臺機器上,而Thread最多只能分布到同一臺機器的多個CPU上。3AN28資訊網——每日最新資訊28at.com

Python的multiprocessing模塊不但支持多進程,其中managers子模塊還支持把多進程分布到多臺機器上。可以寫一個服務進程作為調度者,將任務分布到其他多個進程中,依靠網絡通信進行管理。3AN28資訊網——每日最新資訊28at.com

二、案例分析

在做爬蟲程序時,抓取某個網站的所有圖片,如果使用多進程的話,一般是一個進程負責抓取圖片的鏈接地址,將鏈接地址放到queue中,另外的進程負責 從queue中取鏈接地址進行下載和存儲到本地。3AN28資訊網——每日最新資訊28at.com

怎么用分布式進程實現?3AN28資訊網——每日最新資訊28at.com

一臺機器上的進程負責抓取鏈接地址,其他機器上的進程負責系在存儲。那么遇到的主要問題是將queue 暴露到網絡中,讓其他機器進程都可以訪問,分布式進程就是將這個過程進行了封裝,可以將這個過程稱為本地隊列的網絡化。3AN28資訊網——每日最新資訊28at.com

例:3AN28資訊網——每日最新資訊28at.com

1.py3AN28資訊網——每日最新資訊28at.com

from multiprocessing.managers import BaseManagerfrom multiprocessing import freeze_support, Queue# 任務個數task_number = 10# 收發隊列task_quue = Queue(task_number)result_queue = Queue(task_number)def get_task():    return task_quuedef get_result():    return result_queue# 創建類似的queueManagerclass QueueManager(BaseManager):    passdef win_run():    # 注冊在網絡上,callable 關聯了Queue 對象    # 將Queue對象在網絡中暴露    # window下綁定調用接口不能直接使用lambda,所以只能先定義函數再綁定    QueueManager.register('get_task_queue', callable=get_task)    QueueManager.register('get_result_queue', callable=get_result)    # 綁定端口和設置驗證口令    manager = QueueManager(address=('127.0.0.1', 8001), authkey='qiye'.encode())    # 啟動管理,監聽信息通道    manager.start()    try:        # 通過網絡獲取任務隊列和結果隊列        task = manager.get_task_queue()        result = manager.get_result_queue()        # 添加任務        for url in ["ImageUrl_" + str(i) for i in range(10)]:            print('url is %s' % url)            task.put(url)                    print('try get result')        for i in range(10):            print('result is %s' % result.get(timeout=10))    except:        print('Manager error')    finally:        manager.shutdown()if __name__ == '__main__':    freeze_support()    win_run()

連接服務器,端口和驗證口令注意保持與服務器進程中完全一致從網絡獲取Queue,進行本地化,從task隊列獲取任務,并且把結果寫入result隊列3AN28資訊網——每日最新資訊28at.com

2.py3AN28資訊網——每日最新資訊28at.com

#coding:utf-8import timefrom multiprocessing.managers import BaseManager# 創建類似的Manager:class Manager(BaseManager):    pass#使用QueueManager注冊獲取Queue的方法名稱Manager.register('get_task_queue')Manager.register('get_result_queue')#連接到服務器:server_addr = '127.0.0.1'print('Connect to server %s...' % server_addr)# 端口和驗證口令注意保持與服務進程設置的完全一致:m = Manager(address=(server_addr, 8001), authkey='qiye')# 從網絡連接:m.connect()#獲取Queue的對象:task = m.get_task_queue()result = m.get_result_queue()#從task隊列取任務,并把結果寫入result隊列:while(not task.empty()):        image_url = task.get(True,timeout=5)        print('run task download %s...' % image_url)        time.sleep(1)        result.put('%s--->success'%image_url)#結束:print('worker exit.')

任務進程要通過網絡連接到服務進程,所以要指定服務進程的IP。3AN28資訊網——每日最新資訊28at.com

運行結果如下:3AN28資訊網——每日最新資訊28at.com

獲取圖片地址,將地址傳到2.py。3AN28資訊網——每日最新資訊28at.com

3AN28資訊網——每日最新資訊28at.com

接收1.py傳遞的地址,進行圖片的下載,控制臺顯示爬取結果。3AN28資訊網——每日最新資訊28at.com

3AN28資訊網——每日最新資訊28at.com

三、總結

本文基于Python基礎,Python的分布式進程接口簡單,封裝良好,適合需要把繁重任務分布到多臺機器的環境下。通過講解Queue的作用是用來傳遞任務和接收結果。3AN28資訊網——每日最新資訊28at.com

歡迎大家積極嘗試,有時候看到別人實現起來很簡單,但是到自己動手實現的時候,總會有各種各樣的問題,切勿眼高手低,勤動手,才可以理解的更加深刻。3AN28資訊網——每日最新資訊28at.com

本文鏈接:http://www.tebozhan.com/showinfo-26-82946-0.html一篇文章帶你了解Python的分布式進程接口

聲明:本網頁內容旨在傳播知識,若有侵權等問題請及時與本網聯系,我們將在第一時間刪除處理。郵件:2376512515@qq.com

上一篇: markdown-it大揭秘:輕松玩轉文本格式化新神器!

下一篇: C++中的外部模板及其在當前編譯文件中的實例化

標簽:
  • 熱門焦點
Top