网络编程
位置:首页>> 网络编程>> Python编程>> 对python多线程与global变量详解

对python多线程与global变量详解

作者:hsj_csdn  发布时间:2021-03-05 20:34:48 

标签:python,多线程,global

今天早上起来写爬虫,基本框架已经搭好,添加多线程爬取功能时,发现出错:

比如在下载文件的url列表中加入200个url,开启50个线程。我的爬虫…竟然将50个url爬取并全部命名为0.html,也就是说,最后的下载结果,是有1个0.html(重复的覆盖了),还有1-150。下面是我的代码:


x = str(theguardian_globle.g)
#x为给下载的文件命的名
filePath = "E://wgetWeiBao//"+x+".html"
try:
 wget.download(url,filePath)
 theguardian_globle.g+=1
 print x+" is downloading..."

except:
 print "error!"

#这个是全局变量g的定义
global g

g = 0

后来终于发现问题:多线程+全局变量是个危险的组合,因为程序有多个线程在同时执行,多个线程同时操作全局变量,会引起混乱。在多线程中操作全局变量,应当给该操作加锁。

以下为修改后的代码:


函数:

def downLoad(url,num):
x = str(num)
filePath = "E://wgetWeiBao//"+x+".html"
try:
 wget.download(url,filePath)
 print x+" is downloading..."

except:
 print "error!"

多线程消费者_给操作全局变量的语句加锁
class Cosumer(threading.Thread):
def run(self):
 print('%s:started' % threading.current_thread())

while True:
  global gCondition
  gCondition.acquire()
  while q.empty()==True:
   gCondition.wait()
  url = q.get()
  num = theguardian_globle.g
  theguardian_globle.g+=1
  gCondition.release()
  downLoad(url,num)

大功告成!

来源:https://blog.csdn.net/hsj_csdn/article/details/55505475

0
投稿

猜你喜欢

手机版 网络编程 asp之家 www.aspxhome.com