urllib2.HTTPError: HTTP Error 403: Forbidden 错误
出现urllib2.HTTPError: HTTP Error 403: Forbidden错误是由于网站禁止爬虫,可以在请求加上头信息,伪装成浏览器访问
#伪装浏览器头
headers = {'User-Agent':'Mozilla/5.0 (Windows; U; Windows NT 6.1; en-US; rv:1.9.1.6) Gecko/20091201 Firefox/3.5.6'}
req = urllib2.Request(url = 'http://topic.csdn.net/u/20110123/15/F71C5EBB-7704-480B-9379-17A96E920FEE.html',headers = headers)
feeddata = urllib2.urlopen(req).read()
#或者
#opener = urllib2.build_opener()
#feeddata = opener.open(request).read()
print feeddata.decode('u8')
#伪装浏览器头
headers = {'User-Agent':'Mozilla/5.0 (Windows; U; Windows NT 6.1; en-US; rv:1.9.1.6) Gecko/20091201 Firefox/3.5.6'}
req = urllib2.Request(url = 'http://topic.csdn.net/u/20110123/15/F71C5EBB-7704-480B-9379-17A96E920FEE.html',headers = headers)
feeddata = urllib2.urlopen(req).read()
#或者
#opener = urllib2.build_opener()
#feeddata = opener.open(request).read()
print feeddata.decode('u8')
热门话题 · · · · · · ( 去话题广场 )
- 我们为什么需要书店? 2.3万次浏览
- 解锁我的夏日旅行足迹地图 活动 60.9万次浏览
- 你有哪些保持精力充沛的方法? 5422次浏览
- 我喝过的好喝精酿 4.5万次浏览
- 淡人穿搭实录 新话题
- 当代打工人精神状态be like 新话题