1. ホーム
  2. python

[解決済み] urllib2.HTTPError: HTTP エラー 403: 禁制

2022-03-04 08:38:30

質問

Pythonを使用して、過去の株価データのダウンロードを自動化しようとしています。URLを開くとCSVファイルが返ってきますが、urllib2を使って開くことができません。私は以前のいくつかの質問で指定されたようにユーザーエージェントを変更しようとしました、私はさらに応答クッキーを受け入れようとしましたが、運がありませんでした。助けていただけませんか?

注:yahooファイナンスでも同じ方法で動作します。

コード

import urllib2,cookielib

site= "http://www.nseindia.com/live_market/dynaContent/live_watch/get_quote/getHistoricalData.jsp?symbol=JPASSOCIAT&fromDate=1-JAN-2012&toDate=1-AUG-2012&datePeriod=unselected&hiddDwnld=true"

hdr = {'User-Agent':'Mozilla/5.0'}

req = urllib2.Request(site,headers=hdr)

page = urllib2.urlopen(req)

エラー

ファイル "C:³³³³³.py", 行 527, in http_error_default raise HTTPError(req.get_full_url(), code, msg, hdrs, fp) urllib2.HTTPError.Get_url(), code, msg, hdrs, fp) urllib2.HTTPError: HTTP Error 403: Forbidden

ご協力ありがとうございました

解決方法は?

ヘッダを追加することで、データを取得することができました。

import urllib2,cookielib

site= "http://www.nseindia.com/live_market/dynaContent/live_watch/get_quote/getHistoricalData.jsp?symbol=JPASSOCIAT&fromDate=1-JAN-2012&toDate=1-AUG-2012&datePeriod=unselected&hiddDwnld=true"
hdr = {'User-Agent': 'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.11 (KHTML, like Gecko) Chrome/23.0.1271.64 Safari/537.11',
       'Accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,*/*;q=0.8',
       'Accept-Charset': 'ISO-8859-1,utf-8;q=0.7,*;q=0.3',
       'Accept-Encoding': 'none',
       'Accept-Language': 'en-US,en;q=0.8',
       'Connection': 'keep-alive'}

req = urllib2.Request(site, headers=hdr)

try:
    page = urllib2.urlopen(req)
except urllib2.HTTPError, e:
    print e.fp.read()

content = page.read()
print content

実は、このヘッダを1つ追加するだけで動作するのです。

'Accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,*/*;q=0.8',