#問 python爬蟲 json 爬取段落的方法

小弟我是python爬蟲的新手,最近在爬ig的json檔時遇到一些問題。
megapx
megapx
我看網路上的教學,目前自己的理解是說 items = doc('script[type="text/javascript"]').items() 這一行是抓取 script type="text/javascript" 這一段後面的資料, 然後if item.text().strip().startswith('window._sharedData'): 是在判斷檔案是否是以window._sharedData為開頭。 那我目前的問題是 1、items = doc('script[type="text/javascript"]').items() 最後的items()是做什麼用的? 2、if item.text().strip().startswith('window._sharedData'): 的判斷順序是text()>strip()>startswith() 這樣嗎?那item.text()是什麼意思? 3、 js_data = json.loads(item.text()[21:-1], encoding='utf-8')這行裡的 [21:-1]是什麼意思? 3、
megapx
我想爬取這段json的資料請問該怎麼寫? 目前我是寫這樣,但是抓不到資料....
megapx
請各位大大幫我解答了...
愛心
3
3
全部留言