python - 关于scrapy爬虫AJAX页面

Question

问题：爬取信息页面为：知乎话题广场 当点击加载的时候，用Chrome 开发者工具，可以看到Network中，实际请求的链接为：FormData为：urlencode： 然后我的代码为： {代码...} 执行爬虫之后，返回的是： {代码...} ...

伊谢尔伦 · Answer

DEBUG: Retrying

伊谢尔伦 · Answer

写爬虫应该一步一步来，不能一步到位，不然哪里错了都不知道，一般是先获取到你要的数据，然后再去解析过滤。
你先发送请求看看能不能获取到你想要的数据，如果没有，可能是url不对或者被拦截了

大家讲道理 · Answer

#coding=utf-8

import requests

headers = {'Content-Type':'application/x-www-form-urlencoded; charset=UTF-8'}
url = 'https://www.zhihu.com/node/TopicsPlazzaListV2'
data = 'method=next¶ms=%7B%22topic_id%22%3A833%2C%22offset%22%3A0%2C%22hash_id%22%3A%22%22%7D'

r = requests.post(url, data, headers=headers)
print r.text

PHP中文网 · Answer

少年教你一个大招。