callback回调函数--python_Scrapy回调函数callback传递参数的方式

Scrapy回调函数

回调方法示例:

yield Request(url=self.base_url + 'QueryInfo', headers=self.request_headers, method="POST", body=json.dumps(request_params), callback=self.page_query_schools, cb_kwargs=add_params)

callback对应的是page_query_school()即为回调的方法。

传递参数方式

如何向回调方法中传递参数呢?

在scrapy1.7之后,是基于cb_kwargs方式传递dict类型,可以在回调方式中直接访问对应的参数值。

add_params = {}

add_params['province_code'] = province_code

add_params['province_name'] = name

yield Request(url=self.base_url + 'QueryInfo', headers=self.request_headers, method="POST", body=json.dumps(request_params), callback=self.page_query_schools, cb_kwargs=add_params)

def page_query_schools(self, response, province_code, province_name):

# logic definition

从上述方法中可知, add_params初始化为dict, 放入province_code/province_name两个值。在page_query_schools()方法中,其中的key值直接以参数传入方法: province_code/province_name.

注意事项

错误的用法:

add_params = {}

add_params['data_item']['province_code'] = province_code

add_params['data_item']['province_name'] = name

yield Request(url=self.base_url + 'QueryInfo', headers=self.request_headers, method="POST", body=json.dumps(request_params), callback=self.page_query_schools, cb_kwargs=dict(data_hsh=add_params))

def page_query_schools(self, response, data_hsh):

# logic definition

这种用法的错误是: data_hsh传递是引用,在循环访问中,data_hsh是指向相同的结果值,造成变量的引用有误,与预期不符。

正确的做法: cb_kwargs传递直接变量属性值,不要使用复杂的数据结构,可以做到不同的属性值

原文链接:https://blog.csdn.net/blueheart20/article/details/108352214

  • 1
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值