当前位置: 首页 > news >正文

企业智能网站后台管理系统网络工程就业前景

企业智能网站后台管理系统,网络工程就业前景,wordpress 边栏修改,网站建设项目申报书注意#xff1a;模拟登陆时#xff0c;必须保证settings.py里的 COOKIES_ENABLED (Cookies中间件) 处于开启状态 COOKIES_ENABLED True 或 # COOKIES_ENABLED False 策略一#xff1a;直接POST数据#xff08;比如需要登陆的账户信息) 只要是需要提供post数据的#xff…注意模拟登陆时必须保证settings.py里的 COOKIES_ENABLED (Cookies中间件) 处于开启状态 COOKIES_ENABLED True 或 # COOKIES_ENABLED False 策略一直接POST数据比如需要登陆的账户信息) 只要是需要提供post数据的就可以用这种方法。下面示例里post的数据是账户密码 # -*- coding: utf-8 -*- import scrapyclass Renren1Spider(scrapy.Spider):name renren1allowed_domains [renren.com]def start_requests(self):url http://www.renren.com/PLogin.do# FormRequest 是Scrapy发送POST请求的方法yield scrapy.FormRequest(url url,formdata {email : mr_mao_hacker163.com, password : axxxxxxxe},callback self.parse_page)def parse_page(self, response):with open(mao2.html, w) as filename:filename.write(response.body)策略二标准的模拟登陆步骤 正统模拟登录方法 首先发送登录页面的get请求获取到页面里的登录必须的参数比如说zhihu登陆界面的 _xsrf 然后和账户密码一起post到服务器登录成功 # -*- coding: utf-8 -*- import scrapyclass Renren2Spider(scrapy.Spider):name renren2allowed_domains [renren.com]start_urls (http://www.renren.com/PLogin.do,)# 处理start_urls里的登录url的响应内容提取登陆需要的参数如果需要的话)def parse(self, response):# 提取登陆需要的参数#_xsrf response.xpath(//_xsrf).extract()[0]# 发送请求参数并调用指定回调函数处理yield scrapy.FormRequest.from_response(response,formdata {email : mr_mao_hacker163.com, password : axxxxxxxe},#, _xsrf _xsrf},callback self.parse_page)# 获取登录成功状态访问需要登录后才能访问的页面def parse_page(self, response):url http://www.renren.com/422167102/profileyield scrapy.Request(url, callback self.parse_newpage)# 处理响应内容def parse_newpage(self, response):with open(xiao.html, w) as filename:filename.write(response.body)策略三直接使用保存登陆状态的Cookie模拟登陆 如果实在没办法了可以用这种方法模拟登录虽然麻烦一点但是成功率100% # -*- coding: utf-8 -*- import scrapyclass RenrenSpider(scrapy.Spider):name renrenallowed_domains [renren.com]start_urls (http://www.renren.com/111111,http://www.renren.com/222222,http://www.renren.com/333333,)cookies {anonymid : ixrna3fysufnwv,_r01_ : 1,ap : 327550029,JSESSIONID : abciwg61A_RvtaRS3GjOv,depovince : GW,springskin : set,jebe_key : f6fb270b-d06d-42e6-8b53-e67c3156aa7e%7Cc13c37f53bca9e1e7132d4b58ce00fa3%7C1484060607478%7C1%7C1486198628950,t : 691808127750a83d33704a565d8340ae9,societyguester : 691808127750a83d33704a565d8340ae9,id : 327550029,xnsid : f42b25cf,loginfrom : syshome}# 可以重写Spider类的start_requests方法附带Cookie值发送POST请求def start_requests(self):for url in self.start_urls:yield scrapy.FormRequest(url, cookies self.cookies, callback self.parse_page)# 处理响应内容def parse_page(self, response):print response.urlwith open(deng.html, w) as filename:filename.write(response.body)
http://www.hkea.cn/news/14588846/

相关文章:

  • html网站开发图片素材团关系转接网站建设
  • 网站推广 经典案例网站的模板怎么做
  • 现在建网站还能赚钱吗没有域名可以先做网站吗
  • 上海市建设工程安全质量监督总站网站建设刷单网站
  • 微信视频网站怎么做的好wordpress前台文章增加编辑器
  • 丰功网站建设电商运营培训大概多少学费
  • 潍坊最早做网站的公司不备案的网站的稳定吗
  • 网站内链布局wordpress google联盟
  • thinkphp做双语网站互联网保险现状
  • 唐山的做网站的企业wordpress建站 云打印
  • 酒店类网站开发的策略黄页网大全免费软件
  • 界面设计好看的网站嘉兴网站seo公司
  • 宣武网站建设服务咨询类网站建设方案书
  • 驾校门户网站模板做网站订金是多少钱
  • 柳州网站建设工作室wordpress插件手机
  • 新媒体营销心得体会seod的中文意思
  • 开网站需要钱吗淄川响应式网站建设
  • 黑白灰 网站wordpress要求
  • 深圳分销网站设计公司域名邮箱如何注册
  • 群晖的网站开发服装公司网站建设方案
  • 从事网站开发需要的证书宜春房产网
  • 网站建设中广告法绝对化用语整理电商网站设计公司力荐亿企邦
  • 乐清网站开发学校网站建设工作内容
  • 重庆多功能网站建设镇江网页设计培训
  • wordpress搭建的知名网站高端娱乐网站建设
  • 凉山州城乡规划建设局网站网络推广公司代理
  • 扬州西区网站建设网站建设 上海
  • 个人网站备案号被注销了网站首页设计代码
  • 红河州建设局网站网站做的图上传后字变得很模糊
  • 西安网站建设 早晨凡科网站备案