金狮镖局 Design By www.egabc.com
之前想爬取一些淘宝的数据,后来发现需要登录,找了很多的资料,有个使用request的sessions加上cookie来登录的,cookie的获取在登录后使用开发者工具可以找到。不过这个登录后获得的网页的代码是静态的,获取动态网页还得另寻他法,一般需要的数据可以在网页的源码中得到,但是你知道的,有些动态加载的就不是那么简单了,而且我发现这样获得的源码中,有些想要获取的数据的格式是经过改动的,比如我要某个商品的具体链接,发现并不能直接使用。 总体而言,这是一次失败的尝试,不过倒是了解到使用sessions
和cookies
可以进到需要登录的网页,也算是一种方式吧。
记录一下失败的一次
import requests import os import json from pyquery import PyQuery as pq import re import time sessions = requests.session() url = 'https://s.taobao.com/search"risk"') garbage=re.compile(r'itemlist(.*"risk"') gb=garbage.findall(doc,re.S|re.M) finhtml=htmls.findall(doc,re.S|re.M) finhtml=finhtml+gb print(len(finhtml)) #提取信息的正则表达式 raw_title=r'"raw_title":"(.*"' view_price= r'"view_price":"(.*"' #价格 view_fee=r'"view_fee":"(.*"' #折扣 item_loc = r'"item_loc":"(.*"' #地区 view_sales = r'"view_sales":"(.*"' #付款人数 comment_count = r'"comment_count":"(.*"' #评论数 detail_url=r'"detail_url":"(.*"' #url for html in finhtml: rtitle=re.findall(raw_title,html) price=re.findall(view_price,html) fee=re.findall(view_fee,html) loc=re.findall(item_loc,html) sales= re.findall(view_sales,html) comment=re.findall(comment_count,html) deurl=re.findall(detail_url,html) for rt,p,f,l,s,c,u in zip(rtitle,price,fee,loc,sales,comment,deurl): contentss.append({"raw_title":rt,"view_price":p,"view_fee":f,"item_loc":l,"view_sales":s,"comment_count":c,"detail_url":u}) with open('ipad.json','a',encoding='utf-8') as file: file.write(json.dumps(contentss,indent=2,ensure_ascii=False)) time.sleep(2)#访问间隔
总结
以上所述是小编给大家介绍的python使用sessions模拟登录淘宝,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对网站的支持!
如果你觉得本文对你有帮助,欢迎转载,烦请注明出处,谢谢!
金狮镖局 Design By www.egabc.com
金狮镖局
免责声明:本站文章均来自网站采集或用户投稿,网站不提供任何软件下载或自行开发的软件!
如有用户或公司发现本站内容信息存在侵权行为,请邮件告知! 858582#qq.com
金狮镖局 Design By www.egabc.com
暂无python使用sessions模拟登录淘宝的方式的评论...
稳了!魔兽国服回归的3条重磅消息!官宣时间再确认!
昨天有一位朋友在大神群里分享,自己亚服账号被封号之后居然弹出了国服的封号信息对话框。
这里面让他访问的是一个国服的战网网址,com.cn和后面的zh都非常明白地表明这就是国服战网。
而他在复制这个网址并且进行登录之后,确实是网易的网址,也就是我们熟悉的停服之后国服发布的暴雪游戏产品运营到期开放退款的说明。这是一件比较奇怪的事情,因为以前都没有出现这样的情况,现在突然提示跳转到国服战网的网址,是不是说明了简体中文客户端已经开始进行更新了呢?
更新日志
2024年09月24日
2024年09月24日
- 张惠妹《ThePowerOfA-Mei》2018[SACD/ISO]
- 陈珊妮.2013-低调人生2CD【和气音乐】【WAV+CUE】
- 群星.2000-超级BAND.BAND.BAND【滚石】【WAV+CUE】
- 许志安.2002-On.Show演唱会2CD(2024环球红馆40复刻系列)【环球】【WAV+CUE】
- 蔡琴-哈利路亚2016[SACD/ISO]
- 陈随意2011-今生只为你[豪记][WAV+CUE]
- 陈随意2008-爱的总铺师[美华][WAV+CUE]
- 裘德《一棵树所创造的》[320K/MP3][56.21MB]
- 裘德《一棵树所创造的》[24bit 48kHz][FLAC/分轨][355.1MB]
- 卓依娜姆《美人谋 网剧影视原声带》[320K/MP3][48.29MB]
- 张星特.2024-流绪呢喃【中视鸣达】【FLAC分轨】
- 邓紫棋.2010-MYSECRET【蜂鸟音乐】【WAV+CUE】
- 江惠仪.2011-感謝您【禾广娱乐】【FLAC分轨】
- 韩红2005-精选[首版][WAV+CUE]
- 张敬轩.2004-A.M/P.M【几何文化】【WAV+CUE】