文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

使用Python怎么爬取淘宝的商品信息

2023-06-14 15:35

关注

这期内容当中小编将会给大家带来有关使用Python怎么爬取淘宝的商品信息,文章内容丰富且以专业的角度为大家分析和叙述,阅读完这篇文章希望大家可以有所收获。

python有哪些常用库

python常用的库:1.requesuts;2.scrapy;3.pillow;4.twisted;5.numpy;6.matplotlib;7.pygama;8.ipyhton等。

1、导入需要的包

import timefrom bs4 import BeautifulSoupfrom selenium import webdriver

2、编辑淘宝数据抓取的函数逻辑

   # 编辑淘宝数据抓取的函数逻辑    """    1.登录淘宝    2.首页    3.指定商品的搜索信息    4.提取指定商品的金额、购买人数、商铺地址、商品名称、商品图片    """

3、打开淘宝网页,并扫码登陆点击淘宝网首页

    def login_info(self):        # 1.打开网页        self.browser.get(self.url)        # 2.通过扫码的形式去登录淘宝账号        if self.browser.find_element_by_xpath('//*[@id="login"]/div[1]/i'):            self.browser.find_element_by_xpath('//*[@id="login"]/div[1]/i').click()        # 让程序等待休眠5秒,通过手机扫码登录        time.sleep(8)        # 3.点击淘宝网首页        taobao_index = self.browser.find_element_by_xpath('//*[@id="J_SiteNavHome"]/div/a')        taobao_index.click()        time.sleep(1)

4、自动的在淘宝首页中输入自己想要搜索的商品名称,并且自动点击搜索

        search_input = self.browser.find_element_by_xpath('//*[@id="q"]')        shop_name = input("请输入你想搜索的商品名称:")        search_input.send_keys(shop_name)        time.sleep(0.5)        search_submit = self.browser.find_element_by_xpath('//*[@id="J_TSearchForm"]/div[1]/button')        search_submit.click()

5、获取商品信息

 # 商品金额                shop_price_data = shop_data.find_all('div', class_='price g_price g_price-highlight')                for shop_price in shop_price_data:                    shop_price_list.append(shop_price.text.strip())                # 购买人数                shop_people_number_data = shop_data.find_all('div','deal-cnt')                for shop_people_number in shop_people_number_data:                    shop_people_list.append(shop_people_number.text)                # 店铺地区                shop_location_data = shop_data.find_all('div','location')                for shop_location in shop_location_data:                    shop_location_list.append(shop_location.text)

上述就是小编为大家分享的使用Python怎么爬取淘宝的商品信息了,如果刚好有类似的疑惑,不妨参照上述分析进行理解。如果想知道更多相关知识,欢迎关注编程网行业资讯频道。

阅读原文内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     807人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     351人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     314人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     433人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     221人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-后端开发
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯