文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

Python怎么实现快速保存微信公众号文章中的图片

2023-07-02 12:03

关注

本文小编为大家详细介绍“Python怎么实现快速保存微信公众号文章中的图片”,内容详细,步骤清晰,细节处理妥当,希望这篇“Python怎么实现快速保存微信公众号文章中的图片”文章能帮助大家解决疑惑,下面跟着小编的思路慢慢深入,一起来学习新知识吧。

一、实现效果(以槿泉壁纸为例)

Python怎么实现快速保存微信公众号文章中的图片

Python怎么实现快速保存微信公众号文章中的图片

Python怎么实现快速保存微信公众号文章中的图片

Python怎么实现快速保存微信公众号文章中的图片

二、实现过程

新建一个link文本,将需要下载的文章链接依次保存;

Python怎么实现快速保存微信公众号文章中的图片

新建一个.py文件,将下面的源码复制进去;

Python怎么实现快速保存微信公众号文章中的图片

新建一个pic文件夹,用来保存图片;

Python怎么实现快速保存微信公众号文章中的图片

运行即可;

三、源码

sound code

代码如下(示例):

import requestsfrom re import findallfrom bs4 import BeautifulSoupimport timeimport osimport sysweixin_title=""weixin_time=""#获取微信公众号内容,保存和时间def get_weixin_html(url):    global weixin_time,weixin_title    res=requests.get(url)    soup=BeautifulSoup(res.text,"html.parser")        #获取    temp=soup.find('h2')    weixin_title=temp.string.strip()        #使用正则表达式获取时间#    result=findall(r'[0-9]{4}-[0-9]{2}-[0-9]{2}.+:[0-9]{2}',res.text)    result=findall(r"(\d{4}-\d{1,2}-\d{1,2})",res.text)    weixin_time=result[0]        #获取正文html并修改    content=soup.find(id='js_content')    soup2=BeautifulSoup((str(content)),"html.parser")    soup2.div['style']='visibility: visible;'    html=str(soup2)    pattern=r'http[s]?:\/\/[a-z.A-Z_0-9\/\?=-_-]+'    result = findall(pattern, html)        #将data-src修改为src    for url in result:        html=html.replace('data-src="'+url+'"','src="'+url+'"')        return html#上传图片至服务器def download_pic(content):        pic_path= 'pic/' + str(path)+ '/'    if not os.path.exists(pic_path):        os.makedirs(pic_path)            #使用正则表达式查找所有需要下载的图片链接    pattern=r'http[s]?:\/\/[a-z.A-Z_0-9\/\?=-_-]+'    pic_list = findall(pattern, content)        for index, item in enumerate(pic_list,1):        count=1        flag=True        pic_url=str(item)                while flag and count<=10:            try:                 data=requests.get(pic_url);                    if pic_url.find('png')>0:                     file_name = str(index)+'.png'                                      elif pic_url.find('gif')>0:                     file_name=str(index)+'.gif'                                      else:                     file_name=str(index)+'.jpg'                 with open( pic_path + file_name,"wb") as f:                     f.write(data.content)                                      #将图片链接替换为本地链接                 content = content.replace(pic_url, pic_path + file_name)                                  flag = False                 print('已下载第' + str(index) +'张图片.')                 count += 1                 time.sleep(1)                                  except:                 count+=1                 time.sleep(1)                         if count>10:            print("下载出错:",pic_url)    return contentdef get_link(dir):    link = []    with open(dir,'r') as file_to_read:        while True:            line = file_to_read.readline()            if not line:                break            line = line.strip('\n')            link.append(line)    return linkpath = 'link.txt'linklist = get_link(path)print(linklist)s = len(linklist)        if __name__ == "__main__":        #获取html    input_flag=True    while input_flag:#        for j in range(0,s):#            pic = str(j)        j = 1        for i in linklist:            weixin_url = i              path = j            j += 1                 #weixin_url=input()            re=findall(r'http[s]?:\/\/mp.weixin.qq.com\/s\/[0-9a-zA-Z_]+',weixin_url)             if len(re)<=0:                    print("链接有误,请重新输入!")            else:                input_flag=False                        content=get_weixin_html(weixin_url)            content=download_pic(content)            #保存至本地            with open(weixin_title+'.txt','w+',encoding="utf-8") as f:                f.write(content)             with open(weixin_title+'.html','w+',encoding="utf-8") as f:                f.write(content)                              print()            print("《"+weixin_title+"》")            print("发布时间:"+weixin_time)

四、Python正则表达式匹配日期与时间

import refrom datetime import datetimetest_date = '小明的生日是2016-12-12 14:34,小张的生日是2016-12-21 11:34 .'test_datetime = '小明的生日是2016-12-12 14:34,.小晴的生日是2016-12-21 11:34,好可爱的.'# datemat = re.search(r"(\d{4}-\d{1,2}-\d{1,2})",test_date)print mat.groups()# ('2016-12-12',)print mat.group(0)# 2016-12-12date_all = re.findall(r"(\d{4}-\d{1,2}-\d{1,2})",test_date)for item in date_all:    print item# 2016-12-12# 2016-12-21# datetimemat = re.search(r"(\d{4}-\d{1,2}-\d{1,2}\s\d{1,2}:\d{1,2})",test_datetime)print mat.groups()# ('2016-12-12 14:34',)print mat.group(0)# 2016-12-12 14:34date_all = re.findall(r"(\d{4}-\d{1,2}-\d{1,2}\s\d{1,2}:\d{1,2})",test_datetime)for item in date_all:    print item# 2016-12-12 14:34# 2016-12-21 11:34## 有效时间# 如这样的日期2016-12-35也可以匹配到.测试如下.test_err_date = '如这样的日期2016-12-35也可以匹配到.测试如下.'print re.search(r"(\d{4}-\d{1,2}-\d{1,2})",test_err_date).group(0)# 2016-12-35# 可以加个判断def validate(date_text):    try:        if date_text != datetime.strptime(date_text, "%Y-%m-%d").strftime('%Y-%m-%d'):            raise ValueError        return True    except ValueError:        # raise ValueError("错误是日期格式或日期,格式是年-月-日")        return Falseprint validate(re.search(r"(\d{4}-\d{1,2}-\d{1,2})",test_err_date).group(0))# false# 其他格式匹配. 如2016-12-24与2016/12/24的日期格式.date_reg_exp = re.compile('\d{4}[-/]\d{2}[-/]\d{2}')test_str= """     平安夜圣诞节2016-12-24的日子与去年2015/12/24的是有不同哦.     """# 根据正则查找所有日期并返回matches_list=date_reg_exp.findall(test_str)# 列出并打印匹配的日期for match in matches_list:  print match# 2016-12-24# 2015/12/24

读到这里,这篇“Python怎么实现快速保存微信公众号文章中的图片”文章已经介绍完毕,想要掌握这篇文章的知识点还需要大家自己动手实践使用过才能领会,如果想了解更多相关内容的文章,欢迎关注编程网行业资讯频道。

阅读原文内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     813人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     354人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     318人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     435人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     224人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-后端开发
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯