首页软件开发代码讲解 Python 正文

我要投稿

python 爬取免费简历模板网站的示例

自学编程网 Python

2020-10-10 0 153

代码

# 免费的简历模板进行爬取本地保存 
# http://sc.chinaz.com/jianli/free.html
# http://sc.chinaz.com/jianli/free_2.html

import requests
from lxml import etree
import os

dirName = \'./resumeLibs\'
if not os.path.exists(dirName):
  os.mkdir(dirName)

headers = {
  \'User-Agent\':\'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/85.0.4183.83 Safari/537.36\'
}
url = \'http://sc.chinaz.com/jianli/free_%d.html\'
for page in range(1,2):
  if page == 1:
    new_url = \'http://sc.chinaz.com/jianli/free.html\'
  else:
    new_url = format(url%page)
  page_text = requests.get(url=new_url,headers=headers).text
  tree = etree.HTML(page_text)
  a_list = tree.xpath(\'//div[@id=\"container\"]/div/p/a\')
  
  for a in a_list:
    a_src = a.xpath(\'./@href\')[0]
    a_title = a.xpath(\'./text()\')[0]
    a_title = a_title.encode(\'iso-8859-1\').decode(\'utf-8\')
    # 爬取下载页面
    page_text = requests.get(url=a_src,headers=headers).text
    tree = etree.HTML(page_text)
    dl_src = tree.xpath(\'//div[@id=\"down\"]/div[2]/ul/li[8]/a/@href\')[0]
    
    resume_data = requests.get(url=dl_src,headers=headers).content
    resume_name = a_title
    resume_path = dirName + \'/\' + resume_name + \'.rar\'
    with open(resume_path,\'wb\') as fp:
      fp.write(resume_data)
      print(resume_name,\'下载成功!\')

爬取结果

python 爬取免费简历模板网站的示例

python 爬取免费简历模板网站的示例

以上就是python 爬取免费简历模板网站的示例的详细内容，更多关于python 爬取网站的资料请关注自学编程网其它相关文章！

收藏 (0) 点赞 (0)

遇见资源网 Python python 爬取免费简历模板网站的示例 http://www.ox520.com/27228.html

Python 爬取免费简历模板网站爬取网站爬虫

自学编程网

上一篇： python中Django文件上传方法详解

下一篇： Python confluent kafka客户端配置kerberos认证流程详解

常见问题

相关文章

python利用socket实现udp文件传输功能

python利用socket实现udp文件传输功能

Python

自学编程网

2年前 362

Python实现批量压缩文件/文件夹zipfile的使用

Python实现批量压缩文件/文件夹zipfile的使用

Python

自学编程网

2年前 577

python实现TCP文件接收发送

python实现TCP文件接收发送

Python

自学编程网

2年前 752

Python使用turtle模块绘制爱心图案

Python使用turtle模块绘制爱心图案

Python

自学编程网

2年前 423

猜你喜欢

python利用socket实现udp文件传输功能 2023-01-31
Python实现批量压缩文件/文件夹zipfile的使用 2023-01-31
python实现TCP文件接收发送 2023-01-31
Python使用turtle模块绘制爱心图案 2023-01-13
浅谈Python的字典键名可以是哪些类型 2023-01-13
Python日期时间模块arrow的具体使用 2023-01-13
python利用Appium实现自动控制移动设备并提取数据功能 2023-01-13
python用folium绘制地图并设置弹窗效果 2023-01-13
Python 面向对象编程的三大特性之继承 2023-01-13
利用Python快速绘制海报地图 2023-01-13

发表评论

暂无评论

官方客服团队

为您解决烦忧 - 24小时在线专业服务

联系官方团队在线提交工单

自学编程网

QQ 微信

微博

9875
文章
5,772,774
浏览
0
收藏
0
评论
30812
标签
19
分类

进主页

TA的动态

2023-03-16 一篇文章带你了解如何正确使用java线程池
2023-03-16 JAVA jvm系列--java内存区域
2023-03-16 JAVA代码块你了解吗
2023-03-16 超详细讲解Java线程池
2023-03-16 java Long类型转为String类型的两种方式及区别说明

总裁主题

分享最新WordPress教程共同学习，共同进步，共同成长！

热门文章

热门评论

如遇问题，请联系客服
联系客服请注明来意高端主题开发
微信公众号

总裁主题·高端主题
返回顶部