文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

手把手教你用Python替代Mapinfo更快查找两张表中距离最近的点

2024-12-03 09:02

关注

二、项目目标

用Python实现两张表间最近点的计算。

三、项目准备

软件:PyCharm

需要的库:pandas, xlrd,os

四、项目分析

1)如何选择并读取要处理的Excel文件?

利用os、xlrd,选择要读取处理的Excel文件。

2)如何计算两个经纬度点的距离?

利用pandas库读取两张表的内容,再定义函数计算两个经纬度点的距离。

3)如何循环计算并保存最近一个点的数据?

利用For循环,对两张表的内容进行循环读取,通过If判断保留最近的距离点数据。

4)如何保存结果?

利用to_excel保存,得到最近点的数据。

五、项目实现

1、第一步导入需要的库

  1. import pandas as pd 
  2. import xlrd 
  3. import os 

2、第二步选择并读取要处理的Excel文件

  1. path="D:/a/" 
  2.    #获取文件夹下所有EXCEL名 
  3.    bb = path + 'result.xlsx' 
  4.    writer = pd.ExcelWriter(bb,engine='openpyxl'
  5.    xlsx_names = [x for x in os.listdir(path) if x.endswith(".xlsx")] 
  6.    # 获取第一个EXCEL名 
  7.    xlsx_names1 = xlsx_names[0] 
  8.    aa = path + xlsx_names1 
  9.    #打开第一个EXCEL 
  10.    first_file_fh=xlrd.open_workbook(aa) 
  11.    # 获取SHEET名 
  12.    first_file_sheet=first_file_fh.sheets() 

3、第三步循环计算并保存最近一个点的数据

  1. for i in range(h1): 
  2.      w1=df1.loc[i,'纬度'
  3.      j1 = df1.loc[i,'经度'
  4.      d1 = df1.loc[i, :] 
  5.      d0=10000000000000000000000000.0000 
  6.      print("原小区第%d个。" %(i+1)) 
  7.      test_dict = {'距离': [d0]} 
  8.      d3 = pd.DataFrame(test_dict) 
  9.  
  10.      for l in range(h2): 
  11.          w2=df2.loc[l, '纬度'
  12.          j2=df2.loc[l,'经度'
  13.          d=haversine(j1, w1, j2, w2) 
  14.          if d
  15.              d0=d 
  16.              d2 = df2.loc[l, :] 
  17.              test_dict = {'距离': [d0]} 
  18.              d3 = pd.DataFrame(test_dict) 
  19.          else:continue 

4、第四步保存计算后的文件

  1. resultdata1.to_excel(excel_writer=writer, sheet_name='原小区', encoding="utf-8"index=False
  2. resultdata2.to_excel(excel_writer=writer, sheet_name='最近小区', encoding="utf-8"index=False
  3. resultdata3.to_excel(excel_writer=writer, sheet_name='距离', encoding="utf-8"index=False
  4. writer.save() 
  5. writer.close() 

六、效果展示

处理前数据:

2、处理进度显示:

3、处理结果:

七、总结

本文介绍了如何利用Python计算两个经纬度点间的距离,并在两张表间进行最近点计算,这本来是Mapinfo的分内之事,但数据量大时就处理不动了,Python处理速度快,还能对数据进行预处理,正是由于可以自己优化代码,可以无限提高运行速度,比如数据切块处理,有兴趣的同学可以进一步研究下。

 

来源: Python爬虫与数据挖掘内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     813人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     354人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     318人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     435人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     224人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-后端开发
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯