侯体宗的博客
  • 首页
  • Hyperf版
  • beego仿版
  • 人生(杂谈)
  • 技术
  • 关于我
  • 更多分类
    • 文件下载
    • 文字修仙
    • 中国象棋ai
    • 群聊
    • 九宫格抽奖
    • 拼图
    • 消消乐
    • 相册

基于Python实现船舶的MMSI的获取(推荐)

Python  /  管理员 发布于 7年前   292

目的

工作中遇到一个需求,通过需要通过网站查询船舶名称得到MMSI码,网站来自船讯网。

分析请求

根据以往爬虫的经验,打开F12,通过输入船舶名称,观察发送的请求,发现返回数据的网址

本身网址是一个get请求,直接用这个网址请求,也能返回数据,即网址本身并没有加密,这就简单许多,直接通过改变参数,就能实现数据的获取,马上开始动手

编写代码

代码中,通过request发送请求,为了不给服务器造成太大压力,每隔0.5秒发送一个请求,因为会出现查询不到的情况,通过exception判断,数据结果一是通过pandas中的to_excel存为excel文件,或者是直接通过pymysql入数据库,为了提高入库的速度,采用一次拼接三百条的方式入库

import requestsimport osimport timeimport pymysqlimport pandas as pdimport re'''author:shikailiangfunction:通过读取船舶数据,分别请求拿到json数据入库'''#定义入库的类class company_ship_in_database:  def __init__(self):    self.conn = pymysql.connect(host="192.168.1.222", user="root", password="Cjh#Sjzx@", database="test", charset="utf8")    self.cursor = self.conn.cursor()    #获取当前文件的父级地址    self.last_path = os.path.abspath(os.path.dirname(os.getcwd()))  #写入mysql  def in_database(self,data_list):  #j用来对数据进行计数    j=1    #定义sql    sql = ""    #定义sql头    sql0 = "insert into bms_company_ship_test(oc_name,ship_name,mmsi) values"    rowcount=len(data_list)    for i in data_list:    #定义拼接sql      sql2 = (("(" + "'{}'," * 3)[:-1] + ")").format(i[1][0],i[1][1],i[0])      sql = sql + "," + sql2      # print(sql0 + sql[1:])      if divmod(j, 300)[1] == 0 or j == rowcount:        #如果执行错误回滚当前事务        # print(sql0 + sql[1:])        try:          self.cursor.execute(sql0 + sql[1:])        except:        #执行错误,回滚事务          self.conn.rollback()          continue        sql= ""      self.conn.commit()      j=j+1  #通过pandas写入excel  def in_xls(self, data_list):    df=pd.DataFrame(data_list)    #通过pandas实现存为excel    df.to_excel(self.last_path + r"\data\result.xls",header=False,index=False)  #请求船的方法  def company_ship_in_database(self):    data_path = self.last_path + r"\data"    file=open(data_path + "\company.txt")    data=[]    j = 0    for i in file.readlines():    #将船公司和船舶名称分开      chuan=i.strip().split()      dic={      'f':'auto',      'kw':chuan[1]      }      rq=requests.get("http://searchv3.shipxy.com/shipdata/search3.ashx",params=dic)      #判断是否请求成功      if rq.status_code==200:        try:          result_json=rq.json()          result=result_json['ship'][0]          #判断船舶数字部分是否相同          if re.search('\d+',result['n']).group()==re.search('\d+',chuan[1]).group():result=result['m']data.append([result,chuan])          else:data.append(["", chuan])        except:          data.append(["",chuan])      else:        print(chuan + "请求错误")      time.sleep(0.5)      j = j + 1      if divmod(j,100)[1] == 0:        print("已经请求" + str(j) + "条")      # if j > 10:      #  self.in_xls(data)        # break    self.in_database(data)if __name__=="__main__":  company_ship=company_ship_in_database()  company_ship.company_ship_in_database()

尾记

写程序的过程中其实有发现一个问题,即我们请求的其实是输入文字时候自动发送的请求,其实有一个问题,如果我们需要查询的是"华为5"的船,但是如果系统中没有这个船,就是返回"华为548"Y船,所以在代码中需要做一个判断

 

即用正则提取出船的数字,然后和返回的船的数字进行比对,如果一致,即为同一条船舶

总结

以上所述是小编给大家介绍的基于Python实现船舶的MMSI的获取,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对站的支持!
如果你觉得本文对你有帮助,欢迎转载,烦请注明出处,谢谢!


  • 上一条:
    Python实现字符串中某个字母的替代功能
    下一条:
    基于Python解密仿射密码
  • 昵称:

    邮箱:

    0条评论 (评论内容有缓存机制,请悉知!)
    最新最热
    • 分类目录
    • 人生(杂谈)
    • 技术
    • linux
    • Java
    • php
    • 框架(架构)
    • 前端
    • ThinkPHP
    • 数据库
    • 微信(小程序)
    • Laravel
    • Redis
    • Docker
    • Go
    • swoole
    • Windows
    • Python
    • 苹果(mac/ios)
    • 相关文章
    • 在python语言中Flask框架的学习及简单功能示例(0个评论)
    • 在Python语言中实现GUI全屏倒计时代码示例(0个评论)
    • Python + zipfile库实现zip文件解压自动化脚本示例(0个评论)
    • python爬虫BeautifulSoup快速抓取网站图片(1个评论)
    • vscode 配置 python3开发环境的方法(0个评论)
    • 近期文章
    • 在go语言中使用api.geonames.org接口实现根据国际邮政编码获取地址信息功能(1个评论)
    • 在go语言中使用github.com/signintech/gopdf实现生成pdf分页文件功能(0个评论)
    • gmail发邮件报错:534 5.7.9 Application-specific password required...解决方案(0个评论)
    • 欧盟关于强迫劳动的规定的官方举报渠道及官方举报网站(0个评论)
    • 在go语言中使用github.com/signintech/gopdf实现生成pdf文件功能(0个评论)
    • Laravel从Accel获得5700万美元A轮融资(0个评论)
    • 在go + gin中gorm实现指定搜索/区间搜索分页列表功能接口实例(0个评论)
    • 在go语言中实现IP/CIDR的ip和netmask互转及IP段形式互转及ip是否存在IP/CIDR(0个评论)
    • PHP 8.4 Alpha 1现已发布!(0个评论)
    • Laravel 11.15版本发布 - Eloquent Builder中添加的泛型(0个评论)
    • 近期评论
    • 122 在

      学历:一种延缓就业设计,生活需求下的权衡之选中评论 工作几年后,报名考研了,到现在还没认真学习备考,迷茫中。作为一名北漂互联网打工人..
    • 123 在

      Clash for Windows作者删库跑路了,github已404中评论 按理说只要你在国内,所有的流量进出都在监控范围内,不管你怎么隐藏也没用,想搞你分..
    • 原梓番博客 在

      在Laravel框架中使用模型Model分表最简单的方法中评论 好久好久都没看友情链接申请了,今天刚看,已经添加。..
    • 博主 在

      佛跳墙vpn软件不会用?上不了网?佛跳墙vpn常见问题以及解决办法中评论 @1111老铁这个不行了,可以看看近期评论的其他文章..
    • 1111 在

      佛跳墙vpn软件不会用?上不了网?佛跳墙vpn常见问题以及解决办法中评论 网站不能打开,博主百忙中能否发个APP下载链接,佛跳墙或极光..
    • 2016-10
    • 2016-11
    • 2018-04
    • 2020-03
    • 2020-04
    • 2020-05
    • 2020-06
    • 2022-01
    • 2023-07
    • 2023-10
    Top

    Copyright·© 2019 侯体宗版权所有· 粤ICP备20027696号 PHP交流群

    侯体宗的博客