python导出hive数据表的schema实例代码

更新时间：2018年01月22日 11:43:44 作者：kwsy2008

这篇文章主要介绍了python导出hive数据表的schema实例代码，小编觉得还是挺不错的，具有一定借鉴价值，需要的朋友可以参考下

本文研究的主要问题是python语言导出hive数据表的schema，分享了实现代码，具体如下。

为了避免运营提出无穷无尽的查询需求，我们决定将有查询价值的数据从mysql导入hive中，让他们使用HUE这个开源工具进行查询。想必他们对表结构不甚了解，还需要为之提供一个表结构说明，于是编写了一个脚本，从hive数据库中将每张表的字段即类型查询出来，代码如下：

#coding=utf-8 
import pyhs2 
from xlwt import * 
 
hiveconn = pyhs2.connect(host='10.46.77.120', 
         port=10000, 
         authMechanism='PLAIN', 
         user='hadoop', 
         database='hibiscus_data', 
         ) 
 
def create_excel(): 
  sql = 'show tables' 
  tables = [] 
  with hiveconn.cursor() as cursor: 
    cursor.execute(sql) 
    res = cursor.fetch() 
    for table in res: 
      tables.append(table[0]) 
   
  tableinfo = [] 
  for table in tables: 
    tableinfo.append(get_column_info(table)) 
 
  create_excel_ex(tableinfo) 
 
def create_excel_ex(tableinfo): 
  w = Workbook() 
  sheet = w.add_sheet(u'表结构') 
  row = 0 
  for info in tableinfo: 
    row = write_tale_info(info,sheet,row) 
  w.save('hive_schema.xls') 
 
def write_tale_info(tableinfo,sheet,row): 
  print row 
  sheet.write_merge(row,row,0,2,tableinfo['table']) 
   
  row += 1 
  sheet.write(row,0,u'名称') 
  sheet.write(row,1,u'类型') 
  sheet.write(row,2,u'解释') 
  row += 1 
 
  fields = tableinfo['fields'] 
  for field in fields: 
    sheet.write(row,0,field['name']) 
    sheet.write(row,1,field['type']) 
    row += 1 
 
  return row + 1  
   
   
def get_column_info(table): 
  sql = 'desc {table}'.format(table=table) 
  info = {'table':table,'fields':[]} 
  with hiveconn.cursor() as cursor: 
    cursor.execute(sql) 
    res = cursor.fetch() 
    for item in res: 
      if item[0] == '': 
        break 
      info['fields'].append({'name':item[0],'type':item[1]}) 
 
  return info 
 
if __name__ == '__main__': 
  create_excel()

其实，我们的hive数据库将所有的元数据存储在了mysql当中，分析这些元数据也可以获得表结构信息。

总结

以上就是本文关于python导出hive数据表的schema实例代码的全部内容，希望对大家有所帮助。感兴趣的朋友可以继续参阅本站其他相关专题，如有不足之处，欢迎留言指出。感谢朋友们对本站的支持！

您可能感兴趣的文章:

利用python将json数据转换为csv格式的方法
下面小编就为大家分享一篇利用python将json数据转换为csv格式的方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2018-03-03
修改Pandas的行或列的名字(重命名)
这篇文章主要介绍了修改Pandas的行或列的名字(重命名)，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2019-12-12
python3实现的zip格式压缩文件夹操作示例
这篇文章主要介绍了python3实现的zip格式压缩文件夹操作,结合实例形式分析了Python3基于zipfile模块实现zip格式文件压缩的相关操作技巧,需要的朋友可以参考下
2019-08-08
python实现人机对战的井字棋游戏
这篇文章主要为大家详细介绍了python实现人机对战的井字棋游戏，文中示例代码介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们可以参考一下
2022-04-04
关于Pycharm配置翻译插件Translation报错更新TTK失败不能使用的问题
这篇文章主要介绍了关于Pycharm配置翻译插件Translation报错更新TTK失败不能使用的问题,本文通过图文并茂的形式给大家分享解决方案，需要的朋友可以参考下
2022-04-04
举例讲解Python编程中对线程锁的使用
Python的threading模块中提供了多种锁的相关方法,Python的多线程不能同时执行,因而锁的使用非常关键,下面我们就来举例讲解Python编程中对线程锁的使用:
2016-07-07
python process模块的使用简介
在python中大部分情况需要使用多进程，python提供了multiprocessing模块。multiprocessing模块的功能众多：支持子进程、通信和共享数据、执行不同形式的同步，提供了Process、Queue、Pipe、Lock等组件。本文将着重讲解process模块的使用
2021-05-05
使用Python快速打开一个百万行级别的超大Excel文件的方法
这篇文章主要介绍了使用Python快速打开一个百万行级别的超大Excel文件的方法,本文通过实例代码给大家介绍的非常想详细，对大家的学习或工作具有一定的参考借鉴价值，需要的朋友可以参考下
2021-03-03
python中count函数知识点浅析
在本篇文章里小编给大家整理了一篇关于python中count函数知识点浅析内容，有兴趣的朋友们可以学习下。
2020-12-12
python取数作为临时极大值(极小值)的方法
今天小编就为大家分享一篇python取数作为临时极大值(极小值)的方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2018-10-10

python导出hive数据表的schema实例代码

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具