当前位置：移动技术网 > IT编程>脚本编程>Python > python hbase读取数据发送kafka的方法

python hbase读取数据发送kafka的方法

2019年01月07日 | 移动技术网IT编程 | 我要评论

fm9230,陈可书博客,魔法学园异闻录

本例子实现从hbase获取数据，并发送kafka。

使用

#!/usr/bin/env python
#coding=utf-8
 
import sys
import time
import json
 
sys.path.append('/usr/local/lib/python3.5/site-packages')
from thrift import thrift
from thrift.transport import tsocket
from thrift.transport import ttransport
from thrift.protocol import tbinaryprotocol
from hbase1 import hbase #调用hbase thrif1
from hbase1.ttypes import *
from kafka import kafkaconsumer
from kafka import kafkaproducer
from kafka.errors import kafkaerror
import unittest
 
class hbaseopreator:
 def __init__(self,host,port,table='test'):
  self.tablename=table
  self.transport=ttransport.tbufferedtransport(tsocket.tsocket(host,port))
  self.protocol=tbinaryprotocol.tbinaryprotocol(self.transport)
  self.client=hbase.client(self.protocol)
  self.transport.open()
 
 def __del__(self):
  self.transport.close()
 
 
 def scantablefilter(self,table,*args):
  d=dict() 
  l=[]
  try:
   tablename=table
   # scan = hbase.tscan(startrow, stoprow)
   scan=tscan()
   #主键首字母123
   # filter = "prefixfilter('123_')"
   # filter = "rowfilter(=,'regexstring:.aaa')"
   #过滤条件，当前为 statis_date 字段，值为20170223
   # fitler = "singlecolumnvaluefilter(tablename,'f','statis_date','20170223')"
   # filter="singlecolumnvaluefilter('f','statis_date',=,'binary:20170223') and singlecolumnvaluefilter('f','name',=,'binary:lxs')"
   filter="singlecolumnvaluefilter('info','name',=,'binary:lilei') or singlecolumnvaluefilter('info','name',=,'binary:lily')"
   scan.filterstring=filter
   id=self.client.scanneropenwithscan(tablename,scan,none)
   result=self.client.scannerget(id)
   # result=self.client.scannergetlist(id,100)
   while result:
    for r in result:
     key=r.row
     name=r.columns.get('info:name').value
     age=r.columns.get('info:age').value
     phone=r.columns.get('info:phone').value
     d['key']=key
     d['name']=name
     d['age']=age
     d['phone']=phone
     # encode_result_json=json.dumps(d).encode(encoding="utf-8")
     # print(encode_result_json)
     l.append(d)         
    result=self.client.scannerget(id)    
   return json.dumps(l).encode(encoding="utf-8")  
  finally:
   # self.client.scannerclose(scan)
   print("scan finish")
 
def sendkfafkaproduct(data):
 # self.host_port='localhost:9092'
 producer = kafkaproducer(bootstrap_servers=['localhost:9092'])
 for d in data:
  producer.send('test', key=b'lxs', value=d)
  time.sleep(5)
  print(d)
 
 while true:
  producer.send('test', key=b'lxs', value=data)
  time.sleep(5)
  print(data)
 
if __name__== '__main__':
 # unittest.main()
 
 b=hbaseopreator('10.27.1.138',9090)
 value=b.scantablefilter('ns_lbi:test_hbase_student')
 print(value)
 #sendkfafkaproduct(value)

以上这篇python hbase读取数据发送kafka的方法就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持移动技术网。

您可能感兴趣的文章:

如对本文有疑问，请在下面进行留言讨论，广大热心网友会与你互动！！点击进行留言回复

python dict乱码如何解决

定义字典并直接输出，结果输出结果中文是乱码展示d={'name':'lily','age':18,'sex':'女','no':1121}print d输出结果... [阅读全文]
如何写python的配置文件

一、创建配置文件在d盘建立一个配置文件，名字为：test.ini内容如下：[baseconf]host=127.0.0.1port=3306user=rootp... [阅读全文]
使用Python FastAPI构建Web服务的实现

fastapi 是一个使用 python 编写的 web 框架，还应用了 python asyncio 库中最新的优化。本文将会介绍如何搭建基于容器的开发环境，... [阅读全文]
Python过滤掉numpy.array中非nan数据实例

代码需要先导入pandasarr的数据类型为一维的np.arrayimport pandas as pdarr[~pd.isnull(arr)]补充知识：pyt... [阅读全文]
python求numpy中array按列非零元素的平均值案例

输入：numpy的array输出：一个一维的平均值arrayimport numpy as np def non_zero_mean(np_arr): exis... [阅读全文]
Python如何向SQLServer存储二进制图片

需求是需要用python往 sqlserver中的image类型字段中插入二进制图片核心代码，研究好几个小时的代码：安装pywin32，adodbapiimag... [阅读全文]
python numpy实现rolling滚动案例

相比较pandas，numpy并没有很直接的rolling方法，但是numpy 有一个技巧可以让numpy在c代码内部执行这种循环。这是通过添加一个与窗口大小相... [阅读全文]
python opencv 实现读取、显示、写入图像的方法

opencv是一个强大的图像处理和计算机视觉库，实现了很多实用算法，值得学习和深究下。opencv包安装·　　这里直接安装opencv-python包（非官方）... [阅读全文]
python thrift 实现单端口多服务的过程

thrift 是一种接口描述语言和二进制通信协议。以前也没接触过，最近有个项目需要建立自动化测试，这个项目之间的微服务都是通过 thrift 进行通信的，然后写... [阅读全文]
Python while true实现爬虫定时任务

记得以前的windows 任务定时是可以的正常使用的，今天试了下，发现不能正常使用了，任务计划总是挂起。接下来记录下python 爬虫定时任务的几种解决方法。今... [阅读全文]

网友评论


验证码：

python hbase读取数据发送kafka的方法

2019年01月07日 | 移动技术网IT编程 | 我要评论

您可能感兴趣的文章:

相关文章:

网友评论