PHP通过Thrift操作Hbase

HBase是一个开源的NoSQL产品,它是实现了Google BigTable论文的一个开源产品,和Hadoop和HDFS一起,可用来存储和处理海量column family的数据。官方网址是:http://hbase.apache.org

一 、HBase访问接口

1.  Native Java API,最常规和高效的访问方式,适合Hadoop MapReduce Job并行批处理HBase表数据
2.  HBase Shell,HBase的命令行工具,最简单的接口,适合HBase管理使用
3.  Thrift Gateway,利用Thrift序列化技术,支持C++,PHP,Python等多种语言,适合其他异构系统在线访问HBase表数据
4.  REST Gateway,支持REST 风格的Http API访问HBase, 解除了语言限制
5.  Pig,可以使用Pig Latin流式编程语言来操作HBase中的数据,和Hive类似,本质最终也是编译成MapReduce Job来处理HBase表数据,适合做数据统计
6.  Hive,当前Hive的Release版本尚没有加入对HBase的支持,但在下一个版本Hive 0.7.0中将会支持HBase,可以使用类似SQL语言来访问HBase
如果使用PHP操作Hbase,推荐使用Facebook开源出来的thrift,官网是:http://thrift.apache.org/ ,它是一个类似ice的中间件,用于不同系统语言间信息交换。

二、安装Thrift

在Hadoop和Hbase都已经安装好的集群上安装Thrift,Thrift安装在Hmaster机器上

1. 下载thrift

wget http://mirror.bjtu.edu.cn/apache//thrift/0.8.0/thrift-0.8.0.tar.gz

2. 解压

tar -xzf thrift-0.8.0.tar.gz

3 .编译安装:

如果是源码编译的,首先要使用./boostrap.sh创建文件./configure ,我们这下载的tar包,自带有configure文件了。((可以查阅README文件))

If you are building from the first time out of the source repository, you will
need to generate the configure scripts.  (This is not necessary if you
downloaded a tarball.)  From the top directory, do:
./bootstrap.sh

./configure
make ; make install

4. 启动:

# ./bin/hbase-daemon.sh start thrift [--port=PORT]
starting thrift, logging to /home/banping/hbase/hbase-0.90.3/bin/../logs/hbase-root-thrift-localhost.localdomain.out

Thrift默认监听的端口是9090

使用jps查看进程,看到ThriftServer进程:

三、测试:

1 .php脚本库操作Hbase

PHP通过Thrift访问Hbase的库是在thrift-0.8.0/lib/php/src目录下,其实这个文件夹下也包含通过Thrift访问Hbase的PHP扩展源代码。

1)复制thrift-0.8.0/lib/php到相应的php web目录。

2)然后生成php与hbase接口文件

#/usr/local/thrift/bin/thrift --gen php /usr/local/hbase/src/main/resources/org/apache/hadoop/hbase/thrift/Hbase.thrift

#(根据自己的目录设置)

生成目录文件: /usr/local/hbase/gen-php/Hbase

有文件: Hbase.php,Hbase_types.php

把Hbase.php,Hbase_types.php copy到:web目录/php/src/packages/Hbase/

3)使用php脚本测试:

[php] view plain copy

print?

  1. <?php
  2. ini_set(‘display_errors‘, E_ALL);
  3. $GLOBALS[‘THRIFT_ROOT‘] = ‘./php/src‘;
  4. require_once( $GLOBALS[‘THRIFT_ROOT‘] . ‘/Thrift.php‘ );
  5. require_once( $GLOBALS[‘THRIFT_ROOT‘] . ‘/transport/TSocket.php‘ );
  6. require_once( $GLOBALS[‘THRIFT_ROOT‘] . ‘/transport/TBufferedTransport.php‘ );
  7. require_once( $GLOBALS[‘THRIFT_ROOT‘] . ‘/protocol/TBinaryProtocol.php‘ );
  8. require_once( $GLOBALS[‘THRIFT_ROOT‘] . ‘/packages/Hbase/Hbase.php‘ );
  9. $socket = new TSocket(‘10.64.60.83‘, ‘9090‘);
  10. $socket->setSendTimeout(10000); // Ten seconds (too long for production, but this is just a demo ;)
  11. $socket->setRecvTimeout(20000); // Twenty seconds
  12. $transport = new TBufferedTransport($socket);
  13. $protocol = new TBinaryProtocol($transport);
  14. $client = new HbaseClient($protocol);
  15. $transport->open();
  16. //获取表列表
  17. $tables = $client->getTableNames();
  18. sort($tables);
  19. foreach ($tables as $name) {
  20. echo( "  found: {$name}\n" );
  21. }
  22. //创建新表student
  23. $columns = array(
  24. new ColumnDescriptor(array(
  25. ‘name‘ => ‘id:‘,
  26. ‘maxVersions‘ => 10
  27. )),
  28. new ColumnDescriptor(array(
  29. ‘name‘ => ‘name:‘
  30. )),
  31. new ColumnDescriptor(array(
  32. ‘name‘ => ‘score:‘
  33. )),
  34. );
  35. $tableName = "student";
  36. try {
  37. $client->createTable($tableName, $columns);
  38. } catch (AlreadyExists $ae) {
  39. echo( "WARN: {$ae->message}\n" );
  40. }
  41. //获取表的描述
  42. $descriptors = $client->getColumnDescriptors($tableName);
  43. asort($descriptors);
  44. foreach ($descriptors as $col) {
  45. echo( "  column: {$col->name}, maxVer: {$col->maxVersions}\n" );
  46. }
  47. //修改表列的数据
  48. $row = ‘2‘;
  49. $valid = "foobar-\xE7\x94\x9F\xE3\x83\x93";
  50. $mutations = array(
  51. new Mutation(array(
  52. ‘column‘ => ‘score‘,
  53. ‘value‘ => $valid
  54. )),
  55. );
  56. $client->mutateRow($tableName, $row, $mutations);
  57. //获取表列的数据
  58. $row_name = ‘2‘;
  59. $fam_col_name = ‘score‘;
  60. $arr = $client->get($tableName, $row_name, $fam_col_name);
  61. // $arr = array
  62. foreach ($arr as $k => $v) {
  63. // $k = TCell
  64. echo ("value = {$v->value} , <br>  ");
  65. echo ("timestamp = {$v->timestamp}  <br>");
  66. }
  67. $arr = $client->getRow($tableName, $row_name);
  68. // $client->getRow return a array
  69. foreach ($arr as $k => $TRowResult) {
  70. // $k = 0 ; non-use
  71. // $TRowResult = TRowResult
  72. var_dump($TRowResult);
  73. }
  74. $transport->close();
  75. ?>

通过浏览器查看看到项目中的所有表,证明PHP可以通过thrift访问HBase了。

2. 使用PHP扩展的方式来使用thrift

我们使用PHP自带的phpize来生成Thtift的php扩展。该扩展的源码结构:

[email protected]:/usr/local/hbase-0.90.4/thrift-0.8.0/lib/php/src
$ cd ext/thrift_protocol
$ /usr/local/php/bin/phpize
$ ./configure --with-php-config=/usr/local/php/bin/php-config --enable-thrift_protocol
$ make
$ make install

然后把生成的thrift_protocol.so文件配置到php.ini并重启apache服务。
时间: 2024-10-21 21:10:56

PHP通过Thrift操作Hbase的相关文章

hbase之python利用thrift操作hbase数据和shell操作

前沿: 以前都是用mongodb的,但是量大了,mongodb显得不那么靠谱,改成hbase撑起一个量级. HBase是Apache Hadoop的数据库,能够对大型数据提供随机.实时的读写访问.HBase的目标是存储并处理大型的数据.HBase是一个开源的,分布式的,多版本的,面向列的存储模型.它存储的是松散型数据. HBase提供了丰富的访问接口. HBase Shell Java clietn API Jython.Groovy DSL.Scala REST Thrift(Ruby.Pyt

Nodejs通过Thrift操作hbase卡住原因分析及与javascript的垃圾回收机制的关系

在最近使用Nodejs通过Thrift操作hbase的时候写了个脚本,不断发送http请求,从而取得hbase下所需的数据,但是在run的过程中for循环并没有执行完全,在执行一部分后会卡住,就再也进不到hbase下取数据,出现socket hang up的错误,查了很多资料也没解决.当时认为是hbase的并发数问题,其并发数的限制导致了资源负载的极限,后来不断测试找到原因所在,其实与hbase处理并发的能力无关,真正的原因是jsvascript的垃圾回收机制使得资源使用达到瓶颈,下面是代码处理

Python 操作 HBase —— Trift Trift2 Happybase 安装使用

Python无法直接访问HBase,必须通过Thrift. HBase与Thrift之间又支持两种接口标准,两种标准互不兼容,功能也互不覆盖. Thrift连接HBase还有超时自动断开的大坑. 安装Thrift依赖(Server端) Centos: yum install automake libtool flex bison pkgconfig gcc-c++ boost-devel libevent-devel zlib-devel python-devel ruby-devel open

Spark操作Hbase

Spark 下操作 HBase(1.0.0 新 API) HBase经过七年发展,终于在今年2月底,发布了 1.0.0 版本.这个版本提供了一些让人激动的功能,并且,在不牺牲稳定性的前提下,引入了新的API.虽然 1.0.0 兼容旧版本的 API,不过还是应该尽早地来熟悉下新版API.并且了解下如何与当下正红的 Spark 结合,进行数据的写入与读取.鉴于国内外有关 HBase 1.0.0 新 API 的资料甚少,故作此文. 本文将分两部分介绍,第一部分讲解使用 HBase 新版 API 进行

java操作hbase例子

hbase安装方法请参考:hbase-0.94安装方法详解 hbase常用的shell命令请参考:hbase常用的shell命令例子 java操作hbase,在eclipse中创建一个java项目,将hbase安装文件根目录的jar包和lib目录下jar包导入项目,然后就可以编写java代码操作hbase了.下面代码给出来一个简单的示例 /** * @date 2015-07-23 21:28:10 * @author sgl */ package com.songguoliang.hbase;

HBase 6、用Phoenix Java api操作HBase

开发环境准备:eclipse3.5.jdk1.7.window8.hadoop2.2.0.hbase0.98.0.2.phoenix4.3.0 1.从集群拷贝以下文件:core-site.xml.hbase-site.xml.hdfs-site.xml文件放到工程src下 2.把phoenix的phoenix-4.3.0-client.jar和phoenix-core-4.3.0.jar添加到工程classpath 3.配置集群中各节点的hosts文件,把客户端的hostname:IP添加进去

基于jython操作hbase

一.前言 关于jython介绍,直接上官网www.jython.org,可以得到详细资料,这里只介绍一下jython操作hbase的一些方法,本质上和用java操作hbase差不多,只不过语法换成了python 二.环境 hbase版本:0.98.6.1 hadoop版本: 2.5.2 jython版本:2.7 三.jython安装配置 1 安装 关于hbase&hadoop的安装配置这里也不介绍,主要介绍一下jython的安装配置,其实安装很简单,就执行一条命令就OK java -jar jy

spark 操作hbase

HBase经过七年发展,终于在今年2月底,发布了 1.0.0 版本.这个版本提供了一些让人激动的功能,并且,在不牺牲稳定性的前提下,引入了新的API.虽然 1.0.0 兼容旧版本的 API,不过还是应该尽早地来熟悉下新版API.并且了解下如何与当下正红的 Spark 结合,进行数据的写入与读取.鉴于国内外有关 HBase 1.0.0 新 API 的资料甚少,故作此文. 本文将分两部分介绍,第一部分讲解使用 HBase 新版 API 进行 CRUD 基本操作:第二部分讲解如何将 Spark 内的

Hadoop之——Java操作HBase

转载请注明出处:http://blog.csdn.net/l1028386804/article/details/46463617 不多说,直接上代码,大家都懂得 package hbase; import java.io.IOException; import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.hbase.HBaseConfiguration; import org.apache.hadoop.hbas