当我试图通过HDP 2.4.2中的spark(使用newhadoopAPIRDD)连接hbase时,遇到跟随错误时,一直尝试增加hbase站点xml文件中的RPC时间,但仍然保持不变。知道怎么修吗?:320) at org.apache.hadoop.hbase.client.ClientScanner.initializeScannerInCo
假设我通过不同的转换(连接、映射等)创建了dataset,并将其保存到hbase中的表A中。现在,我希望通过选择特定的列将相同的数据集保存到hbase中的另一个表中。在这种情况下,是否应该在保存到表A后使用持久化函数?或者,如果我只使用select函数,这不重要吗?例如:
Dataset<Row> ds = //computing dataset by different transformations
我在修复有问题的表(在Hbase 0.92.1-cdh4.0.0,Hadoop 2.0.0-cdh4.0.0上)时遇到了一点麻烦Region StateNumber of empty REGIONINFO_QUALIFIER rows in .META.: 0
ERROR: Region {:8020/hbase