腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(5798)
视频
沙龙
1
回答
覆盖
hadoop
用户日志(特定于队列)
hadoop
、
hive
、
hadoop2
我有一个
hadoop
作业,它运行在由300个节点组成的
集群
中,对于我的作业,我有一个特定的队列来执行作业。作业在生产过程中运行良好,但是它在userlog文件夹下为特定的应用程序id生成了太多的日志,我执行了
hadoop
命令,并获得了290 GB大小的文件。我可以在syslog中看到太多
hadoop
日志记录。我对此有一些疑问,如果有人能指导我的话,对我会有很大的帮助-2)-基于hive查询的syslog中的日志(正如我所看到的,所有条目都与
Hadoop
处理有关,
浏览 5
提问于2016-08-25
得票数 1
回答已采纳
1
回答
nutch
hadoop
只有一个从站在爬行
hadoop
、
fetch
、
nutch
我有一个3-slaves
hadoop
集群
,我在一个网站上执行抓取。但是,只有一个从设备正在执行抓取(尽管其他从设备仍然处于活动状态)。如果只抓取1个域,这是正常行为吗?
浏览 0
提问于2012-05-24
得票数 0
2
回答
并行
hadoop
作业不会通过
hadoop
、
mapreduce
、
hadoop2
我正在运行一个本地
hadoop
集群
,并尝试同时提交两个作业,但是我的第一个作业完成了,而第二个作业没有完成,并且在第一个作业完成之前一直处于未分配状态。我预感到这是一个记忆问题,但是我不能完全弄清楚。下面是我为容器、
映射
器、reduce、jvm等设置的值。还有什么需要我
改
的吗?
浏览 0
提问于2015-06-02
得票数 1
2
回答
如何
在
hadoop
集群
中的节点上增加map输出能力?
hadoop
我使用
hadoop
集群
中的3台计算机,主计算机有3 GB Ram,从计算机有3 GB Ram。我可以更改这个号码吗?
浏览 1
提问于2013-01-27
得票数 0
1
回答
Hadoop
是否在块级复制?
hadoop
、
hdfs
、
cluster-computing
、
distcp
集群
之间/
集群
内部的差异是
映射
-减少作业。我的假设是,它在输入分割级别上复制文件,这有助于提高复制性能,因为一个文件将由多个并行处理多个“片段”的
映射
程序复制。然而,当我阅读
Hadoop
的文档时,它似乎只在文件级别上起作用。请参阅此处:
hadoop
.apache.org/docs/current/
hadoop
-distcp/DistCp.html 根据distcp,distcp将只拆分文件列表,而不是文件本身,并将列表
浏览 3
提问于2017-02-20
得票数 2
回答已采纳
2
回答
Hadoop
客户端与
集群
分离
hadoop
、
cluster-computing
、
vpn
、
hadoop2
我也是
hadoop
,linux的新手。我的教授要求我们使用端口
映射
或VPN分离
Hadoop
客户端和
集群
。我不明白这种分离的含义。有人能给我个提示吗?我有一些天真的想法: 1.创建客户端计算机并安装
hadoop
。2.将fs.default.name设置为hdfs://maste
浏览 1
提问于2016-02-10
得票数 1
回答已采纳
3
回答
地图-通过Oozie减少
hadoop
、
mapreduce
、
oozie
、
oozie-coordinator
如果我使用Oozie来运行MapReduce作业,那么启动多少
映射
程序有具体的数字吗?是: 一个用于Oozie,一个
映射
器用于每64 one块(默认块大小)
浏览 5
提问于2016-08-02
得票数 2
回答已采纳
1
回答
JMX导出Mapreduce指标
hadoop
、
mapreduce
、
jmx
、
jmx-exporter
我正在尝试使用JMX导出
Hadoop
集群
的指标。它适用于HDFS和resourceManager。将其添加到
HADOOP
_OPTS、
HADOOP
_NAMENODE_OPTS、
HADOOP
_DATANODE_OPTS和YARN_RESOURCEMANAGER_OPTS。
如何
导出作业的Mapreduce指标?我想导出作业操作,如
映射
和缩减。作为下图中显示作业UI的指标: ?
浏览 16
提问于2019-06-03
得票数 0
3
回答
如何
在单个JVM中运行
hadoop
多线程?
hadoop
、
jvm
、
mapreduce
我有4个核心的台式机,希望使用
hadoop
将我的所有核心用于本地数据处理。(例如,有时我有足够的能力在本地处理数据,有时我向
集群
提交相同的作业)。默认情况下,
hadoop
本地模式只运行一个
映射
器和一个reducer,所以我的本地作业非常慢。我不想首先在单机上设置
集群
,因为“痛苦”的配置,然后我每次都必须创建jar。所以完美的解决方案是
如何
在一台机器上运行嵌入式
Hadoop
PS伪分布式模式是不好的选择,因为它将创建具有单个节点的
集群
,因此我将只获得一个
浏览 0
提问于2012-09-20
得票数 2
1
回答
Hadoop
经典与纱线的比较
hadoop
、
hadoop-yarn
、
hortonworks-data-platform
我有两个
集群
,每个
集群
运行着不同版本的
Hadoop
。如果我需要了解纱线
如何
提供同时运行多个应用程序的能力,我正在开发一个POC,这不是用经典地图还原框架完成的。
Hadoop
:我有一个wordcount.jar文件,并在一个
集群
上执行(2个Mappers和2个减法器)。
Hadoop
:相同的wordcount.jar与不同的
集群
(4个核心,所以总共4台机器)。由于纱线不预先分配
映射
器和减速机,任何芯都可以用作
映射
器或
浏览 2
提问于2013-12-13
得票数 0
回答已采纳
1
回答
在MapReduce Servlet上从动态WildFly项目运行
Hadoop
WildFly作业
java
、
eclipse
、
servlets
、
hadoop
、
wildfly
我已经将
Hadoop
2.2.0安装在ubuntu13.10上,在我的pc上以伪分布式模式启动并正确运行(只有一个datanode)。我使用EclipseKeplerv4.3和Maven插件来开发我的
Hadoop
程序和动态without (项目没有Maven)。我有一个名为"HadWork“的
Hadoop
项目,我用它创建了HadWork.jar (右键单击项目、导出、运行的Jar文件,并选择”将所需的库提取到生成的JAR")。我正在编写Servlet "ServletHadoopTest.java“,但是我不明
浏览 3
提问于2014-03-24
得票数 0
回答已采纳
4
回答
配置
Hadoop
集群
时需要设置多少个
映射
器/缩减器?
map
、
hadoop
、
reduce
配置
Hadoop
集群
时,设置
集群
映射
器/缩减器数量的科学方法是什么?
浏览 0
提问于2012-04-05
得票数 4
回答已采纳
1
回答
减速机取地图芯
hadoop
、
mapreduce
、
hadoop-yarn
我正在
hadoop
集群
上运行mapreduce作业,该
集群
有88个内核和60个减速器。出于某种原因,它只使用了79个
集群
核心。开始时,它使用79个
映射
器运行,但当完成一半分割时,它使用53个
映射
器和26个减速器,运行
映射
器的数量随后继续减少,从而增加了工作完成时间。日志显示,这26名减速器在复制计算数据。是否有可能让
hadoop
先运行所有
映射
器,然后再运行该减速器?就像在火花或tez作业中一样,他们使用所有的核来
映射
浏览 1
提问于2016-10-01
得票数 2
回答已采纳
1
回答
如何
在windows上安装
hadoop
2.4.1
windows-7
、
cluster
、
hadoop
、
hdfs
、
apache-spark
我想在纱线模式下使用
hadoop
设置一个
集群
。我想使用spark进行
映射
-减少,并使用submit来部署我的应用程序。我想在cluster..can上工作,任何人都可以帮助我使用windows在
集群
中安装
HADOOP
。
浏览 0
提问于2017-03-13
得票数 0
1
回答
在
hadoop
中不使用reducer运行WordCount
hadoop
、
jar
、
mapreduce
、
reduce
我安装了
hadoop
集群
环境(Master & Slave)。工作顺畅。 我使用(
hadoop
.example.jar)文件尝试了wordcount和grep,也运行得很好。现在,我想编辑(
hadoop
.example.jar)只运行
映射
器而不运行reducer。有没有办法做到这一点?我读过一些文章,说我必须将setNumReducerTask(0)的值设置为零,但我不知道
如何
设置?使用(
hadoop
.example.jar)文件。
浏览 1
提问于2015-04-07
得票数 0
2
回答
Hadoop
文件大小说明
hadoop
我正在澄清关于使用
Hadoop
处理大约200万个大文件的问题。我有一个由200万行组成的文件数据,我希望将每行数据拆分为单个文件,将其复制到
Hadoop
file System中,然后使用Mahout执行词频计算。
浏览 0
提问于2012-04-25
得票数 0
回答已采纳
1
回答
如何
在
Hadoop
集群
上运行
Hadoop
Streaming?
hadoop
、
cluster-computing
、
hadoop-yarn
、
hadoop-streaming
目前我有一个有3个节点的
Hadoop
集群
(Ubuntu) 我想运行带有
Hadoop
流的python /R脚本,但是我不确定仅仅执行HS是否真的能使所有节点工作 如果可能,请告诉我在群集上运行流的方向
浏览 21
提问于2020-04-25
得票数 0
1
回答
如何
做一个3阶段的Map Reduce流?
python
、
hadoop
、
mapreduce
、
hadoop-streaming
我是
hadoop
的新手。 目前我有一个
映射
器,一个缩减器和一个组合器。我可以做cat file | mapper.py | reducer.py | combiner.py来产生结果。那么,如果我有一个
hadoop
集群
,谁能告诉我
如何
将其应用到
hadoop
流中?
浏览 0
提问于2015-01-30
得票数 0
1
回答
EC2上的
Hadoop
流作业仍处于“待定”状态
amazon-ec2
、
hadoop
尝试在Ubuntu上使用cloudera发行版CDH3对
Hadoop
和流进行实验。用python写的小流
映射
器。当我启动一个只有
映射
器的作业时,请使用:
hadoop
jar /usr/lib/
hadoop
/contrib/streaming/
hadoop
-streaming*.jar -file /usr/适当地决定它将使用
集群</e
浏览 0
提问于2011-06-27
得票数 0
回答已采纳
2
回答
使用
Hadoop
流进行线程处理
python
、
multithreading
、
hadoop
、
hadoop-streaming
、
amazon-emr
我正在利用
Hadoop
流编写一个基于python的HTML抓取器。我发现运行单个线程的python脚本很慢。我想把它修改成多线程版本。有谁知道将
映射
程序中的线程数设置为什么才是一个好数字吗?我不确定
集群
每个节点的规范,但我假设它至少支持两个线程。
浏览 2
提问于2013-08-06
得票数 0
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券