腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
0
回答
上传
文件
到
HDFS
是否会自动以
分布式
方式
存储
文件
?
hadoop
、
hdfs
我刚刚开始学习Hadoop,我对如何以
分布式
方式
存储
数据感到有点困惑。我有MPI背景。对于MPI,我们通常有一个主处理器,它将数据发送到各种其他处理器。这是由程序员显式完成的。有了Hadoop,您就拥有了Hadoop
分布式
文件
系统(
HDFS
)。那么,当您将本地服务器中的某些
文件
放入
HDFS
时,
HDFS
是否会自动以
分布式
方式
存储
此
文件
,而无需程序员执行任何操作?
HDFS
这个名字似乎暗
浏览 8
提问于2019-01-26
得票数 1
回答已采纳
1
回答
用于blob数据的
分布式
文件
存储
hdfs
、
distributed-computing
我想使用
HDFS
来
存储
图像/
文件
。但是我在网上读到,关于
HDFS
由于单一namenode的缺点。我遇到了这个名为Cassandra的框架,它是一个nosql
分布式
数据库,但对于blob
存储
来说,它的性能同样不好。对于这个问题有什么建议吗?例如,一个用于blob数据的
分布式
文件
存储
?
浏览 3
提问于2013-05-28
得票数 0
1
回答
如何指定在提交Spark应用程序时从
HDFS
读取数据的位置?
apache-spark
、
hdfs
我已经成功地部署了spark集群,但是对于如何在从服务器上分发我的
HDFS
数据感到困惑吗?是否需要手动将数据放在从节点上,以及如何指定从客户端提交应用程序时从何处读取数据?我已经搜索了多个论坛,但没有找到如何在没有使用Hadoop的情况下使用
HDFS
与Spark。
浏览 0
提问于2017-12-03
得票数 0
回答已采纳
1
回答
Hadoop到底是干什么用的,主要的应用场景和应用领域是什么?
hadoop
Hadoop到底是干什么用的,主要的应用场景和应用领域是什么,主要解决的核心问题又是什么,我们个人可以用它来干什么 产生价值呢?
浏览 1089
提问于2020-09-24
2
回答
将小
文件
合并为用于Hadoop
分布式
缓存的大
文件
?
hadoop
、
hdfs
我有很多小
文件
(大小约1MB)需要分发。众所周知,Hadoop和
HDFS
更喜欢大
文件
。但我不知道这是否也适用于
分布式
缓存,因为
分布式
文件
存储
在本地计算机上。如果它们需要合并,在
HDFS
上以编程方式合并
文件
的最佳方式是什么? 还有一个问题:使用symlink的好处是什么?谢谢
浏览 1
提问于2013-04-07
得票数 2
回答已采纳
1
回答
hdfs
/user空间在
hdfs
中分配的位置
hadoop
、
hdfs
我搞不懂
hdfs
的/user空间是在哪里分配的。它在Linux
文件
系统中不可见。但是在
hdfs
中有一个名为/user的目录。我猜是因为配置的原因?它是否跨集群中的所有节点创建?
浏览 6
提问于2015-02-21
得票数 0
1
回答
度量收集和分析体系结构
database
、
amazon-web-services
、
architecture
、
bigdata
、
iot
首先,不需要
存储
所有数据,因为用户只需要指定时间段的图表,因此需要一些聚合。什么样的数据库解决方案适合它?我相信没有RDMS会处理这么多的数据。那么,如何获取度量的平均数据来将其呈现给最终用户呢?AWS具有共享的时间序列数据处理架构: 很简单,我是这样想的: 以
浏览 0
提问于2018-11-26
得票数 1
2
回答
HDFS
和ADLS有什么区别?
hadoop
、
hadoop2
、
azure-data-lake
与
HDFS
不同的是,我对天蓝色数据湖的
存储
方式感到困惑。有谁能简单地解释一下吗?
浏览 2
提问于2020-07-09
得票数 1
回答已采纳
2
回答
hadoop
文件
系统的说明
hadoop
有人能帮我理解hadoop的数据
存储
概念吗?我使用这个链接来建立一个单节点hadoop集群:
浏览 1
提问于2014-02-15
得票数 0
回答已采纳
2
回答
在hadoop的映射阶段写入本地
文件
hadoop
、
mapreduce
Hadoop将中间结果写入本地磁盘,将reducer的结果写入
HDFS
。
HDFS
是什么意思。它在物理上翻译成什么?
浏览 1
提问于2012-09-14
得票数 0
回答已采纳
1
回答
有/没有
HDFS
的Alluxio
hadoop
、
hdfs
、
distributed-filesystem
、
alluxio
我有一个集群,将
HDFS
作为一个未
存储
的
分布式
文件
系统,但我刚刚读到关于冲积is 的快速和灵活的内容。所以,我的问题是:我应该在
HDFS
中使用Alluxio还是Alluxio替代
HDFS
?(我在他们的站点中看到,用于下
存储
文件
系统的共享
存储
可以是网络
文件
系统(NFS)。因此,我认为
HDFS
不是必需的。如果我犯了错误,请纠正我。在哪种模式下性能更好:
HDFS
与Alluxio或All
浏览 1
提问于2018-08-30
得票数 2
回答已采纳
1
回答
如何构建基于hadoop和lucene的
分布式
搜索
hadoop
、
lucene
、
katta
我正准备使用lucence和hadoop制作
分布式
搜索模块,但我对以下内容感到困惑: 众所周知,
hdfs
是一个
分布式
文件
系统,当我将一个
文件
放到
hdfs
中时,
文件
将被分成几个块,并
存储
在claster中的不同的从机中,但是如果我使用lucene在
hdfs
上编写索引,我希望看到每台机器上的索引,如何实现它?我读过一些hadoop/cont肋骨/index和一些katta,但不理解“碎片,看起来像索引的一部分”的概
浏览 2
提问于2013-12-08
得票数 1
1
回答
HDFS
可以作为机器的本机
文件
系统运行吗?
hadoop
、
hdfs
每当我必须执行操作时,我必须将
文件
从VM
文件
系统传输到
HDFS
,在我看来,将所有
文件
从本机
文件
系统(在我的示例中为VM本机
文件
系统)复制到
HDFS
会产生一定的开销。
hdfs
dfs -put <FILE_IN_VM_FS> <FILE_IN_
HDFS
>
HDFS
在工业环境中是否作为本机
文件
系统运行,或者以上提到的方法是这样做的事实。
浏览 2
提问于2015-09-18
得票数 1
1
回答
是
分布式
文件
存储
(
HDFS
/Cassandra/S3等)是否强制spark在群集模式下运行?若有,原因为何?
apache-spark
、
hadoop
、
hdfs
是
分布式
文件
存储
(
HDFS
/Cassandra/S3等)是否强制spark在群集模式下运行?若有,原因为何? Spark是用于计算海量数据的
分布式
数据处理引擎。假设我在mysql中
存储
了大量数据,我想对这些数据进行处理。Spark从mysql读取数据,并在集群节点本身上执行内存(或磁盘)计算。我仍然不能理解为什么在集群模式下运行spark需要
分布式
文件
存储
?
浏览 3
提问于2021-03-25
得票数 0
1
回答
Hadoop的目的是保存在RAM或磁盘中?
hadoop
、
hdfs
通过查看互联网上的文档,我得到了这样的印象:
HDFS
的想法是将其保存在RAM中,以加快速度。现在我们的架构师说
HDFS
的主要思想是可伸缩性。我没意见。但他也声称,主要的想法是把它放在硬盘上。
HDFS
基本上是一个可伸缩的硬盘。我的观点是,硬盘支持
HDFS
是一种选择。但是,主要的想法是将其保存在RAM中。现在谁来了?我现在真的很困惑,我想说,这一点对于理解Hadoop是至关重要的。
浏览 2
提问于2013-08-01
得票数 1
回答已采纳
1
回答
关于配置单元表
存储
hive
如果它分布在不同的数据节点上,那么我们如何才能看到\hive\warehouse
文件
夹下的一个
文件
呢? 另外,请不要说明这个
存储
是如何分配给一个分区表的。
浏览 2
提问于2015-02-26
得票数 0
1
回答
使用spark和
HDFS
作为
文件
存储
系统,使用YARN作为资源管理器的优势是什么?
apache-spark
、
hadoop
、
hdfs
既然spark在使用
HDFS
作为spark的
存储
系统时,将对数据的操作保存在内存中,那么它是否利用了
HDFS
的
分布式
存储
?例如,假设我在
HDFS
中
存储
了100 it的CSV
文件
,现在我想对其进行分析。如果我将其从
HDFS
加载到spark,它将触发将完整数据加载到内存中进行转换,或者它将使用
分布式
环境来完成其作业,该作业是由在hadoop中编写的MapReduce程序所利用的。如果不是,那么使用spark比使用
浏览 17
提问于2019-01-27
得票数 0
回答已采纳
1
回答
对于Hadoop:哪个数据
存储
?
hadoop
、
hbase
、
store
为此,我正在考虑将Hadoop用于MapReduce和
分布式
计算。使用MapReduce模式,我可以创建每组100.000条记录,并将它们分布在集群上,以便进行一些
分布式
分析/计算。除此之外,我还必须
存储
所有这些记录,并每个月使用它们来改进我每天计算的算法。哪家商店最适合这种情况?我正在考虑HBase或CouchDB,因为我认为它们很适合我的需求。
浏览 3
提问于2015-02-11
得票数 0
1
回答
是否有可能使用key-value将数据
存储
在
HDFS
中?
nosql
、
hdfs
、
key-value-store
在NoSQL数据库中
存储
数据可以提供键值
存储
模型。但是,
HDFS
在Hadoop生态系统中是一种
分布式
文件
存储
。Key-value由mapreduce集群使用。因此,此分布仅在处理阶段生成。我需要知道是否有可能将静态数据
存储
在
HDFS
中,其中每个值都由一个键标识。
浏览 44
提问于2019-03-06
得票数 0
回答已采纳
1
回答
来自不同服务器的Hadoop输入
java
、
hadoop
、
mapreduce
对于这两个数据节点,每个节点在自己的
HDFS
中都有一个日志
文件
。现在,我想运行Hadoop在主节点上执行map/reduce,输入应该是来自两个数据节点的
HDFS
的两个日志
文件
。我能这么做吗?有没有可能来自不同datanode的
HDFS
的输入位于不同的服务器中?
浏览 0
提问于2013-07-10
得票数 0
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券