首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >在HDFS中存储的是什么?为什么在Titan执行查询时map-减少计算速度这么快?

在HDFS中存储的是什么?为什么在Titan执行查询时map-减少计算速度这么快?
EN

Stack Overflow用户
提问于 2016-08-22 12:44:16
回答 1查看 98关注 0票数 1

我现在在学土卫六。我在远程模式下与HBase一起使用泰坦。

现在有三个问题把我搞糊涂了。我在下面描述了它们:

  1. 在TinkerPop3文档中,它说“任何OLAP操作的结果都存储在通过HDFS访问的hdfs中。”但是现在我使用了Titan作为OLTP,在这种情况下HDFS中存储了什么?
  2. 当我们使用泰坦连接HBase成功时(通过Java ),我们可以看到在HBase shell中创建的表并扫描内容。表中内容“列”的含义是什么?它们在图中表示顶点id吗?
  3. 当我测试土卫六的性能时,我观察到查询的速度比普通地图快--减少作业。为什么土卫六能做到呢?在土卫六文档中,他们说泰坦引擎“土卫六”使用并行地图-减少model.Can我得到更详细的介绍吗?
EN

回答 1

Stack Overflow用户

回答已采纳

发布于 2016-08-22 13:49:12

  1. 泰坦架构图有助于显示OLTP和OLAP使用之间的差异。请参阅架构图的右侧: TinkerPop API。OLTP是最常见的泰坦用法,无论您选择哪个后端存储(Cassandra、HBase、BerkeleyDB)。当您使用Titan-HBase执行OLTP查询时,HDFS中没有存储任何内容。事实上,HDFS/Hadoop对于使用Titan-HBase的OLTP来说根本不需要。
  2. 在HBase中扫描泰坦表的内容时,您将发现图形的序列化表示形式。Titan在键/列/值上使用数据压缩技术,因此您会发现数据不是人类可读的。您可以阅读更多关于土卫六博士中存储布局的详细信息。
  3. 请参见#1的答案,您可能一直在运行OLTP查询。Hadoop风格的OLAP图形处理是通过图形计算机完成的.它使用TitanHBaseInputFormat从后端存储读取数据,然后使用TinkerPop图形计算机(火花或计量器)运行OLAP作业。请参见上面的体系结构图的左侧: GremlinGraphComputer。在土卫六博士中也有这方面的一些文档。
票数 0
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/39079913

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档