没有找到合适的产品?
联系客服协助选型:023-68661681
提供3000多款全球软件/控件产品
针对软件研发的各个阶段提供专业培训与技术咨询
根据客户需求提供定制化的软件开发服务
全球知名设计软件,显著提升设计质量
打造以经营为中心,实现生产过程透明化管理
帮助企业合理产能分配,提高资源利用率
快速打造数字化生产线,实现全流程追溯
生产过程精准追溯,满足企业合规要求
以六西格玛为理论基础,实现产品质量全数字化管理
通过大屏电子看板,实现车间透明化管理
对设备进行全生命周期管理,提高设备综合利用率
实现设备数据的实时采集与监控
利用数字化技术提升油气勘探的效率和成功率
钻井计划优化、实时监控和风险评估
提供业务洞察与决策支持实现数据驱动决策
原创|行业资讯|编辑:陈俊吉|2016-08-16 09:26:24.000|阅读 796 次
概述:在打开本文章前,或许您已经产生疑问:BigInsights里包含了Big SQL 和Spark SQL,它们有何区别,而作为用户又该如何选择?
# 界面/图表报表/文档/IDE等千款热门软控件火热销售中 >>
相关链接:
由于前期的文件已经多次介绍了Big SQL的特点和工作机制,如《BigInsights金刚钻之首:BigSQL - SQL on Hadoop》,《BigSQL发动机的结构和工作原理》和《BigSQL让HBase更易用》等,而Spark SQL在网上也有很多相关文章,所以,这两个SQL on Hadoop引擎的功能特点在此不在细述。
两种SQL引擎在一些数据处理的场景都是可以胜任和互换的。然而,Spark SQL目前还很不成熟,包括对SQL标准的支持、对数据访问的安全性控制(行级和列级的访问控制)和并发有待改进,而且它在处理数据时受内存容量的限制。所以,在更多的场景中,Big SQL无论在功能上还是性能上才是最佳选择。
鉴于Big SQL和Spark的流行性,企业想要部署和使用这两种技术的期望是合理的。幸运的是,Spark的应用程序不难与Big SQL共享Big SQL表中的数据。这种可能得益于Big SQL的设计,特别是它重用了Hive的HCatalog元数据管理并支持不同的Hadoop文件格式的存储数据(而不是专有的格式)。这种方法使得Spark SQL非常容易地获取Big SQL表的数据。
下面,我们看一个简单的例子,以说明Spark SQL如何访问Big SQL的数据。
在BigInsights中,假设您已经在Hive仓库或在DFS目录中已经创建了一个Big SQL表,现在您只需调用标准Spark SQL语句和表达式,以创建一个HiveContext并使用HiveQL语法查询Big SQL表。一旦您把数据读入到Spark,您就可以使用适当的Transformation和Action进行数据处理。
这例子简单明了吧!
那么,Big SQL和Spark SQL之间如何选择呢?看看下面这张图就明白了:
对于很多场景,Spark SQL想做的事情,Big SQL可能一点兴趣都没有。例如,应用场景是获取数据用于机器学习,或者是数据科学家从零开始编写探索性的查询,那Spark SQL是个相当好的选择,而且它利用内存计算能过获取很好的性能。
然而,如果您想从数据仓库Offload工作负载:其查询,报表和应用程序以最小的修改代价运行在Hadoop上,那么对每个查询都要维护两个版本是不可接受的。对于生产环境,数据访问的安全性也是另一个非常重要的要求。还有,需要多用户并发…这时,Big SQL才是最佳答案。
所以,Big SQL和Spark SQL不是互斥的。您应该同时使用Big SQL和Spark SQL解决不同的问题。
更多大数据与分析相关行业资讯、解决方案、案例、教程等请点击查看>>>
详情请咨询在线客服!
客服热线:023-66090381
本站文章除注明转载外,均为本站原创或翻译。欢迎任何形式的转载,但请务必注明出处、不得修改原文相关链接,如果存在内容上的异议请邮件反馈至chenjj@evget.com
Web测试工具Parasoft SOAtest让测试脚本的创建和复用变得简单高效,自动适应界面变化,实现数据驱动的零压力维护,同时确保跨浏览器测试的无缝执行,极大地降低了维护成本,提高了测试效率。
Parasoft Jtest作为一款强大的Java自动化测试工具,通过灵活的规则定制和统一标准管理,为团队提供了高效的代码规范与合规性检查解决方案。无论是应对行业标准还是企业特殊需求,它都能帮助开发者提升代码质量、降低风险,从而在复杂的开发环境中实现高效协作与稳定交付。
作为全球领先的三维图形开发平台,Tech Soft 3D提供的HOOPS产品套件已成为众多计算机辅助制造(CAM)软件的核心基础架构之一,并为其提供了高性能的数据解析、三维渲染与协作能力。
Parasoft dotTEST凭借其即插即用的内置安全标准和直观的规则映射能力,为C#/VB.NET 开发者提供了强大的支持。它有效消除了理解复杂标准与配置规则的障碍,让开发者能够专注于编写高质量代码,而非耗费精力在标准解读与工具映射上。这不仅显著提升了开发效率,缩短了交付周期,更从源头系统性地降低了安全风险,确保了软件符合严苛的行业合规要求。
工业4.0优选产品 | 商业智能和绩效管理软件领导者,帮助企业成为业绩最佳的分析驱动型企业
SPSS Modeler工业4.0优选产品 | 在历史数据中发现规律以预测未来事件,做出更好的决策,实现更好的成效
IBM BigInsights for Apache Hadoop经济高效地存储、管理和分析大数据
IBM InfoSphere Streams高效捕获和分析动态数据的软件平台
Watson Analytics具备理解,学习和推理能力,实现更智能的人机互动,帮助人们做出更好的决策
服务电话
重庆/ 023-68661681
华东/ 13452821722
华南/ 18100878085
华北/ 17347785263
客户支持
技术支持咨询服务
服务热线:400-700-1020
邮箱:sales@evget.com
关注我们
地址 : 重庆市九龙坡区火炬大道69号6幢
慧都科技 版权所有 Copyright 2003-
2025 渝ICP备12000582号-13 渝公网安备
50010702500608号