标签：Shark

Shark迁移到Spark 1.1.0 编程指南

　　Spark 1.1.0马上就要发布了（估计就是明天），其中更新了很多功能。其中对Spark SQL进行了增强：　　1、Spark 1.0是第一个预览版本( 1.0 was the first “preview” release)；　　2、Spark 1.1 将支持Shark更新(1.1 provides upgrade path for Shark)，　　　　（1）、Replaced Shark in our benchmarks with 2-3X perfgains；　　　　（2）、Can perform optimizations with 10-

w397090770 11年前 (2014-09-11) 7793℃ 2评论5喜欢

Hadoop

SQL on Hadoop:场景和结论

以下文章是转载自国外网站，介绍了Hadoop生态系统上面的几种SQL：Hive、Drill、Impala、Presto以及Spark\Shark等应用场景、对比以及一些结论Within the big data landscape there are multiple approaches to accessing, analyzing, and manipulating data in Hadoop. Each depends on key considerations such as latency, ANSI SQL completeness (and the ability to tolerate machine-generated SQL), developer and a

w397090770 11年前 (2014-08-11) 9923℃ 0评论14喜欢

Shark

Shark 0.9.1安装遇到的问题及解决办法

这几天在集群上部署了Shark 0.9.1，我下载的是已经编译好的，Hadoop版本是2.2.0，下面就总结一下我在安装Shark的过程中遇到的问题及其解决方案。一、YARN mode not available ?[code lang="JAVA"]Exception in thread "main" org.apache.spark.SparkException: YARN mode not available ? at org.apache.spark.SparkContext$.org$apache$spark$SparkContext$$createTaskScheduler(SparkContext.

w397090770 11年前 (2014-05-05) 16094℃ 3评论4喜欢

HBase

Shark对Hive的兼容性总结

　　Shark是一种分布式SQL查询工具，它的设计目标就是兼容Hive，今天就来总结一下Shark对Hive特性的兼容。　　一、Shark可以直接部署在Hive的数据仓库上。支持Hive的绝大多数特性，具体如下： Hive查询语句，包括以下： SELECT GROUP_BY ORDER_BY CLUSTER_BY SORT_BY 支持Hive中所有的操作符：关系运算符（=, ⇔, ==, <>, <, &

w397090770 11年前 (2014-04-30) 7366℃ 1评论4喜欢

过往记忆

专注于大数据技术构架及应用，微信公众号:过往记忆大数据

标签：Shark

Shark迁移到Spark 1.1.0 编程指南

SQL on Hadoop:场景和结论

Shark 0.9.1安装遇到的问题及解决办法

Shark对Hive的兼容性总结