贾永琪的技术博客

Hive的hiveserver2和beeline的使用以及spark thritfserver的启动

本文详细介绍了HiveServer2的配置,包括最小和最大工作线程数、监听端口和绑定地址,并展示了如何使用beeline连接HiveServer2。此外,还探讨了SparkThriftServer的配置,以及它与HiveServer2和spark-sql的对比,强调了其在应用复用方面的优势。最后,展示了如何通过beeline连接SparkThriftServer,并给出了使用sparksql程序连接ThriftServer的示例。

使用maven集成java和scala开发环境

本文档详细介绍了如何使用Maven搭建一个包含Scala和Spark的开发环境。首先创建一个普通的Maven项目,然后在父项目中配置Scala依赖,并在子项目中引入。接着配置Scala插件,安装Scala SDK,编写并运行Scala的HelloWorld程序。随后,配置Maven的各种插件,如maven-compile-plugin、maven-scala-plugin、maven-jar-plugin、maven-dependency-plugin和maven-assembly-plugin,用于编译、打包和依赖管理。最后,通过maven-assembly-plugin创建可执行的jar包,并演示了如何在Spark集群上运行该程序。

spark源码编译和集群部署以及idea中sbt开发环境集成

spark源码编译和集群部署以及idea中sbt开发环境集成源码下载源码编译maven 下载scala 下载编译参数编译编译分发的二进制包单机启动集群部署开发环境集成源码编译的3.2.0版本无法在window上直接用spark-shell启动总结项目地址:https://gitee.com/jyq_18792721831/studyspark.git源码下载打开Apache Spark™ - Unified Engine for large-scale data analytics,下载源码在下载_spark 源码编译与部署

hadoop集群的搭建以及hadoop的配置

hadoop集群的搭建以及hadoop的配置环境说明与目的配置说明准备hadoop-env.shcore-site.xmlhdfs-site.xmlyarn-site.xmlmapred-site.xmllog4j.propertiesssh 免密启动验证界面任务历史任务提交总结环境说明与目的准备:我自己准备了三台虚拟机在windows平台上使用Hyper-V搭建虚拟机集群环境_a18792721831的博客-CSDN博客环境如下主机nameNodedataNoderesourceMa_修改hadoop-env. sh说hadoop没有找到

Hive 安装、配置、数据导入和使用

Hive 安装、配置、数据导入和使用Hive 下载Hive 的环境Hive 配置Hive 数据导入总结Hive 下载首先到Apache Hive TM下载软件随便写一个,都比较慢下载二进制文件Hive 的环境首先将下载的压缩包上传到linux中将下载后的压缩包解压到合适的位置tar -zxvf apache-hive-2.3.9-bin.tar.gz然后配置环境变量vi ~/.bash_profile将HIVE_HOME配置到Path中增加HIVE_HOME=/hive_hive系统配置及数据导入

windows下搭建hadoop

windows下搭建hadoop下载环境变量windows 脚本替换配置windows权限启动单词统计实例下载首先去Apache Hadoop下载hadoop的安装包选择二进制文件即可选择国内镜像增加下载速度下载后解压到文件夹环境变量设置环境变量HADOOP_HOME然后把HADOOP_HOME加入Path中打开cmd,输入hadoop version验证windows 脚本替换到cdarlint/winutils: winutils.exe hadoop.dll and_windows下搭建hadoop