Spark-shell批量命令执行脚本的方法

时间：2021-05-26 08:14:00 | 栏目：Shell | 点击：次

批量执行spark-shell命令，并指定提交参数

#!/bin/bash

source /etc/profile

exec $SPARK_HOME/bin/spark-shell --queue tv --name spark-sql-test --executor-cores 8 --executor-memory 8g --num-executors 8 --conf spark.cleaner.ttl=240000 <<!EOF
import org.apache.spark.sql.SaveMode
sql("set hive.exec.dynamic.partition=true")
sql("set hive.exec.dynamic.partition.mode=nonstrict")
sql("use hr")
sql("SELECT * FROM t_abc ").rdd.saveAsTextFile("/tmp/out") 
sql("SELECT * FROM t_abc").rdd.map(_.toString).intersection(sc.textFile("/user/hdfs/t2_abc").map(_.toString).distinct).count
!EOF

您可能感兴趣的文章:

shell 备份数据库、代码上线的脚本
shell脚本之判断输入参数是否为整数值的实例
shell随机定时修改密码change_passwd.sh
bash脚本中if语句的使用方法
linux 守护进程详解及建立守护进程

相关文章

12-29Linux bash Shell中的变量类型详解
01-05Linux Bash 提示符的一些骚操作(自定义 Bash 提示符)
01-07linux下防火墙开启某个端口号及防火墙常用命令使用(详解)
10-15Linux基础命令last 命令实例详解
01-08Shell编程中while与for的区别及用法详解