尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

使用dataGrip连接spark

发布时间:2026/9/17 1:01:42

资讯中心
01
ARTICLE

使用dataGrip连接spark

使用dataGrip连接spark
概述spark的配置共有5种1、本地模式2、集群模式standalone yarnk8smesos四种集群模式spark本身只是一个计算引擎是没有数据库的所以说数据需要在hdfs上存放而数据库就是使用hive都已经启动hdfs了就使用yarn模式即可而使用standalone模式就不合适了。因此以下的配置是基于hdfsyarnspark进行配置的。一、配置要想spark知道hive中所有的数据库那么就需要将spark和metastore服务联系起来1、在hive下的hive-site.xml中添加property namehive.metastore.schema.verification/name valuefalse/value /property2、将hive的该文件复制到spark的conf下cp /opt/installs/hive/conf/hive-site.xml /opt/installs/spark/conf3、分发一下spark中的该文件xsync.sh opt/installs/spark/conf/hive-site.xml二、启动1、启动hadoop 2、启动metastore 3、启动Spark Thrift Server启动ThriftServer若已经启动过hiveserver2 那么记得将端口号改为10001opt/installs/spark/sbin/start-thriftserver.sh \ --hiveconf hive.server2.thrift.port10000 \ --hiveconf hive.server2.thrift.bind.hostbigdata01 \ --master yarn \ --conf spark.sql.shuffle.partitions2hiveServer2 和 thriftserver的区别只需访问 Hive 表无需 Spark 的计算能力使用 HiveServer2更简单且原生支持 Hive 功能。需要访问 Hive 表并利用 Spark 的计算引擎使用 Spark Thrift Server可以充分利用 Spark 的分布式计算能力。
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。