Spark3.0的新特性有哪些

本篇内容主要讲解“Spark3.0的新特性有哪些”,感兴趣的朋友不妨来看看。本文介绍的方法操作简单快捷,实用性强。下面就让小编来带大家学习“Spark3.0的新特性有哪些”吧!

为玉山等地区用户提供了全套网页设计制作服务,及玉山网站建设行业解决方案。主营业务为成都网站设计、做网站、玉山网站设计,以传统方式定制建设网站,并提供域名空间备案等一条龙服务,秉承以专业、用心的态度为用户提供真诚的服务。我们深信只要达到每一位用户的要求,就会得到认可,从而选择与我们长期合作。这样,我们也可以走得更远!

Spark 3.0 主要的新特性如下:

  • 相比于Spark2.4,性能提升了2倍,主要体现在自适应查询执行,动态分区修剪等方面。

  • Pandas API改动,包括Python类型的提示和UDF函数。

  • 对于PySpark的异常处理进行了增强。

  • 新的Structured Streaming UI页面。

  • 而且解决了大量Jira问题。

Structured Streaming最初于Spark 2.0引入,并且停止了SparkStreaming的更新,很明显Structured Streaming的出现是为了在实时计算领域可以与对水印,窗口等支持更好的Flink一战。

3.0版本添加Structured Streaming的专用UI,可以方便的查看流作业的执行信息。

Spark3.0的新特性有哪些

虽然与Flink比起来,Structured Streaming还有很长的路要走,但是可以期待Spark 3.0版本对于Structured Streaming的持续加强。

到此,相信大家对“Spark3.0的新特性有哪些”有了更深的了解,不妨来实际操作一番吧!这里是创新互联网站,更多相关内容可以进入相关频道进行查询,关注我们,继续学习!


网站标题:Spark3.0的新特性有哪些
文章地址:http://azwzsj.com/article/ppdihe.html