本文主要是介绍2.安装Spark与Python练习,对大家解决编程问题具有一定的参考价值,需要的程序猿们随着小编来一起学习吧!
一、安装Spark
1.检查基础环境hadoop,jdk
![](/upload/202203/08/202203082044590809.png)
![](/upload/202203/08/202203082044597899.png)
![](/upload/202203/08/202203082045001522.png)
2.下载spark
3.解压,文件夹重命名、权限
![](/upload/202203/08/202203082045008441.png)
![](/upload/202203/08/202203082045019784.png)
4.配置文件
![](/upload/202203/08/202203082045024672.png)
![](/upload/202203/08/202203082045031795.png)
5.环境变量
![](/images/baidian.png)
![](/upload/202203/08/202203082045049159.png)
![](/upload/202203/08/202203082045054241.png)
6.试运行Python代码
![](/upload/202203/08/202203082045060375.png)
![](/upload/202203/08/202203082045066048.png)
二、Python编程练习:英文文本的词频统计
- 准备文本文件
- 读文件
- 预处理:大小写,标点符号,停用词
- 分词
- 统计每个单词出现的次数
- 按词频大小排序
- 结果写文件
![](/upload/202203/08/202203082045069828.png)
![](/upload/202203/08/202203082045081061.png)
这篇关于2.安装Spark与Python练习的文章就介绍到这儿,希望我们推荐的文章对大家有所帮助,也希望大家多多支持为之网!