本文主要是介绍2.安装Spark与Python练习,对大家解决编程问题具有一定的参考价值,需要的程序猿们随着小编来一起学习吧!
一、安装Spark
![](/upload/202203/06/202203062015414729.png)
环境配置:
![](/upload/202203/06/202203062015415681.png)
![](/upload/202203/06/202203062015416619.png)
启动spark:
![](/upload/202203/06/202203062015417732.png)
试运行python代码:
![](/upload/202203/06/202203062015418669.png)
二、Python编程练习:英文文本的词频统计
- 准备文本文件
- 读文件
- 预处理:大小写,标点符号,停用词
- 分词
- 统计每个单词出现的次数
- 按词频大小排序
- 结果写文件
思路:先读取文件文本内容,使用循环将内容中的每一个标点符号替换为空,再将内容所有字母替换为小写字母并分词,最后利用循环统计词频,并用列表储存进行排序,将结果显示。
文本截图:
![](/upload/202203/06/202203062015419621.png)
代码截图:
![](/upload/202203/06/202203062015420559.png)
运行结果截图:
![](/upload/202203/06/202203062015421355.png)
这篇关于2.安装Spark与Python练习的文章就介绍到这儿,希望我们推荐的文章对大家有所帮助,也希望大家多多支持为之网!