一、安装Spark
1.检查基础环境hadoop,jdk
2.下载spark
3.解压,文件夹重命名、权限
4.配置文件
5.环境变量
6.试运行Python代码
二、Python编程练习:英文文本的词频统计
1.准备文本文件
2.读文件,预处理:大小写,标点符号,停用词,分词,统计每个单词出现的次数,按词频大小排序
7.结果写文件
来源:https://www.cnblogs.com/Luirc/p/15981261.html
本站部分图文来源于网络,如有侵权请联系删除。