当前位置: 首页 > news >正文

一键抓取的网站怎么做seo需要懂代码吗

一键抓取的网站怎么做,seo需要懂代码吗,苏州园区属于哪个区,婚纱网站免费源码简介 注意: 在部署spark集群前,请部署好Hadoop集群,jdk8【当然Hadoop集群需要运行在jdk上】,需要注意hadoop,spark的版本,考虑兼容问题。比如hadoop3.0以上的才兼容spark3.0以上的。 下面是Hadoop集群部署…

简介

 

注意:

在部署spark集群前,请部署好Hadoop集群,jdk8【当然Hadoop集群需要运行在jdk上】,需要注意hadoop,spark的版本,考虑兼容问题。比如hadoop3.0以上的才兼容spark3.0以上的。

下面是Hadoop集群部署的链接,个人笔记,已经成功部署两次了,实时更新,分【一】【二】两部分,需要的自己看。不懂欢迎问,看到了解答。(链接失效的话请参考个人主页)

hadoop集群部署【一】HDFS集群icon-default.png?t=N7T8http://t.csdnimg.cn/BVKlqhadoop集群部署【二】YARN,MapReduce集群icon-default.png?t=N7T8http://t.csdnimg.cn/aJJt7

 搭建准备工作:

需要python环境,上传Anaconda,找到放置的位置。

安装Anaconda

在node1(我的第一台机器名)安装Anaconda(我的是Anaconda3-2021.05-Linux-x86_64.sh         版本python3.8)

sh ./Anaconda3-2021.05-Linux-x86_64.sh

然后一直空格,出现[yes|no] 就回答yes,懂?

出现这样的就填你要把anaconda安装到哪里。(路径)

完成后结果(退出终端,重新进来)

更改conda国内源

vim ~/.condarc(新建的,一般里面没东西)

channels:- defaults
show_channel_urls: true
default_channels:- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/main- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/r- https://mirrors.tuna.tsinghua.edu.cn/anaconda/pkgs/msys2
custom_channels:conda-forge: https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloudmsys2: https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloudbioconda: https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloudmenpo: https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloudpytorch: https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloudsimpleitk: https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloud

终端输入 

python

 创建spark运行的虚拟环境

conda create -n pyspark python=3.8
 切换虚拟环境
conda activate pyspark

 

Spark Local部署

上传解压spark

(我的是 spark-3.2.0-bin-hadoop3.2.tgz)

通过什么工具不管,能上传就行。

找到spark上传的位置,cd 进到该目录,不进去也行,自己在前面加路径哈!解压。

 tar -zxvf spark-3.2.0-bin-hadoop3.2.tgz -C /export/server spark-3.2.0-bin-hadoop3.2/

-C 参数后跟解压到哪(路径)

cd /export/server    #填你自己解压的路径

 建立软链接

 ln -s spark-3.2.0-bin-hadoop3.2/ spark
ll

 配置环境变量

vim /etc/profile

export SPARK_HOME=/export/server/spark
export PYSPARK_PYTHON=/export/server/anaconda3/envs/pyspark/bin/python3.8
export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop
:wq
source /etc/profile
vim /root/.bashrc

添加 

export JAVA_HOME=/export/server/jdk
export PYSPARK_PYTHON=/export/server/anaconda3/envs/pyspark/bin/python3.8
:wq

启动spark local模式

pyspark

进入spark的bin路径下

cd /export/server/spark/bin  # 注意路径
./pyspark

 运行下面代码,结果参考上图

sc.parallelize([1,2,3,4,5]).map(lambda x:x *10).collect()

可以通过游览器输入node1:4040查看监控页面(多个进程不会起冲突,具体监控页面的端口看上图spark版本下面第二行)

Ctrl+d退出

scala交互式界面
./spark-shell

 Ctrl+d退出

提交python文件(参考spark自带的案例文件pi.py    求圆周率,参数10 迭代十次)
./spark-submit --master local[*] /export/server/spark/examples/src/main/python/pi.py 10

 提交文件没有监控界面

http://www.ds6.com.cn/news/67334.html

相关文章:

  • 有没有可以做司考真题的网站企业推广的渠道有哪些
  • 网站开发顺序今日军事新闻头条最新
  • 互动网门户网站建设网络营销常用的方法有哪些
  • 怎让做淘宝网站网站制作郑州
  • 培训网站建设情况b2b平台排名
  • 网站为什么要续费seo是哪个英文的简写
  • 做直播网站需要证书吗哈尔滨seo和网络推广
  • 幼儿园网站建设方案结语seo网络推广经理
  • 建一个营销网站的步骤b2b免费发布信息平台
  • 网页网站开发助理网络营销专业学校排名
  • 40万用户自助建站营销策略手段有哪些
  • 域名估价哪个网站准确百度网盘怎么提取别人资源
  • 谷歌系平台推广seo的工作流程
  • oa连接到网站的链接怎么做seo入门培训学校
  • php网站留言板怎么做店铺推广软文500字
  • 扬州建设公司网站网站快速收录软件
  • 怎样建立静态网站抖音关键词优化
  • 爱站seo北京seo推广公司
  • 哪里有手机网站建设联系方式关键词搜索优化
  • 如何添加网站图标全网营销代理加盟
  • 公司网站没备案注册网站在哪里注册
  • 哪个网站可以做危险化学品供求谷歌seo顾问
  • wordpress站点字体修改品牌推广活动策划案例
  • 南隼深圳网站建设app如何推广以及推广渠道
  • js特效网站展示百度竞价一个月5000够吗
  • 重庆网站自己推广百度竞价seo排名
  • 网站开发工具js新网站快速排名软件
  • c2c网站建设价格游戏加盟
  • 教做饮品的网站谷歌ads
  • 建设银行网站用户名是什么意思网站备案查询