自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(8)
  • 收藏
  • 关注

原创 VM命令2

基本命令:1.mv + cp 1.mv 剪切 2.cp 复制 mv =》 文件个数 始终是1分 cp =》 文件个数 始终是2分 1.移动 [root@sygy10 bigdata]# mv 1.log ../1.log [root@sygy10 bigdata]# cp ~/1.log ./ 2.改名字 [root@sygy10 ~]# mv 1.log 1.log_blk ...

2022-04-14 23:41:50 844

原创 VM基本命令

1.基本命令 1.pwd 当前光标所在目录的位置 [root@sygy10 ~]# pwd /root 2.ls 【查看】当前光标所在目录的 下面有什么东西 [root@sygy10 ~]# ls ls 显示文件夹和文件名字 ls -l 显示文件夹和文件名字 详细信息 ls -l -a 显示文件夹和文件名字 详细信息 显示隐藏文件【 文件或者文件夹 以.开头的文件 】 ls ...

2022-04-12 22:05:52 9360

原创 numpy基础

机器学习: 1.概念 Simple and efficient tools for predictive data analysis 【预测数据分析结果】 用机器代替人做决策 数据集 =》 训练 =》 模型 2.Built on NumPy, SciPy, and matplotlib、pandas2.机器学习里面的常用术语 : 1.数据集准备 色泽= 绿色 、根=弯曲 、 敲声 = 浑浊 =》 熟的 ...

2022-04-06 21:32:12 1542

原创 scrapy

爬虫的框架:scrap :1.An open source and collaborative framework for extracting the data you need from websites.In a fast, simple, yet extensible way. 1.开源的爬虫框架 2.快速、简单、高效的方式2.安装部署3.基本使用 1.创建一个项目 scrapy startproject test_scrapy ...

2022-04-06 08:27:57 123

原创 scrapy爬虫命令

1.创建项目:scrapy startproject test_scrapy2. 找目录:cd .\test_scrapy\3.创建一个模板: scrapy genspider python01 www.xxx.com4.运行模板,看好使不:scrapy runspider .\test_scrapy\spiders\python01.py5.两种命令都试试: scrapy crawl python016.改参数,让它只报错:7.生成json文件:scrapy crawl pyt

2022-04-06 08:26:18 1387

原创 python1

1.函数: 函数 =》方法 【区别不大】 scala 【有区别】 1.内置函数 【 常用类的api】 1.数学相关的 【math 包下的】 2.自定义函数 3.匿名函数【没有名字的函数】 1.内置函数 【 常用类的api】 print(abs(-10)) #绝对值 print(max(1, 2, 3, 4, 5)) print(min(1, 2, 3, 4)) print(sum([1, 2, 3]))...

2022-03-31 21:27:37 346

原创 python2

爬虫: 1.百度百科 2.自己理解: 通过代码、模拟浏览器上网 然后抓取数据的过程 数据解析2.爬虫是否合法? 1.法律允许 2.有法律风险的3.统一规定? 【法律界限】 robots.txt协议4.爬虫的分类: 1.获取一整张页面 【通用爬虫】 2.获取一整张页面 部分数据 【聚焦爬虫】 3.检查页面更新、获取页面最新的更新的数据 【增量式爬虫】5.爬虫的规则: 1.反爬策略: 门户...

2022-03-31 21:27:05 74

原创 大数据专业:

面试:linux: tail -f F 区别hadoop: 读写流程、yarn、mapreduce【不会问的、shuffle】 hdfs: 小文件如何解决 nn ha yarn hahive: 1.sql 2.调优: 1.数据倾斜=》 join group by 2.使用过哪些参数flume:tail -f F 区别 ...

2022-03-31 21:24:09 1784

京东SKⅡ商品评论信息数据集

商品的名称、评论内容、评论时间、评分、销量等信息

2023-06-09

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除