- 博客(4)
- 收藏
- 关注
原创 Python爬虫
爬虫: 1.百度百科 2.自己理解: 通过代码、模拟浏览器上网 然后抓取数据的过程 2.爬虫是否合法? 1.法律允许 2.有法律风险的 3.统一规定? 【法律界限】 robots.txt协议 4.爬虫的分类: 1.获取一整张页面 【通用爬虫】 2.获取一整张页面 部分数据 【聚焦爬虫】 3.检查页面更新、获取页面最新的更新的数据 【增量式爬虫】 5.爬虫的规则: 1.反爬策略: 门户网站 通过...
2022-04-22 10:34:35
71
原创 Python函数
1.函数: 函数 =》方法 【区别不大】 scala 【有区别】 1.内置函数 【 常用类的api】 1.数学相关的 【math 包下的】 2.自定义函数 3.匿名函数【没有名字的函数】 1.内置函数 【 常用类的api】 print(abs(-10)) #绝对值 print(max(1, 2, 3, 4, 5)) print(min(1, 2, 3, 4)) print(sum([1, 2, 3])) ...
2022-04-22 10:33:53
56
原创 机器学习1
机器学习: 1.概念 Simple and efficient tools for predictive data analysis 【预测数据分析结果】 用机器代替人做决策 数据集 =》 训练 =》 模型 2.Built on NumPy, SciPy, and matplotlib、pandas 2.机器学习里面的常用术语 : 1.数据集准备 色泽= 绿色 、根=弯曲 、 敲声 = 浑浊 =》 熟的 ...
2022-04-22 10:33:13
57
原创 linux
linux模板机: 1. ip 动态ip =》静态ip 1.内网 2.学习方便 2.关闭防火墙 : 1-65535 关闭防火墙 3.额外的安装包 : 1.jdk =》 卸载掉 2.mysql =》 mysql自带的额外包【安装mysql 去掉就行】 【superset mysql自带的额外包】 ip: 1.win =》 vmware : ...
2022-04-22 09:58:39
54
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人