一、互联网时代背景下大机遇,为什么要用NoSql?
在90年代,一个网站的访问量并不大,用单个数据库完全可以轻松应付,那个时候,更多的都是静态网页,动态交互的网站并不多。
从上述架构下,我们来看看数据存储的瓶颈是什么?
假设一下,现在数据量翻一百倍上去呢?
1)数据量总大小 一个机器放不下时;
2)数据的索引(B+Tree)一个机器放不下时;
3)访问量(读写混合)一个实例不能承受时
如果满足上述1或者3个条件时,就需要进化...
二、Memcached(缓存)+ MySQL + 垂直拆分
随着访问量上升,几乎大部分使用MySQL架构的网站在数据库上都开始出现性能问题,web程序不在仅仅专注在功能上,同时也在追求性能。程序员们开始大量使用缓存技术来缓解数据库的压力,优化数据库的结构和索引。开始比较流行的是通过文件缓存来缓解数据库的压力,但是当访问量继续增大时,多台web机器通过文件缓存不能共享,大量的小文件缓存也带来了比较高的IO压力,在这个时候,Memcached就自然成为了一个非常流行的技术产品。
三、MySQL主从复制读写分离
由于数据库的写入压力增加,Memcached只能缓解数据库的读取压力。读写集中在一个数据库上让数据库不堪重负,打部分网站开始使用主从复制的技术来达到读写分离,以提高读写性能的可扩展性。MySQL的master-slave模式成为这个时候的网站标配了。
四、分库分表 + 水平拆分 + MySQL集群
在Memcached的高速缓存,MySQL的主从复制,读写分离的基础上,这时MySQL主库的写压力开始出现瓶颈,而数据量的持续猛增,由于MyISAM使用表锁,在高并发下会出现严重的锁问题,大量的高并发MySQL应用开始使用InnoDB引擎代替MyISAM。
同时,开始流行使用分库分表来缓解写压力和数据增长的问题,这个时候,分表分库成了一个热门技术,在这个时候MySQL推出了还不太稳定的表分区,这也给技术实力一般的公司带来了希望,虽然MySQL推出了MySQL cluster集群,但性能不能很好满足互联网的要求,只是在高可靠性上提供了非常大的保证。
五、MySQL的扩展性瓶颈
MySQL数据库也经常存储一些大文本字段,导致数据库表非常的大,在做数据库恢复时就导致非常慢,不容易快速恢复数据库,比如100G万4Kb大小的文本就接近40Gb大小,如果能把这些数据从MySQL中省去,MySQL将变得非常小,关系型数据库很强大,但是它不能很好的应付所有应用场景,MySQL的扩展性差(需要负责的技术来实现),大数据下IO压力大,表结构更改困难,正是当前使用MySQL开发人员面临的难题。
六、今天是什么样子?
七、为什么要用NoSql?
如今我们可以通过第三放平台(如:goole,FaceBook等),可以很容易的访问和抓取数据。用户的个人信息,社交网络,地理位置,用户生成的数据和用户的操作日志已经成倍增加,我们如果要对用户数据进行挖掘,那SQL数据库已经不适合这些应用了,NoSQL数据库的发展却能很好的处理这么大的数据。
八、什么是NoSQL?
泛指非关系型数据库,即Not Only SQL。
随着互联网web2.0网站的兴起,传统的关系型数据库在应对web2.0网站,特别是超大规模和高并发的SNS类型的web2.0纯动态网站以力不从心,暴力很多难以克服的问题。
NoSQL数据库的产生就是为了解决大规模数据集合多重数据类型的解决方案,尤其是大数据应用难题,包括超大规模数据存储。这类的数据存储不需要固定的模式,无需多余操作就可以横向扩展。
如:Redis,Memcache,Mongdb。
九、NoSQL的优点
1)方便扩展
NoSQL数据库种类繁多,但是它们都有一个特点就是:去掉了关系型数据库的关系型数据(主外键关系),使得数据之间无关系,这样就很容易扩展,在架构方面上带来了可扩展的能力。
2)大数据量下的高性能
NoSQl数据库具有非常高的读写性能,尤其是在大数据量下,同样表现优秀。虽然一般MySQL自带缓存,但是一旦表更新Cache就失效,性能不高,而NoSQL的Cache就一种细粒度的Cahce,所以在这个层面上NoSQL的性能就高很多了。
3)多样灵活的数据模型
NoSQL无需事先为存储数据建立字段,可以随时存储自定义数据格式,那么试想一下在传统的关系型数据库中,在一个有着上亿数据的表中,增加字段是不是很恐怖。
十、传统关系型数据库(RDBMS)和非关系型数据库(NoSQL)的区别
RDBMS
高度组织化结构数据
结构化查询语言(sql)
数据和关系都存储在单独的表中
数据操纵语言,数据定义语言
严格的一致性
基础事务
NoSQL
不仅仅是SQL
没有声明性查询语言
没有预定义的模式
k-v存储,列存储,文档存储,图形数据库
最终一致性,非ACID,强调CAP定理
非结构化和不可预知的数据
高性能,高可用,可伸缩性