
hadoop
文章平均质量分 84
gary
对3G通信协议,核心网,海量数据处理,NoSql和大规模并发的分布式集群都感兴趣
展开
-
谷歌三大核心技术(一)Google File System
摘要我们设计并实现了Google GFS文件系统,一个面向大规模数据密集型应用的、可伸缩的分布式文件系统。GFS虽然运行在廉价的普遍硬件设备上,但是它依然了提供灾难冗余的能力,为大量客户机提供了高性能的服务。 虽然GFS的设计目标与许多传统的分布式文件系统有很多相同之处,但是,我们的设计还是以我们对自己的应用的负载情况和技术环境的分析为基础 的,不管现在还是将来,GFS和早期的分转载 2012-08-05 12:50:57 · 4439 阅读 · 0 评论 -
谷歌三大核心技术(二)Google MapReduce
摘要MapReduce是一个编程模型,也是一个处理和生成超大数据集的算法模型的相关实现。用户首先创建一个Map函数处理一个基于 key/value pair的数据集合,输出中间的基于key/value pair的数据集合;然后再创建一个Reduce函数用来合并所有的具有相同中间key值的中间value值。现实世界中有很多满足上述处理模型的例子, 本论文将详细描述这个模型。 Map转载 2012-08-05 12:54:21 · 4328 阅读 · 0 评论 -
谷歌三大核心技术(三)Google BigTable
摘要Bigtable是一个分布式的结构化数据存储系统,它被设计用来处理海量数据:通常是分布在数千台普通服务器上的PB级的数据。Google的很 多项目使用Bigtable存储数据,包括Web索引、Google Earth、Google Finance。这些应用对Bigtable提出的要求差异非常大,无论是在数据量上(从URL到网页到卫星图像)还是在响应速度上(从后端的批量处理到 实时数据服务)转载 2012-08-05 13:09:36 · 6223 阅读 · 0 评论