首页>科技革命的历史现状与未来 > 第220章 大数据处理关键操作

第220章 大数据处理关键操作

目录

“当然可以,你拿去看吧,有什么意见尽管跟我说。”

李卫脸上挂着温和的笑容,语气客气地说道。

秦奕接过论文,迫不及待地开始快速浏览其中的关键论述——这篇论文主要阐述了并行程序中并行、汇聚、通讯、映射及归纳等机制的语义。

看着看着,他的眼中闪过一丝惊喜,这里面描述的不正是前世互联网大数据处理框架

mapreduce

里的基本操作吗!

前世,搜索引擎巨头谷歌在

2004

年前后发布了三篇奠定大数据处理基础的论文

——《the

google

file

system》《mapreduce:

simplified

data

processing

on

large

c露sters》《bigtable:

a

distributed

storage

system

for

structured

data》。

这三篇论文为大数据处理领域带来了全新的思路和方法,宛如一把火,瞬间点燃了学术界和工业界对大规模数据处理技术的研究热情,也有力推动了

hadoop

本章未完,点击下一页继续阅读



返回顶部