首页>科技革命的历史现状与未来 > 第220章 大数据处理关键操作
第220章 大数据处理关键操作
“当然可以,你拿去看吧,有什么意见尽管跟我说。”
李卫脸上挂着温和的笑容,语气客气地说道。
秦奕接过论文,迫不及待地开始快速浏览其中的关键论述——这篇论文主要阐述了并行程序中并行、汇聚、通讯、映射及归纳等机制的语义。
看着看着,他的眼中闪过一丝惊喜,这里面描述的不正是前世互联网大数据处理框架
mapreduce
里的基本操作吗!
前世,搜索引擎巨头谷歌在
2004
年前后发布了三篇奠定大数据处理基础的论文
——《the
file
system》《mapreduce:
simplified
data
processing
on
large
c露sters》《bigtable:
a
distributed
storage
system
for
structured
data》。
这三篇论文为大数据处理领域带来了全新的思路和方法,宛如一把火,瞬间点燃了学术界和工业界对大规模数据处理技术的研究热情,也有力推动了
hadoop
本章未完,点击下一页继续阅读