首页 > Python资料 博客日记

hadoop的MapReduce

2024-10-20 11:00:06Python资料围观31

文章hadoop的MapReduce分享给大家,欢迎收藏Python资料网,专注分享技术知识

1.什么是计算(广义): 内容分析, 得到需要的结果

     也就是一系列, 基于数据得出的结论。 这些就是我们所说的计算。

2.分布式计算模式:

    一:分散-汇总模式:数据分片,多个服务器负责各个部分数据处理,最后结果汇总

    二:中心调度模式: 1. 由一个节点作为中心调度管理者 2. 将任务划分为几个具体步骤 3. 管理者安排每个机器执行任务 4. 最终得到结果数据

3.MapReduce(hadoop的计算组件)(hive的底层工具)

   一:利用的是分散-汇总模式

   二:编程接口:map(分散)与reduce(汇总)


版权声明:本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:jacktools123@163.com进行投诉反馈,一经查实,立即删除!

标签:

相关文章

本站推荐