ビッグデータ処理基盤(Hadoop・MapReduce)とは?
ビッグデータ処理基盤(Hadoop・MapReduce)とは、大量データを多数の安価なサーバへ分散して蓄積・処理する仕組み。分散ファイルシステム(HDFS)がデータを複製しながら分割保持し、MapReduceが「分割して各ノードで処理(Map)→集約(Reduce)」の2段階で並列計算する。
応用情報技術者試験の過去問では2回出題されています(2017年度〜2021年度)。
びっぐでーたしょりきばん
ビッグデータ処理基盤(Hadoop・MapReduce)の意味
大量データを多数の安価なサーバへ分散して蓄積・処理する仕組み。分散ファイルシステム(HDFS)がデータを複製しながら分割保持し、MapReduceが「分割して各ノードで処理(Map)→集約(Reduce)」の2段階で並列計算する。
ビッグデータ処理基盤(Hadoop・MapReduce)の具体例
1TBのアクセスログからURL別の件数を数える場合、各ノードが担当ブロックを読んで(URL,1)を出力し、同じURLを1ノードへ集めて合計する。ノードを増やせばほぼ台数に比例して時間が短くなる。
ビッグデータ処理基盤(Hadoop・MapReduce)は試験でどう引っ掛けられる?
台数を増やせば必ず速くなるわけではない。Map結果をネットワーク越しに集めるシャッフル段が支配的になると台数効果が頭打ちになる。またレコード単体の低遅延応答には向かず、バッチ向きである点も狙われる。
ビッグデータ処理基盤(Hadoop・MapReduce)と関連する用語
ビッグデータ処理基盤(Hadoop・MapReduce)が出た過去問
Hadoopの説明はどれか。
正解:大規模なデータを分散処理するためのソフトウェアライブラリ
要点:Hadoopは大規模データを分散処理する基盤
Hadoopは大量のデータを多数のサーバに分散して蓄積・処理するためのオープンソースのソフトウェアライブラリ群である。分散ファイルシステムHDFSと、MapReduceに代表される分散処理の枠組みを中核とする。
出典:平成29年度 秋期 応用情報技術者試験 午前 問19(IPA)Hadoopの説明はどれか。
正解:大規模なデータセットを分散処理するためのソフトウェアライブラリ
要点:Hadoopは大規模データを分散処理するOSS基盤
Hadoopは大規模データを多数のマシンに分散して蓄積・処理するためのオープンソースのソフトウェア基盤で、分散ファイルシステムHDFSと分散処理フレームワークMapReduceを中核とする。ビッグデータ処理の代表的な実装である。
出典:令和3年度 春期 応用情報技術者試験 午前 問20(IPA)
最終更新:2026-08-25/解説は資格暗記が独自に作成しています。 過去問の出典は各問題に記載のとおりです。