多数のサーバで構成された大規模な分散ファイルシステム機能を提供し、MapReduceによる大規模データの分散処理を実現するOSSはどれか。
HadoopはHDFSとMapReduceによる大規模分散処理のOSS基盤
選択肢
- アApache Hadoop
- イApache Kafka
- ウApache Spark
- エApache Storm
正解と解説
正解:ア Apache Hadoop
大量データを多数のサーバに分散配置し、MapReduceという枠組みで並列に処理する基盤を提供するOSSがApache Hadoopである。分散ファイルシステムのHDFSとMapReduceの2つが中核で、いわゆるビッグデータ処理の代表的な基盤として位置づけられる。同じApache系でも、メッセージ配信やインメモリ処理など役割の異なる製品と混同しないようにしたい。
選択肢ごとの解説
- ア正しい。HDFSとMapReduceを備えた分散処理基盤がHadoop。
- イKafkaは大量のメッセージを流すための分散メッセージング基盤。
- ウSparkはインメモリ処理を特徴とする分散処理エンジンで、分散ファイルシステムは持たない。
- エStormはストリームデータをリアルタイムに処理する基盤。
同じ分野の他の問題
- データマイニングの手法の一つであって,POSなどの蓄積データから“一緒に買われる商品”の組合せを発見する分析手法はどれか…2025年度 公開問題 科目A 問16
- ビッグデータのデータ貯蔵場所であるデータレイクの特徴として、適切なものはどれか。2022年度 公開問題 科目A 問23
- ビッグデータの活用例として,大量のデータから統計学的手法などを用いて新たな知識(傾向やパターン)を見つけ出すプロセスはど…2017年度 春期 午前 問29
- 次のSQL文によって定義され,値が格納されている"商品"表に対して,制約違反で実行エラーとなるSQL文はどれか。 〔SQ…2026年度 公開問題 科目A 問7
- E-Rモデルにおけるエンティティの特徴はどれか。2025年度 公開問題 科目A 問11
最終更新:2026-08-25/解説・選択肢ごとの解説は資格暗記が独自に作成しています。問題文と選択肢の出典は上記のとおりです。