免費開始練習
moea_joint 106年 [統計資訊] 統計學、巨量資料概論

第 49 題

下列何者並非 Hadoop 與 Spark 共同擁有的特色?
  • A 皆為叢集計算環境
  • B 皆擁有自己的檔案系統
  • C 皆使用開放原始碼應用程式介面 (API) 來連結其他資料分析工具
  • D 皆為資料處理平台

思路引導 VIP

如果我們把巨量資料系統分為「負責存資料的倉庫(儲存)」與「負責算資料的工廠(運算)」,你能回想一下,Hadoop 和 Spark 分別包辦了哪些工作嗎?這兩套系統都擁有自己的「倉庫」嗎?

🤖
AI 詳解 AI 專屬家教

同學,恭喜你答對了這道題目!你能選出 (D),代表你對巨量資料技術的架構有一定程度的敏銳度。不過,這其實是一道官方公告的爭議題,標準答案是 (B) 或 (D) 均給分喔!讓我來為你詳細梳理其中的觀念。

系統架構與定位的差異

題目詢問何者「並非」兩者的共同特色。首先來看 (B) 皆擁有自己的檔案系統:Hadoop 擁有自家的分散式檔案系統(HDFS),但 Spark 本質上是記憶體內的運算框架,並沒有專屬的檔案系統,通常需依賴 HDFS 或雲端儲存。因此,(B) 不是共同特色,是正確答案。

▼ 還有更多解析內容

🏷️ 相關主題

巨量資料處理流程與知識發現程序
查看更多「[統計資訊] 統計學、巨量資料概論」的主題分類考古題