SAP-C02 学习助手

SAP-C02 第 281 题

S3 Redshift

题目

一家公司正在从一组物联网设备收集大量数据。数据作为优化行列式 (ORC) 文件存储在持久 Amazon EMR 集群上的 Hadoop 分布式文件系统 (HDFS) 中。该公司的数据分析团队使用部署在同一 EMR 集群上的 Apache Presto 中的 SQL 查询数据。查询会扫描大量数据,运行时间始终少于 15 分钟,并且仅在下午 5 点到晚上 10 点之间运行。该公司担心当前解决方案的高成本。解决方案架构师必须提出最具成本效益的解决方案,以允许 SQL 数据查询。哪种解决方案可以满足这些要求?

选项

A. 将数据存储在 Amazon S3 中。使用 Amazon Redshift Spectrum 查询数据。

B. 将数据存储在 Amazon S3 中。使用 AWS Glue 数据目录和 Amazon Athena 查询数据。

C. 将数据存储在 EMR 文件系统 (EMRFS) 中。在 Amazon EMR 中使用 Presto 查询数据。

D. 将数据存储在 Amazon Redshift 中。使用 Amazon Redshift 查询数据。

答案

B

解析

正确答案:B 解析: 题干关键点:成本控制、核心服务:S3, Redshift。 正确选项: B. 将数据存储在 Amazon S3 中。使用 AWS Glue 数据目录和 Amazon Athena 查询数据。 选择理由: 选项 B 的设计直接围绕题干限制展开,关键动作是 B. 将数据存储在 Amazon S3 中。使用 AWS Glue 数据目录和 Amazon Athena 查询数据。它把主要风险点落到托管服务或题干指定的架构路径...

登录后查看完整解析