AWS SAA 题库
点击卡片任意位置翻面查看正确答案与解析,也可以用键盘 ← → 切换题目。
一家公司最近迁移到AWS云。公司希望针对大规模半结构化数据集实现无服务器的并行按需处理解决方案。数据包括存储在Amazon S3中的日志、媒体文件、销售交易和物联网传感器数据。公司希望解决方案能够并行处理数据集中的数千个项目。 哪种解决方案将以最高的运营效率满足这些要求?
解析
为了以最高的运营效率满足这些要求,应该选择选项B,即使用AWS Step Functions Map状态的分布式模式来并行处理数据。这种方法允许数据并行处理,以便同时处理数据集中的多个项目,同时还提供了灵活性和可扩展性。 其他选项的操作效率可能不如分布式模式的AWS Step Functions Map状态高: A 使用内联模式的AWS Step Functions Map状态通常用于较小的任务,不太适合大规模并行处理。 C AWS Glue通常用于ETL(抽取、转换和加载)任务,而不太适合大规模的并行数据处理。 D 使用多个AWS Lambda函数进行并行处理可能会涉及更多的手动管理和配置,而不如使用AWS Step Functions Map状态的分布式模式方便。
AI 解析
AWS Step Functions的Map状态支持两种模式来处理并行任务:内联(Inline)和分布式(Distributed)。根据AWS官方文档,分布式模式专为大规模并行处理设计,能够动态扩展子任务,每个子任务独立运行,无需等待其他任务完成,适合处理数千个数据项的场景。这种模式通过自动管理并发和资源分配,提升了处理效率。内联模式适用于较小规模或需要严格顺序控制的场景,而AWS Glue主要面向ETL批处理作业,Lambda直接调用需要额外编排。相比之下,分布式Map状态更贴合题目中大规模、无服务器、按需并行处理的要求。