人工智能训练师三级高级工 详细题库
下载APP练习智能训练 题目预览
-
第 1 题 单选题在分布式数据处理工具中,将数据切分为多个分片并分发到不同节点并行计算,最后合并结果,这一核心机制称为( )。
- A. 数据并行
- B. 模型并行
- C. 流水线并行
- D. 内联缓存
解析:数据并行是将数据切分为多个分片,分发到不同计算节点并行处理,最后汇总结果,是分布式数据处理工具的核心机制之一。 -
第 2 题 单选题智能训练数据处理工具中,用于持续监测训练数据分布变化并发出告警的功能,主要解决( )。
- A. 数据缺失
- B. 数据漂移
- C. 数据重复
- D. 数据倾斜
解析:数据漂移指训练数据分布与历史分布或真实分布发生偏移,持续监测和告警是数据处理工具应对该问题的重要手段。 -
第 3 题 单选题在数据处理工具的“数据清洗”模块中,处理“同一用户ID在不同表中格式不一致”的问题,所依据的核心原理是( )。
- A. 数据分片
- B. 数据标注
- C. 数据标准化
- D. 数据聚合
解析:数据标准化是将不同格式或量纲的数据统一为一致表示,用于解决格式不一致、编码不统一等问题,属于数据清洗的常见处理方式。 -
第 4 题 单选题通用数据处理工具与专用数据处理工具的划分依据是( )。
- A. 是否支持分布式计算
- B. 是否支持GPU加速
- C. 是否开源
- D. 工具适用的数据场景范围
解析:通用工具适用范围广泛,专用工具针对特定数据类型或业务场景进行优化,因此划分依据是工具适用的数据场景范围。 -
第 5 题 判断题在数据并行模式下,每个计算节点都持有完整的训练数据集副本,各自独立训练出相同的模型。
- A. 对
- B. 错
解析:数据并行是将数据切分为多个分片,分发到不同计算节点分别处理,各节点持有的是数据分片,而不是完整的训练数据集副本。 -
第 6 题 判断题抽取-转换-加载工具中的“转换”环节,其主要功能是将清洗后的数据转换为目标系统或模型可用的格式。
- A. 对
- B. 错
解析:抽取-转换-加载包含抽取、转换、加载三个环节,转换环节负责数据格式、结构和表示形式的变换,以便后续存储或模型使用。 -
第 7 题 多选题关于分布式数据处理工具中的“数据倾斜”现象,下列说法正确的有( )。
- A. 会导致部分计算节点负载过高,拖慢整体任务
- B. 可通过重新设计分区键或增加随机前缀缓解
- C. 与数据分布无关
- D. 只发生在流处理工具中
- E. 是数据清洗工具必须消除的永久性错误
解析:数据倾斜由数据分布不均或分区键设计不当引起,会造成部分节点负载过高;可通过优化分区策略、增加随机前缀等方式缓解,其并不只发生在流处理工具中,也不是数据清洗工具能永久消除的错误。 -
第 8 题 多选题关于智能训练数据处理工具的分类维度,下列对应关系正确的有( )。
- A. 按数据处理时延分为离线处理工具和在线处理工具
- B. 按处理架构分为单机工具和分布式工具
- C. 按数据形态分为结构化、半结构化和非结构化数据工具
- D. 按部署方式分为云上工具和本地工具
- E. 按算法复杂度分为监督学习工具和无监督学习工具
解析:数据处理工具可从处理时延、处理架构、数据形态、部署方式等多个维度分类;监督学习与无监督学习属于机器学习任务类型,不是数据处理工具的分类维度。
余下详情题库请下载 APP 或扫码小程序查看全部题目与智能刷题。