人工智能工程技术人员四级中级工-自然语言及语音处理产品实现 详细题库
下载APP练习常用模型的使用方法如文本生成目标检测、图像分割、机器翻译等 题目预览
-
第 1 题 单选题在基于变换器的自回归文本生成模型中,解码器在每一步生成下一个词时,常使用( )来平衡生成文本的多样性与质量。
- A. 温度参数
- B. 学习率
- C. 批大小
- D. 隐藏层维度
解析:温度参数通过调整softmax分布的平滑度,控制随机采样的随机性,低温度使分布尖锐偏向高概率词,高温度增加多样性,从而平衡多样性与质量。 -
第 2 题 单选题文本生成中,使用束搜索时,束宽越大,通常会导致生成文本的( )降低。
- A. 连贯性
- B. 正确性
- C. 多样性
- D. 效率
解析:束宽越大,候选序列越多,但束搜索倾向于选择高概率路径,导致生成的文本更保守,多样性降低。 -
第 3 题 单选题在训练文本生成模型时,教师强制(teacher forcing)策略是指( )。
- A. 使用模型自身预测作为下一输入
- B. 使用真实目标词作为下一输入
- C. 使用随机词作为下一输入
- D. 使用前一个隐状态作为输入
解析:教师强制在每一步使用真实的目标词作为解码器的输入,而不是模型自身预测的词,有助于加速训练。 -
第 4 题 单选题对于基于变分自编码器的文本生成模型,其损失函数除了重构损失外,另一项是( )。
- A. 梯度惩罚
- B. 对抗损失
- C. 标签平滑
- D. KL散度
解析:变分自编码器的损失函数包含重构误差和KL散度,用于约束潜在空间的分布。 -
第 5 题 判断题在文本生成中,使用束搜索且束宽为1时,等价于贪心搜索。
- A. 对
- B. 错
解析:束宽为1时,每一步只保留一个最优候选,即贪心选择当前最大概率词,因此等价于贪心搜索。 -
第 6 题 判断题在文本生成中,使用温度参数为0时,相当于随机采样。
- A. 对
- B. 错
解析:温度参数为0时,softmax输出变为one-hot形式(除最大概率词外其余几乎为0),实际等价于贪心搜索,而不是随机采样。 -
第 7 题 多选题关于文本生成中的束搜索,下列哪些描述是正确的?
- A. 束搜索可以保证找到全局最优序列
- B. 束搜索在每一步保留多个候选序列
- C. 束宽越大,计算成本越高
- D. 束搜索常用于机器翻译等任务
- E. 束搜索在每一步只保留一个最佳序列
解析:束搜索不能保证全局最优,是一种近似搜索;每一步保留束宽个候选序列;束宽大计算成本高;常用于机器翻译等生成任务;E选项错误。 -
第 8 题 多选题在文本生成中,为了控制生成文本的多样性和质量,常用的解码策略包括哪些?
- A. 温度采样
- B. 顶部K采样
- C. 核采样
- D. 束搜索
- E. 贪心搜索
解析:温度采样、顶部K采样和核采样通过调整概率分布或截断来增加多样性或控制质量;束搜索和贪心搜索更注重生成高概率序列,通常降低多样性。
余下详情题库请下载 APP 或扫码小程序查看全部题目与智能刷题。