题目
“幻觉”是指大语言模型一本正经地胡说八道。语义熵是概率统计中用于测量一段答案中的信息是否一致的一种指标。熵值越低,即大家给出的答案越类似,说明信息越可信。例如,当你问AI“世界上最高的山是哪座?”发现“珠穆朗玛峰”这个答案出现频率最高,低语义熵表明“珠穆朗玛峰”是可信答案。因此,语义熵方法能够解决“幻觉”问题。以下哪项如果为真,不能削弱上述结论?()A. 语义熵很难处理复杂的问题,特别是当正确答案有多个时,语义熵很难区分哪个答案更可靠B. “幻觉”不是大语言模型的故障,而是它的特点,语义熵方法不应试图解决幻觉问题C. 当需要综合常识来判断时,语义熵只能基于词语的统计概率来评估,可能导致错误D. 如果训练数据被无意或者有意“污染”,语义熵给出的“自信”陈述的熵值可能不高
“幻觉”是指大语言模型一本正经地胡说八道。语义熵是概率统计中用于测量一段答案中的信息是否一致的一种指标。熵值越低,即大家给出的答案越类似,说明信息越可信。例如,当你问AI“世界上最高的山是哪座?”发现“珠穆朗玛峰”这个答案出现频率最高,低语义熵表明“珠穆朗玛峰”是可信答案。因此,语义熵方法能够解决“幻觉”问题。
以下哪项如果为真,不能削弱上述结论?()
A. 语义熵很难处理复杂的问题,特别是当正确答案有多个时,语义熵很难区分哪个答案更可靠
B. “幻觉”不是大语言模型的故障,而是它的特点,语义熵方法不应试图解决幻觉问题
C. 当需要综合常识来判断时,语义熵只能基于词语的统计概率来评估,可能导致错误
D. 如果训练数据被无意或者有意“污染”,语义熵给出的“自信”陈述的熵值可能不高
题目解答
答案
B. “幻觉”不是大语言模型的故障,而是它的特点,语义熵方法不应试图解决幻觉问题
解析
本题考查削弱论证的选非题,解题的关键在于明确论点和论据,然后分析每个选项是否能对论点起到削弱作用。
- 论点:语义熵方法能够解决“幻觉”问题。
- 论据:语义熵是测量一段答案中信息是否一致的指标,熵值越低,答案越类似,信息越可信,如问AI“世界上最高的山是哪座?”,“珠穆朗玛峰”答案出现频率最高,低语义熵表明其是可信答案。
接下来对每个选项进行分析:
- A选项:
- 语义熵很难处理复杂问题,特别是正确答案有多个时,难以区分哪个答案更可靠。
- 这意味着语义熵方法在某些情况下无法有效解决“幻觉”问题,因为它不能准确判断答案的可靠性,对论点有削弱作用,所以排除A选项。
- B选项:
- “幻觉”不是大语言模型的故障,而是它的特点,语义熵方法不应试图解决幻觉问题。
- 此选项讨论的是语义熵方法是否应该去解决“幻觉”问题,而论点关注的是语义熵方法能否解决“幻觉”问题,话题不一致,无法对论点进行削弱,所以B选项当选。
- C选项:
- 当需要综合常识来判断时,语义熵只能基于词语的统计概率来评估,可能导致错误。
- 这说明语义熵方法在综合常识判断时存在局限性,不能准确解决“幻觉”问题,对论点有削弱作用,所以排除C选项。
- D选项:
- 如果训练数据被无意或者有意“污染”,语义熵给出的“自信”陈述的熵值可能不高。
- 这表明在训练数据有问题的情况下,语义熵方法可能无法准确判断信息的可信度,也就不能有效解决“幻觉”问题,对论点有削弱作用,所以排除D选项。