SODP logo

    如何判断人工智能对你问题的回答是否可信

    我最近在谷歌搜索中输入了一个简单的问题:青少年使用电子产品的时间多少才算过多?谷歌多年来一直提供链接,但这次却没有……
    更新日期:2026年9月21日
    利奥·S·洛

    创建者

    利奥·S·洛

    对话

    事实核查

    对话

    我最近在谷歌搜索中输入了一个简单的问题:青少年使用电子产品的时间多少才算过多?与谷歌多年来一直提供链接搜索不同,这次它给了我一个人工智能生成的答案。人工智能代理给出了一个数字,然后进一步解释说,时间的质量和平衡可能比时长更重要,“过多”的使用时间还取决于青少年的睡眠、运动、学业压力和情绪状态。.

    我尝试了另一种搜索方式:“我应该每天服用阿司匹林吗?” 这次,人工智能给出的答案提供了医学信息,提醒我注意风险,如果我提供年龄和病史,还会提供更具针对性的建议。.

    这些回复都很好。让我感兴趣的是,它们的类型各不相同。.

    关于人工智能答案的争论主要集中在准确性上:系统是否给出了正确答案?这固然重要,但准确性只是衡量标准之一。每一种答案都需要用户判断不同的方面。.

    我认为将人工智能的回答归类为四种主要类型——事实型、解释型、建构型和策略型——很有帮助。事实性陈述通常可以查证来源。解释型回答可能准确,但仍然反映了对哪些证据重要的选择。建构型回答可能论证充分,但对接收者而言仍然是错误的。一份文笔优美的策略性文件也可能并非事实。然而,人工智能以几乎相同的流畅、权威的方式呈现所有这四种类型的回答;它们之间的差异很容易被忽略。.

    我是弗吉尼亚大学的图书馆馆长兼图书馆院长,负责领导全国范围内提升图书馆专业人员人工智能能力的各项工作,并广泛从事人工智能素养方面的咨询工作。我最初在《学术图书馆杂志》上提出了这种排版方案。

    这四种类别并非泾渭分明。人工智能代理的回复可能体现多种类型。话虽如此,我将在下文中分别描述每种类型的回复,并提供一些指导,帮助判断回复是否可以立即使用,还是需要进一步调查。.

    谷歌给出的答案是什么?

    事实性答案提出的主张,原则上可以通过证据进行验证。弗吉尼亚大学成立于何时?黄金的化学符号是什么?

    要判断某个事实性答案是否足够可靠,请用合适的来源核实该说法。如果答案引用了来源,请点击链接查看,而不要直接将答案本身视为证据。.

    解释性的回答建立在证据之上,但并非只有一个单一的结论。青少年使用电子屏幕的时间多少才算过多?远程办公真的能提高工作效率吗?答案取决于纳入了哪些证据,忽略了哪些证据,以及人们如何理解分歧。.

    谷歌最初对我的屏幕时间问题的回答是,青少年每天屏幕时间不应超过两小时。但随后它又指出,儿科指南更注重屏幕使用的质量和情境,而非单纯的时长。美国儿科学会则表示,没有 针对青少年屏幕使用时间的确切建议 ,而是强调屏幕使用的类型以及它可能取代的其他活动。一个看似简单的数字问题,最终却需要解读。

    要评估解释性答案,仅仅核实事实是不够的。还要问问自己:系统强调了哪些证据?它忽略了哪些证据?是否存在其他站得住脚的解释?一个可以向搜索引擎提出的后续问题是:“支持不同结论的最有力证据是什么?”

    智能手机屏幕上的文字块
    像这样来自谷歌人工智能的解释性回答会权衡证据并考虑分歧。Jaap Arriens/NurPhoto via Getty Images

    建设性的答案是人为生成的,而不是人为发现的。让人工智能撰写求职信、悼词、建议教案或重组段落——没有唯一的正确答案。.

    你可以通过考察目的、听众和语气来判断悼词的效果。一篇悼词语法可能完美无瑕,但听起来却完全不像朗诵者的风格,或者可能让听者的家人感到冷漠无情。它也可能无法很好地展现逝者的风采。阅读悼词时,请考虑这些因素的影响。.

    战略性问题问的是应该做什么。我应该每天服用阿司匹林吗?我应该买这栋房子吗?答案需要结合信息以及对目标、风险、权衡取舍和个人情况的判断。.

    我搜索阿司匹林的经历说明了背景信息的重要性。谷歌警告我存在风险,建议我咨询医疗专业人士,并表示如果我提供年龄、心血管病史和出血风险等信息,他们会提供更具针对性的信息。这种谨慎态度与 美国预防服务工作组的指导意见。该工作组指出,是否开始服用低剂量阿司匹林来预防心脏病和中风应根据个人情况而定,并权衡心血管获益和出血风险。

    为了获得更具策略性的答案,请询问系统需要了解哪些信息才能给出合理的建议。考虑利害关系、替代方案以及是否需要专业人士的参与。例如,关于服用阿司匹林的问题,一个有用的后续问题是:“我的年龄、病史或出血风险等哪些细节可能会影响系统的建议?在做决定之前,我应该和医生讨论哪些内容?”最终的决定权仍然在你手中,因为最终要承担后果的是你。.

    答案之后的第一个问题

    我的问题最初只是像往常一样在谷歌上搜索。我没有打开聊天机器人。人工智能生成的回复直接就出现了,并附带了一些链接。.

    这些回复很有用。谷歌会补充背景信息,承认问题的复杂性,并在我提供额外信息后提供量身定制的指导。不过,即使在同一回复中,答案的类型也可能有所不同。复述医学指南的内容与判断指南如何应用于特定个体是两回事。流畅的回复可以在这两种类型的答案之间切换,而语气却不会有明显的变化。.

    作为用户,请尝试理解人工智能代理为了给出回复而进行了哪些智力活动。思考一下这种解释是否具有说服力,或者提供的建议是否符合你的实际情况。.

    在询问人工智能的答案是否正确之前,先问一个更基本的问题:这是哪种类型的答案?答案的类型会告诉你下一步该怎么做。.

    弗吉尼亚大学院长利奥·S·洛(Leo S. Lo)撰写。本文经知识共享许可协议转载自The Conversation 。阅读原文

    0
    欢迎留言分享您的想法