AI and Authenticity in Islamic Research: A Critical Evaluation of Generative AI Reliability, Hallucination, and Source Fidelity in Quranic, Hadith, and Fiqh Knowledge
想象一下,互联网就像一座巨大且繁忙的图书馆,任何人都可以瞬间提出问题并得到答案。几十年来,我们一直依赖人类图书管理员——学者、教师和专家——来寻找正确的书籍并解释难懂的部分。但最近,一种新型的图书管理员来到了这里:生成式人工智能(AI)。把这些 AI 系统想象成极其快速、超级聪明的机器人,它们几乎读过了图书馆里的每一本书。它们可以写故事、解数学题,甚至能像人类一样聊天。但问题在于,这些机器人非常擅长表现得自信且流利,但它们有时也会编造事实。在科学领域,这被称为“幻觉”,即 AI 虚构了听起来真实但并不真实的事实。
现在,想象一下这座图书馆不仅仅是关于历史或科学,而是关于宗教——特别是伊斯兰教。对于数百万人来说,宗教知识不仅仅是信息;它是如何生活、祈祷以及做出重大人生决策的指南。它依赖于古老的圣典,如《古兰经》和《圣训》(先知的言论),并且需要对不同的学派有深刻的理解。如果机器人图书管理员在这里给了你错误的建议,这不仅仅是一个愚蠢的错误;它可能会导致某人做出不该做的事情。因此,一个大问题是:我们能否信任这些超快速的 AI 机器人成为我们的宗教向导,还是说我们仍然需要人类专家?
这篇论文就像是对这些 AI 机器人在特定的伊斯兰知识图书馆进行的一次严格的“试驾”。来自澳大利亚和英国大学的研究人员决定让六个最流行的 AI 系统接受一场严苛的考试。他们不仅问了简单的问题,还提出了 5 题具有现实意义的开放式问题,这些问题是真实的人们可能会问的,涵盖了从“《古兰经》关于诚实是怎么说的?”到关于礼拜规则和金钱的复杂法律问题等方方面面。他们想看看 AI 是否能正确回答,是否能找到正确的来源(例如圣书中具体的页码),以及它是否知道在什么时候应该说“我不确定”,而不是瞎猜。
结果是“相当不错”与“保持警惕”并存。研究人员发现,这些 AI 机器人实际上非常擅长回答关于普遍伦理、《古兰经》含义以及广泛道德教训的问题。这就像它们是图书馆主厅里优秀的导游。然而,当问题变得棘手时——比如询问具体的法律规则(Fiqh)或不同伊斯兰学派之间的差异时——这些机器人就开始踉跄了。它们经常忘记给出信息的准确来源,有时会编造不存在的书籍引用,或者在人类学者存在广泛分歧的情况下给出自信的答案。
简而言之,这项研究表明,虽然这些 AI 工具在获取快速入门介绍或概括性概念方面非常出色,但它们尚不足以成为宗教裁决的最终权威。作者警告说,在没有咨询人类专家的情况下,将它们用于严肃的宗教决策是有风险的。这就像使用一个 GPS,它在开车去超市时表现得很好,但如果你试图穿越复杂的山隘,它可能会给你指错路。论文总结道,我们可以将这些 AI 助手作为学习的起点,但我们必须始终通过经过认证的来源和合格的人类学者来核实它们的“作业”,以确保路径的安全与真实。