Generative Artificial Intelligence and Linguistic Epistemic Justice for isiZulu and African Languages in Multilingual Education
本文认为,要在人工智能介导的教育中实现祖鲁语及其他非洲语言的语言-认识论正义,必须超越单纯的文本生成,转而建立一种治理框架,通过公平的数据呈现、教师能动性和制度问责制,将这些语言视为推理、身份和知识权威的有效基础设施。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象这样一个教室:一名学生用母语提问,计算机程序用同样的语言回答。几十年来,人工智能的梦想一直是能够流利地使用每种语言,充当连接不同人群的通用翻译器。但在现实世界中,这些计算机程序并非中立的工具;它们构建在海量的文本和数据之上,而其中大部分来自英语来源。这造成了不平等的竞争环境。当一个系统主要针对英语进行训练时,它会成为该语言的大师,但在被要求用像祖鲁语(南非十一种官方语言之一)这样语言来推理、解释复杂概念或讲述故事时,却往往会踉跄跌倒。问题不仅在于能否把词说对,还在于计算机是否能理解这些词汇背后的文化、历史和深层含义。如果一台机器只能将一种语言作为英语的二流翻译来使用,那么它就未能尊重那些将该语言作为思考和学习主要方式的人们。
来自南非大学的两名研究人员,Stella Bolanle Apata 和 Itumeleng I. Setlhodi,着手调查了这一确切的张力。他们并没有运行一个新的计算机测试来观察特定的聊天机器人能否用祖鲁语写出一个句子。相反,他们收集并研究了44篇不同的学术文章、政策文件和技术报告,以了解更宏观的图景。他们想知道,生成式人工智能——即那种可以写论文、解决问题并进行对话的技术——的快速崛起,是在帮助非洲语言成长,还是在悄悄地将它们排挤在一旁。他们的研究是对现有知识的细致回顾,其结果表明,答案完全取决于学校和政府如何选择使用这些工具。他们发现,如果没有刻意的努力,这些强大的系统很可能会强化英语的主导地位,将非洲语言仅仅视为翻译英语思想的渠道,而非构建知识的完整且独立的途径。
研究人员首先从技术层面进行了观察。他们发现,虽然计算机在翻译单词方面已经变得更加出色,但在处理更深层次的教育工作时仍然感到吃力。一个模型可能会生成一个语法正确的祖鲁语句子,但它往往缺乏解释科学概念或历史事件所需的文化细微差别或特定词汇。这种情况之所以发生,是因为用于教导这些计算机的数据对于非洲语言来说非常匮避。研究人员将此描述为不是语言本身的问题——因为这些语言丰富且复杂——而是数字基础设施的失败。计算机仅仅是因为没有摄取足够的高质量祖鲁语故事、教科书和对话来学习如何用这种语言进行思考。因此,当学生和教师转向这些工具寻求帮助时,他们往往会发现英语版本的答案更清晰、更详细且更可靠。这产生了一种微妙的压力,促使人们转向英语,不是因为用户偏好英语,而是因为技术让英语成为了阻力最小的路径。
这项研究不仅深入探讨了技术故障,还审视了等式中的人类与政治层面。作者认为,语言不仅仅是沟通的工具,更是身份与权威的载体。当一个计算机系统将一种非洲语言视为次要选项时,它传递了一个信息,即与该语言相关的知识和文化价值较低。这就是研究人员所称的“认识论不义”(epistemic injustice),这是一个高级术于,指代对作为思考者和知晓者的人群所遭受的不公平对待。如果一名学生无法使用其母语来论证观点、解决数学问题或撰写研究论文,并拥有与英语使用者同等的信心,那么他们在思想世界中就被剥夺了充分参与的权利。研究人员警告说,如果学校只是简单地采用这些工具而没有计划,他们就有可能使这种不平等自动化,从而使非洲语言在数字时代更难生存和繁荣。
然而,这篇论文并不暗示人工智能对非洲语言具有天生的危害。作者看到了前进的道路,但这需要我们改变看待这些工具的方式。他们提出了一种新的治理方式,将语言公平置于核心地位。这意味着,在学校或大学购买新的人工智能工具之前,他们应该提出具体的问题:这个工具是否很好地支持了我们的本土语言?它是否经过了使用这些语言的人员的测试?为这个工具创造数据的那些人是否得到了认可和回报?研究人员建议,教师在这里扮演着至关重要的角色。他们不仅需要接受如何使用技术的培训,还需要接受如何识别计算机出错时的培训。教师必须能够审视一个由人工智能生成的祖鲁语答案,并判断它捕捉到了课程的真实含义,还是仅仅是一个浅薄的模仿。
研究人员还强调,责任在于机构,而不仅仅是个人。大学和政府不能仅仅声称支持多语言主义,然后任由细节随波逐流。他们需要制定政策,要求人工智能公司对其数据保持透明,并投资于建设更好的非洲语言资源。这包括创建当地知识的数字图书馆、开发更好的测试这些系统的方法,并确保使用这些语言的人参与到设计过程中。目标是从“非洲语言只是一个附带物”转变为“非洲语言被视为数字世界中不可或缺的一部分”。
最后,这篇论文将问题从“计算机能否说祖鲁语?”重新定义为“计算机是否尊重祖鲁语?”作者指出,答案并非简单的“是”或“否”。这是一个有条件的可能性。这项技术有潜力支持并加强非洲语言,但前提是我们必须积极构建基础设施、培训教师并制定相关政策。如果没有这些步骤,像南非这样多语言社会的教育未来可能会变成一个英语仍是唯一严肃思考语言的地方,而其他语言则会被遗忘。然而,通过这些步骤,人工智能可以成为保护文化记忆和扩大所有人获取知识途径的强大盟友。Apata 和 Setlhodi 的工作为这段旅程提供了一份清晰的路线图,敦促我们超越新技术的闪光点,专注于那些安静而本质的关于正义与包容的工作。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。