认知语文学是一个跨学科领域,将认知科学和计算方法应用于历史文本与语言的研究。它考察人类认知如何塑造文本的生产、传播和阐释,整合了语言学、心理学、神经科学和计算机科学的见解。该领域出现于20世纪末,当时学者们试图理解文学和文献制品创作与接受背后的心理过程。
与传统语文学侧重于文本批评、词源学和历史语法不同,认知语文学强调影响文本创作、抄写和理解方式的认知约束与策略。它借鉴记忆、注意力和问题解决的理论,来解释抄写错误、文体变异和叙事结构演变等现象。该方法还利用计算工具对大规模历史文本语料库进行建模和分析,为文化和思想史提供新的视角。
历史发展
认知语文学的根源可以追溯到20世纪80年代和90年代人文学科中的认知转向。诸如马克·陈等学者开始将认知心理学的概念应用于文学分析,认为文本不仅是文化制品,也是具身和情境化认知的产物。随着数字人文学科的兴起,该领域获得了发展动力,数字人文为大规模文本分析提供了计算基础设施。
一个关键的里程碑是语料库方法的发展,使研究人员能够量化跨历史时期的词汇使用、句法和叙事结构模式。这些方法得到了机器学习和自然语言处理进展的补充,从而能够对文本现象进行更复杂的建模。到21世纪初,认知语文学已确立为一个独特的研究领域,拥有专门的会议和出版物。
认知基础
认知语文学建立在若干关于人类认知的核心假设之上。其中之一是记忆具有重构性而非复制性,这意味着抄写者和作者常常根据他们的期望和先前知识来改变文本。这一见解有助于解释手稿传统中某些类型错误的普遍性,例如用熟悉的词语替换不熟悉的词语,或省略难以回忆的段落。
另一个基础是注意力和工作记忆在文本生产中的作用。例如,对口头创作的研究表明,表演者依赖公式化短语和韵律模板来减少认知负荷。认知语文学家将类似原则应用于书面文本,考察作者如何使用重复、排比和其他手段来促进创作和理解。
计算方法
计算方法在现代认知语文学中占据核心地位。研究人员使用神经网络和变换器模型来分析文体特征、归属作者身份以及重建丢失或损坏的文本。例如,深度学习技术已被应用于古代铭文的修复和匿名手稿的分类。
一个显著的应用是使用大型语言模型来模拟历史读者和作者的认知过程。通过在特定时期的语料库上训练模型,研究人员可以探究语言惯例和概念框架如何随时间演变。这些模型还能够生成假设性变体,可与实际手稿证据进行比较,以检验关于文本传播的假设。
应用与案例研究
认知语文学已应用于从古典希腊和拉丁作品到中世纪方言文学的广泛文本。一个有影响力的案例研究涉及对荷马史诗的分析,研究人员使用计算模型证明诗歌的公式化结构与口头记忆的约束相一致。另一项研究考察了希伯来圣经的传播,使用统计方法识别不同手稿家族中抄写行为的模式。
该领域还对文学风格研究做出了贡献。通过量化句子长度、词汇多样性和句法复杂性等特征,研究人员能够追踪个别作者风格的发展并检测文本之间的影响。这些分析对文本批评具有启示意义,因为它们有助于区分作者修订和抄写干预。
批评与局限
认知语文学面临学者的批评,他们认为它夸大了认知机制的普遍性,忽视了文化和历史的特殊性。批评者指出,从现代心理学实验发展出的认知模型可能不适用于具有不同教育实践和识字模式的近代以前社会。此外,对计算工具的依赖引发了对算法解释权威性和训练数据潜在偏见的质疑。
支持者回应说,认知语文学并不声称取代传统方法,而是对其进行补充。通过明确文本实践背后的认知假设,该领域为理解文本为何呈现如此面貌提供了更严谨的框架。随着计算技术的不断进步,认知语文学很可能在数字人文学科中发挥越来越重要的作用。
未来方向
展望未来,认知语文学有望受益于人工智能和生成式AI的进展。多头注意力机制和其他架构创新的整合可能允许对文本认知进行更细致的建模。研究人员还在探索使用强化学习来模拟抄写者和编辑者的决策过程。
另一个有前景的方向是认知语文学家与神经科学家之间的合作。阅读和写作的功能成像研究可以为从文本分析中推断出的认知过程提供经验证据。这种跨学科工作可能带来对心智与文本关系的更深入理解,弥合人文学科与科学之间的鸿沟。