计算幽默是人工智能的一个子领域,专注于幽默的计算建模。它借鉴语言学、心理学和计算机科学,开发能够检测、解释和生成幽默文本或其他媒体的系统。该领域既涉及幽默背后的认知机制,也涉及构建能够处理歧义、语境和文化差异的算法的实际挑战。
计算幽默的研究在历史上侧重于基于规则的方法,例如识别双关语或简单的笑话模板,但已日益采用机器学习和深度学习技术。现代系统通常依赖在大型文本语料库上训练的大型语言模型,这些模型能够比早期方法更灵活地生成和分析幽默。该领域仍然具有挑战性,因为幽默往往依赖于共享知识、时机和意外性,所有这些都难以形式化。
历史发展
计算幽默的早期工作可追溯到20世纪90年代,当时格雷姆·里奇(Graeme Ritchie)等研究者提出了基于不协调与消解语言学理论的计算模型。这些早期系统使用手工规则来生成简单的双关语或对笑话进行分类。例如,20世纪90年代中期开发的JAPE程序,从单词联想数据库中生成双关谜语。
到21世纪初,统计方法开始出现,利用笑话语料库训练分类器,以区分幽默与非幽默文本。然而,由于幽默的复杂性和标注数据的稀缺,性能受到限制。2010年代神经网络以及后来的Transformer架构的出现标志着一个转折点,使模型能够捕捉语言中更细微的模式。
核心挑战
一个核心挑战是幽默的主观性。一个人觉得好笑的内容可能不会让另一个人感到有趣,这使得评估变得困难。研究者通常使用人工评分者或诸如意外性或不协调性等代理指标,但这些并不完美。另一个问题是依赖世界知识;许多笑话引用特定事件、人物或文化规范,而模型可能未曾遇到过这些。
语境也起着关键作用。一个短语在一种情境下可能幽默,在另一种情境下则可能冒犯。因此,计算系统必须处理语用学和社会线索,这仍是活跃的研究领域。此外,生成幽默需要在创造性与连贯性之间取得平衡,因为笑话必须既新颖又易于理解。
方法与技术
基于规则的方法包括模板生成器,这些生成器在预定义的笑话结构中填充槽位,例如“你称一个[X]为[Y]什么?”这类方法透明但范围有限。统计和机器学习方法使用诸如语音相似性、语义距离或句法模式等特征来识别幽默内容。
更近期的工作利用深度学习和大型语言模型,例如由OpenAI、Anthropic和Google DeepMind开发的模型。这些模型可以在笑话数据集上进行微调,或通过提示生成幽默回应。诸如top-p采样和温度缩放等技术用于控制输出的随机性和创造性。一些系统还采用基于人类反馈的强化学习(RLHF)来使生成的幽默与人类偏好对齐。
应用
实际应用包括用于娱乐的自动笑话生成,例如在聊天机器人或社交媒体中,以及用于情感分析或内容审核的幽默检测。在教育领域,计算幽默可用于创建引人入胜的学习材料。该领域还为人类-计算机交互提供信息,其中幽默可以使界面更具亲和力。
在商业领域,三星电子和苹果等公司已探索在虚拟助手中使用幽默,但由于不适当输出的风险,部署仍然有限。MIT CSAIL和斯坦福人工智能实验室等研究机构已发表关于幽默识别和生成的研究,为该领域的学术基础做出了贡献。
评估与未来方向
评估计算幽默是出了名的困难。常见方法包括人工判断量表,例如要求参与者按李克特量表评分趣味性,或测量意外性或不协调性的自动指标。然而,这些往往与实际幽默感知相关性较差。一些研究者提出使用行为测量,如笑声或参与度,但这些在基于文本的系统中难以捕捉。
未来方向包括开发能够将幽默适应特定受众或语境的模型,以及整合多模态线索(如视觉或听觉信号)以处理视频或语音中的幽默。此外,人们也对理解伦理影响感兴趣,特别是避免有害或偏见的幽默。随着生成式人工智能的持续进步,计算幽默可能变得更加复杂,但它很可能仍然是人工智能的一个挑战性基准。