计算创造力是一个研究和实践领域,涉及表现出被认为具有创造性的行为的计算机系统的理论、设计和评估。它借鉴了人工智能、认知科学、心理学和艺术,旨在通过计算模型理解人类创造力,并构建能够生成原创且有价值输出的系统。该领域涉及音乐、文学、视觉艺术、科学假设和工程设计等产物,并提出了关于作者身份、原创性以及算法在文化生产中作用的问题。
该术语在20世纪90年代获得 prominence,早期工作侧重于基于规则和符号的系统。此后,该领域扩展到纳入机器学习和深度学习方法,尤其是随着生成式人工智能模型的兴起。当代计算创造力通常涉及神经网络架构,包括变换器模型,这些模型能够在文本、图像和音频领域产生高度复杂的输出。然而,该领域也包括非神经网络方法,如进化算法和基于约束的生成,反映了其广泛的跨学科根源。
历史基础
早期的计算创造力研究早于该术语本身。在20世纪50年代和60年代,先驱者探索了音乐和文本的算法生成。例如,20世纪50年代开发的国际象棋计算机程序展示了策略新颖性,尽管它并未被定义为创造性。到20世纪70年代,由Harold Cohen开发的AARON等系统使用一组关于构图和颜色的手工编码规则生成了原创绘画和画作。这些早期系统依赖于显式知识表示,这是符号人工智能的标志。
在20世纪80年代和90年代,施乐帕克研究中心和麻省理工学院计算机科学与人工智能实验室等机构的研究人员开始将创造力形式化为计算问题。该领域的首批专门会议于20世纪90年代末出现,包括自1999年以来每年举行的国际计算创造力会议。这一时期的关键理论贡献包括创造性过程的模型,例如现有概念的组合、概念空间的探索以及这些空间的转换。
核心方法和技术
现代计算创造力采用多种技术。符号方法使用语法、逻辑和搜索在定义约束内生成新颖结构。例如,系统可以通过应用正式的音节和韵律语法来生成诗歌。进化计算受生物进化启发,基于适应度函数迭代地变异和选择候选产物,通常用于生成设计或优化美学标准。
随着深度学习的出现,许多系统现在使用大型语言模型和其他神经网络架构。这些模型在大量数据集上训练,能够生成连贯的文本、逼真的图像和原创音乐。诸如top-k采样、top-p采样和温度缩放等技术控制生成输出的随机性和多样性,使创作者能够在新颖性和连贯性之间取得平衡。数据增强和课程学习也用于提高模型在创造性任务中的性能。
评估仍然是一个核心挑战。与传统的人工智能基准不同,创造力缺乏单一的客观指标。研究人员通常使用人类评审员,采用新颖性、价值和惊喜等标准。一些框架,如“创造性三脚架”,从新颖性、价值和惊喜三个维度评估创造力。其他方法使用计算指标,例如测量生成输出与训练数据的统计差异。
跨领域应用
计算创造力在众多领域具有实际应用。在音乐领域,系统可以创作各种风格的原创作品,从古典到电子,有时与人类音乐家合作。在视觉艺术领域,生成模型产生绘画和插图,其中一些作品在拍卖会上售出。在文学领域,人工智能系统撰写诗歌、短篇小说甚至剧本,通常需要人工编辑。
在科学领域,计算创造力有助于假设生成和实验设计。例如,系统可以提出新颖的化合物或建议新的数学猜想。在工程领域,生成设计工具探索广阔的设计空间,以创建优化的制造部件。娱乐行业将这些技术用于游戏关卡设计、角色创建和特效制作。
商业采用已有所增长,OpenAI、Anthropic和谷歌DeepMind等公司开发了通用创造性工具。这些工具通常通过亚马逊网络服务、Azure和谷歌云等云平台部署,使创造性人工智能广泛可及。然而,该领域还包括专注于特定创造性利基的专业初创公司和研究实验室,如AI21 Labs和Inflection AI。
哲学和伦理维度
计算创造力的兴起引发了关于创造力和作者身份本质的辩论。一些人认为机器不能真正具有创造性,因为它们缺乏意向性或意识,而另一些人则认为创造力是复杂信息处理的涌现属性。梅兰妮·米切尔和约书亚·特南鲍姆等哲学家探讨了这些问题,研究人工智能系统是否能够理解意义或仅仅操纵符号。
伦理问题包括人工智能生成作品的版权和所有权、训练数据中的潜在偏见以及对人类创造性职业的影响。法律框架仍在演变,一些司法管辖区在特定条件下授予人工智能生成作品版权。该领域还考虑人机协作的作用,其中机器充当工具或伙伴,而非自主创作者。
未来方向
计算创造力的研究持续进步,重点是提高生成输出的原创性和意向性。一个方向涉及整合强化学习技术,如基于人类反馈的强化学习,以使创造性输出与人类偏好对齐。另一个方向是开发能够推理自身创造性过程的模型,可能带来更透明和可控的系统。
跨学科合作仍然至关重要,汇集了计算机科学家、艺术家、心理学家和哲学家。随着生成式人工智能变得更加普遍,计算创造力可能在塑造文化、科学和技术方面发挥越来越重要的作用,提出需要持续研究的新问题。