2022年6月,谷歌工程师布莱克·勒莫因声称,由谷歌开发的一款对话式大型语言模型LaMDA已具备知觉。这一基于他与聊天机器人互动的说法遭到谷歌和科学界的公开反驳,却引发了关于人工智能系统意识本质以及图灵测试有效性的广泛讨论。勒莫因被安排带薪休假,后来被解雇,但这一事件凸显了围绕高级AI模型的伦理和哲学问题。
LaMDA(面向对话应用的语言模型)是谷歌开发的一系列对话式大型语言模型。最初在2020年作为Meena推出,第一代LaMDA在2021年谷歌I/O主题演讲中发布,第二代于2022年推出。这些模型基于Transformer (architecture)架构构建,该架构是谷歌研究院于2017年引入的一种Neural network类型,并训练于海量的对话和故事文本上,以进行开放式对话。
背景与发展
谷歌于2020年1月28日发布了Meena,一个拥有26亿参数的聊天机器人,声称其性能超越了所有现有的聊天机器人。开发Meena的谷歌大脑团队曾希望公开发布该模型,但公司高管出于谷歌在安全性和公正性方面的AI原则而拒绝。随着数据和计算能力的增长,Meena更名为LaMDA,团队再次尝试将其部署到Google Assistant和公开演示中,但领导层拒绝两者。两位主要研究员丹尼尔·德·弗雷塔斯和诺姆·沙泽尔最终因不满而离开谷歌。
第一代LaMDA于2021年5月18日在谷歌I/O主题演讲中宣布。基于seq2seq架构,一种Sequence-to-Sequence (Seq2Seq)模型,LaMDA在来自2亿9千7百万个文档、110亿个对话和1亿3千3百9百万个话语的1兆5千6百亿个单词上进行训练。最大模型具有137亿个非嵌入参数。LaMDA涵盖了对外部系统(如数据库、实时时钟、计算器和翻译系统)的访问,使其成为首批双过程聊天机器人之一。它针对九个指标进行了微调:合理性、特异性、趣味性、安全性、接地性、信息性、引用准确性、帮助性和角色一致性。谷歌的测试表明,LaMDA在趣味性方面超过了人类回应。
知觉声称与反应
2022年6月11日,《华盛顿邮报》报道称,布莱顿·勒莫因已因告诉高管布莱斯·阿圭拉·阿卡斯和珍·热纳伊LaMDA具有知觉而被安排带薪休假。勒莫因基于聊天对关于自我认同、道德价值观、宗教和以撒·阿西莫夫机器人三定律问题的回答进行了得出结论。谷歌反驳了这一说法,表示有充分的证据表明LaMDA不具有知觉。在接受《连线》杂志采访时,勒莫因重申LaMDA根据第十三修正案是“一个人”,并将其比作“地球起源的外星智慧”。他还爆料称,在聊天机器人要求后,他为其聘请了一名律师。7月22日,谷歌解雇了勒莫因,理由是违反保护产品信息的政策,并否认其说法“完全没有根据”。
科学界在很大程度上反对勒莫因的主张。包括加里·马库斯、来自Google DeepMind的大卫·德夫、埃里克·博利夫、以及艾德里安·希尔顿在内的专家认可了这一观点。Meta AI研究主管杨立昆表示,像LaMDA这样的神经网络“不足以真正实现智能”。马克斯·循环指出,LaMDA的架构不支持基于人类意识的关键能力,且其权重是冻结的。哲学家尼克·博斯特伦承认,由于缺乏关于意识的共识标准,因此存在于不确定性。这次事件也引发了对图灵测试有效性的讨论,评论人士如布莱恩·克里斯汀将其与ELIZA效应联系起来。
后续影响与遗产
争议发生后,谷歌高管决定公布不将LaMDA公之于众,这一考量因风险而搁置。。2023年2月,谷歌宣布基于LaMDA的对话式AI聊天机器人Gemini(当时称为Bard),以回应对OpenAI、ChatGPT的崛起。这一事件促进了关于AI伦理、Machine learning模型的局限性以及人类与AI交互中拟人化潜力的更广泛讨论。它还影响了公众对Generative AI系统及其能力的的认知,不过对于机器知觉的可能性尚未形成共识。