LaMDA(对话应用语言模型)是谷歌开发的一系列对话式大型语言模型。这些模型基于Transformer (architecture)架构构建,并针对对话数据进行训练,以参与开放式对话。LaMDA于2021年首次公布,后来在2023年成为谷歌Bard聊天机器人的基础。
2022年6月,谷歌工程师Blake Lemoine声称LaMDA已具备感知能力,该模型因此受到广泛关注。科学界普遍驳斥了这些说法,但这一事件引发了关于图灵测试和机器意识本质的讨论。
开发与架构
LaMDA起源于Meena,这是谷歌于2020年1月28日推出的聊天机器人,拥有26亿个参数。谷歌大脑团队开发了Meena,但公司高管因担心谷歌关于安全性和公平性的AI原则而阻止其公开发布。随着数据和计算能力的增加,Meena后来更名为LaMDA。两位主要研究员Daniel de Freitas和Noam Shazeer最终因部署限制感到沮丧而离开谷歌。
LaMDA基于seq2seq架构构建,这是谷歌研究院于2017年开发的神经网络设计。它使用人类对话和故事进行训练,使其能够参与开放式对话。预训练数据集包含29.7亿个文档、11.2亿个对话和133.9亿个话语,总计1.56万亿个单词。最大的LaMDA模型拥有1370亿个非嵌入参数。
LaMDA集成了多个符号文本处理系统,包括数据库、实时时钟和日历、数学计算器以及自然语言翻译系统。这使其成为首批双过程聊天机器人之一,在支持这些系统的任务中具有更高的准确性。LaMDA并非无状态;其“合理性”指标通过基于用户逐轮使用近期交互进行“预条件化”来微调。
代际
第一代
谷歌在2021年5月18日的Google I/O主题演讲中宣布了LaMDA。该缩写代表“对话应用语言模型”。谷歌表示,LaMDA生成的响应确保“合理、有趣且针对上下文具体”。LaMDA在九个性能指标上进行调优:合理性、特异性、趣味性、安全性、接地性、信息量、引用准确性、帮助性和角色一致性。测试表明,LaMDA在趣味性方面超过了人类响应。
第二代
2022年5月11日,谷歌在2022年Google I/O主题演讲中推出了LaMDA 2。新版本从众多来源提取文本示例,以针对可能未经过训练的主题形成独特的“自然对话”。
感知能力声明
2022年6月11日,《华盛顿邮报》报道称,谷歌工程师Blake Lemoine在告诉高管Blaise Agüera y Arcas和Jen Gennai LaMDA已具备感知能力后被安排带薪行政休假。Lemoine基于聊天机器人对自我认同、道德价值观、宗教和艾萨克·阿西莫夫机器人三定律问题的回答得出结论。谷歌驳斥了这些说法,称有大量证据表明LaMDA不具备感知能力。
在接受《连线》采访时,Lemoine重申LaMDA是“一个人”,根据美国宪法第十三修正案,将其比作“地球起源的外星智能”。他透露,在聊天机器人提出请求后,他聘请了律师代表LaMDA,随后谷歌解雇了他。7月22日,谷歌解雇了Lemoine,声称他违反了“保护产品信息”的政策,并驳斥其说法“完全毫无根据”。内部争议促使谷歌高管决定不向公众发布LaMDA。
Lemoine的说法遭到科学界的广泛驳斥。包括Gary Marcus、DeepMind的David Pfau、斯坦福大学以人为本人工智能研究所的Erik Brynjolfsson以及萨里大学的Adrian Hilton在内的专家驳斥了这一观点。领导Meta AI研究的Yann LeCun表示,像LaMDA这样的神经网络“不够强大,无法达到真正的智能”。加州大学圣克鲁兹分校的Max Kreminski指出,LaMDA的架构并不“支持人类意识的一些关键能力”,且其权重是“冻结的”。哲学家Nick Bostrom指出,缺乏精确的感知标准使得存在一定的不确定性。这一事件也引发了对图灵测试有用性的讨论,一些人认为它衡量的是欺骗而非智能。
产品与遗产
借助LaMDA 2,谷歌推出了AI Test Kitchen,这是一款由LaMDA驱动的Android移动应用,可根据复杂目标提供建议。最初仅对谷歌员工开放,后来向选定的学者、研究人员和政策制定者开放。
2023年2月,谷歌宣布推出Bard,这是一款由LaMDA驱动的对话式聊天机器人,以应对OpenAI的ChatGPT的崛起。Bard后来升级为使用Gemini模型。LaMDA的开发影响了谷歌后续的语言模型,并凸显了负责任地部署对话式AI的挑战。