ChatGPT是由OpenAI开发的生成式人工智能聊天机器人,于2022年11月30日发布。它基于大型语言模型,特别是生成式预训练变换器(GPT),并根据用户提示生成文本、语音和图像。该产品采用免费增值模式,用户通过文本、音频和图像输入输出进行交互。ChatGPT加速了AI热潮,这是一个持续的人工智能快速投资和公众关注时期,发布两个月后达到1亿月活跃用户,到2026年2月达到9亿周活跃用户。
该聊天机器人因其改变专业领域的潜力而受到赞扬,但也因局限性和不道德使用而受到批评。它可能产生听起来合理但错误的答案,称为幻觉,并反映其训练数据中的偏见。担忧包括学术不端、错误信息生成、恶意代码创建,以及在训练中使用受版权保护内容的伦理问题。
发布与病毒式增长
ChatGPT于2022年11月30日由研究组织OpenAI公开发布。此次发布是在Large language model技术多年发展之后,基于Transformer (architecture)架构。五天内,它拥有超过100万用户,到2023年1月初,达到1亿月活跃用户,成为历史上增长最快的消费应用之一。病毒式传播由社交媒体推动,用户分享令人印象深刻的输出,从写诗到调试代码。这种快速采用标志着公众对Generative AI认识的转折点,促使Google DeepMind和Anthropic等竞争对手加速自身的聊天机器人工作。
核心技术与架构
ChatGPT基于Generative AI模型,特别是使用Transformer (architecture)架构的GPT系列。底层Neural network使用Machine learning技术(包括Deep learning和基于人类反馈的强化学习(RLHF))在大量文本数据上进行训练。该模型通过Multi-Head Attention和Positional Encoding层处理提示,使其能够生成连贯且上下文相关的响应。初始版本GPT-3.5是从前代模型微调而来,后续迭代如GPT-4改进了推理和事实准确性。系统还结合了Temperature Scaling和Top-P (Nucleus) Sampling来控制响应的随机性和多样性。
功能与能力
ChatGPT支持广泛的任务,包括编写和调试计算机程序、创作音乐、剧本、故事和文章、回答问题,以及生成商业概念。它可以翻译和总结文本,并模拟交互环境,如Linux终端或基于文本的游戏。用户通过文本、音频和图像输入输出进行对话交互,可选的“记忆”功能允许聊天机器人回忆特定信息或过去的对话。基于GPT的审核分类器减少有害输出。
2023年3月,OpenAI添加了插件支持,包括网页浏览和代码解释,以及来自Expedia、OpenTable和Zapier等开发者的外部插件。从2024年10月到12月,ChatGPT搜索被部署,允许网页搜索以获得更准确和最新的响应,增加了与主要搜索引擎的竞争。2024年12月,一项功能允许用户通过电话免费拨打ChatGPT,每月最多15分钟。2025年10月,OpenAI推出了ChatGPT Atlas,这是一款将助手直接集成到网页导航中的浏览器,具有“代理模式”,可以为用户执行在线操作。
付费层级与移动应用
ChatGPT最初免费,并继续以有限容量免费提供。2023年2月,OpenAI推出了ChatGPT Plus,每月20美元,提供优先访问和更快的响应。2024年12月推出了每月200美元的Pro层级,与o1模型发布同时进行。2025年8月,ChatGPT Go在印度以每月₹399提供,限额高于免费版本。
iOS和Android的移动应用于2023年5月至7月发布,Windows应用于2024年10月15日在微软商店推出。这些应用扩展了访问范围,允许用户通过语音和图像输入进行交互。
语言支持与翻译
OpenAI于2022年会见了冰岛总统古德尼·约翰内松,并于2023年与40名冰岛志愿者合作,微调ChatGPT的冰岛语对话技能,作为冰岛语言保护工作的一部分。2023年,ChatGPT(基于GPT-4)在日语到英语翻译方面优于Bing、Bard和DeepL翻译器。2023年12月,阿尔巴尼亚政府使用ChatGPT快速翻译欧盟文件,并分析加入欧盟所需的变更。研究表明,ChatGPT在某些主流翻译任务中可以优于谷歌翻译,但截至2024年,没有机器翻译服务能匹配人类专家表现。
GPT、插件与深度研究
2023年11月,OpenAI发布了GPT构建器,允许用户为特定用例定制ChatGPT行为,创建自定义GPT。2024年1月,GPT商店推出,包含用户创建的超过300万个GPT。2025年9月,增加了对模型上下文协议(MCP)的支持,改善了第三方对ChatGPT工具和服务器的访问。2026年7月,ChatGPT应用更名为插件。
2025年2月,OpenAI发布了深度研究,这是一项基于广泛网页搜索生成报告的功能,最初使用o3推理模型,每份报告耗时3至30分钟。
图像生成与代理
2023年10月,DALL-E 3被集成到ChatGPT中,使用对话为图像生成编写提示。2025年3月,ChatGPT更新为使用GPT图像而非DALL-E,显著改善了图像中的文本渲染,尽管对非拉丁字母的改善较少。图像生成带有C2PA元数据以验证AI来源,并设有防护措施以防止有害内容。
2025年,OpenAI添加了代理功能。1月,Operator发布,能够自主执行基于浏览器的任务,如填写表单、下订单和安排约会。这些发展使ChatGPT定位为自动化复杂工作流程的工具。
社会影响与争议
ChatGPT的快速采用引发了关于创造力、知识工作和就业未来的辩论。支持者强调其增强人类能力的潜力,而批评者警告工作流失和对AI的过度依赖。该聊天机器人已被用于学术不端,导致学校实施政策。它可能生成错误信息和恶意代码,引发安全担忧。在受版权保护数据上训练的伦理问题已引起法律挑战和公众审查。尽管存在这些问题,ChatGPT仍是Artificial intelligence领域的核心产品,影响行业趋势和投资。