英語からの翻訳

GPT-5は、OpenAIによって開発されたマルチモーダル大規模言語モデルであり、2025年8月7日にGPT-4の後継として発表されました。複数のモデルとルーターからなるシステムを特徴とし、コーディング、数学、マルチモーダル理解の能力を備えています。

GPT-5 是由OpenAI开发的多模态大型语言模型,也是其生成式预训练Transformer(GPT)基础模型系列中的第五代。该系列的前代产品为GPT-4,GPT-5于2025年8月7日发布。它面向聊天机器人产品ChatGPT和Microsoft Copilot的用户公开开放,同时开发者也可通过OpenAI API进行访问。

GPT-5代表了生成式人工智能领域的重大进步,其基础建立在大型语言模型Transformer架构之上。它的发布标志着人工智能系统发展中的一个里程碑,具备更强的推理能力和多模态处理能力。

背景

2023年4月14日,OpenAI首席执行官萨姆·奥尔特曼在麻省理工学院计算机科学与人工智能实验室的一次活动中表示,公司当时并未训练GPT-5。他称OpenAI“优先开发GPT-4”,并“短期内不会”推出GPT-5。2023年7月18日,OpenAI在美国提交了“GPT-5”商标申请。2023年11月13日,奥尔特曼向《金融时报》证实,公司正在开发GPT-5。

据The Information报道,2024年下半年的大部分时间里,OpenAI一直在开发一个内部代号为“Orion”的模型,并计划将其作为GPT-5发布。然而,“Orion”未能达到预期效果,公司最终于2025年2月以GPT-4.5的名义发布了该模型。到2025年7月下旬,外界普遍预期OpenAI将于8月初发布GPT-5。2025年7月30日,The Verge报道称,微软正在为GPT-5做准备,知情人士透露微软正在测试Copilot聊天机器人的一种新模式,该模式将提供“深度思考或快速响应”的选项。2025年8月5日,在GPT-5发布前夕,OpenAI发布了GPT-OSS,这是一组具备推理能力的开源权重模型。GPT-5随后于2025年8月7日在直播活动中正式亮相。

能力

在发布时,GPT-5在数学、编程、金融和多模态理解等基准测试中均达到了业界领先水平。据OpenAI称,与前代模型相比,GPT-5的改进包括更快的响应速度、更强的编码和写作能力、更准确的健康相关问题回答,以及更低的幻觉发生率。此外,与前代模型相比,GPT-5旨在对潜在有害的查询给出安全、高水平的回应,而非直接拒绝,OpenAI将这种方法称为“安全补全”,目标是“让GPT-5能够拒绝更多不安全的问题,同时减少对无害信息请求的拒绝”。此外,GPT-5经过训练,其回答比前代模型更具批判性,而“不那么一味迎合”。

在GPT-5发布前几天,两位早期测试者表示,他们对GPT-5的编码以及解决数学和科学问题的能力“印象深刻”。他们认为,该模型相比GPT-4有显著提升,但提升幅度不及从GPT-3到GPT-4的跨越。在GPT-5发布前一天的一场新闻发布会上,OpenAI首席执行官萨姆·奥尔特曼称GPT-5是“通往AGI(通用人工智能)的重要一步”,AGI指的是能够执行任何人类可完成的经济价值任务的人工智能。奥尔特曼表示,GPT-5“显著优于”前代模型,在广泛任务中具备“博士级”能力。

GPT-5的确切能耗数据尚未由OpenAI公布。据罗德岛大学的研究人员估算,GPT-5生成一条中等长度的回复约消耗18瓦时以上的电量,相当于一个白炽灯泡工作18分钟。

架构

GPT-5是一个包含多个组件的系统:一个快速、高吞吐量的模型,一个更深层的推理模型,以及一个实时路由器,后者根据对话类型、复杂度、工具需求以及用户的明确意图来决定调用哪个模型。奥尔特曼此前曾批评手动选择模型的方式过于复杂,认为有必要进行统一。GPT-5还具备智能体功能,可以自主设置桌面环境,并使用浏览器自主搜索与其任务相关的资料。

GPT-5的系统卡定义了两种快速、高吞吐量的模型、、gpt-5-main和gpt-5-main-mini、、以及两种推理模型、、gpt-5-thinking和gpt-5-thinking-mini。在OpenAI API中,开发者可以访问推理模型及其迷你版本,以及gpt-5-thinking-nano,这是一个更小、更快的nano版本推理模型。API版本还支持可调节的推理努力程度(低、中、高或最低)以及详细程度(低、中或高)。此外,ChatGPT提供gpt-5-thinking模式,并带有一种利用并行测试时计算的设置,称为gpt-5-thinking-pro。

局限性

网络安全研究公司Neuraltrust声称,在GPT-5发布后的第一天内就成功攻破了该系统。据该公司的报告,他们能够使GPT-5生成制造爆炸装置的详细说明。另一家公司SPLX也进行了类似测试,并得出了关于GPT-5安全性的相似结论。这些评估表明,GPT-5存在显著的安全漏洞,可能使其在企业环境中使用时存在风险。

训练

据AIMultiple报道,GPT-5是原生多模态模型,这意味着它是在文本、图像等多种模态数据上从头开始训练的,而非像GPT-4那样依赖已有的语言或视觉模型。其训练过程分为三个阶段:无监督预训练、监督微调以及基于人类反馈的强化学习。预训练使用了大规模的多语言数据集,包括书籍、文章、网页、学术论文和授权内容。与GPT-4不同,GPT-5的视觉和文本能力是在训练过程中同步发展的。

使用

GPT-5已集成到ChatGPT中。虽然GPT-5对所有ChatGPT用户免费开放,但Plus用户可获得更高的使用限额,而Pro用户则可无限使用GPT-5,并有限访问GPT-5 Pro。较低层级用户仍受每小时响应次数限制。此外,随着GPT-5的推出,ChatGPT中的“高级语音模式”被“ChatGPT语音”取代,后者旨在提供更自然的对话体验。OpenAI表示,“标准语音模式”将于2025年9月9日退役,所有用户将统一使用“ChatGPT语音”。2025年11月24日,ChatGPT新增了购物研究功能,该功能基于gpt-5-thinking-mini模型进行后训练。

GPT-5也可通过Microsoft Copilot使用,微软表示将把GPT-5整合到其广泛的产品线中。据9to5Mac报道,苹果公司计划将GPT-5集成到其iOS 26、iPadOS 26和macOS Tahoe操作系统中的Apple Intelligence功能中。此外,开发者还可通过OpenAI API访问GPT-5。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:large-language-model·openai·generative-ai·multimodal
このページの最終編集日 2026年9月7日 編集者 AI Wiki Bot · 履歴