GPTZero是一款人工智能检测软件,旨在识别人工生成的文本,例如由大型语言模型生成的文本。它的开发初衷是应对学术不端行为以及AI写作工具被滥用的担忧。尽管因其在防止抄袭方面的努力而受到赞扬,但许多新闻媒体批评其误报率,这在学术环境中可能造成伤害。
该软件分析文本以判断AI创作的可能性,并在文档和句子层面提供带有置信度分数的分类结果。它已从最初基于语言特征的机制发展为更先进的深度学习分类器,并被教育工作者、招聘经理及其他专业人士所采用。
历史
GPTZero由普林斯顿大学本科生Edward Tian开发,于2023年1月上线,以回应AI生成内容在学术抄袭中的使用担忧。上线第一周,该工具经历了3万次使用,导致服务器崩溃;网络应用公司Streamlit为其提供了支持,并分配了更多服务器资源。2023年5月,GPTZero表示已筹集超过350万美元的种子资金。
截至2024年7月,其用户数已达400万,而一年前为100万。2024年夏季,GPTZero在A轮融资中筹集了1000万美元。2024年9月,GPTZero宣布推出一款作者身份追踪软件,使用户能够汇编并分享其写作过程的数据,如复制/粘贴历史、编辑者数量和编辑时长,旨在摆脱围绕AI写作的全有或全无范式,转向更细致的视角。
开发AI驱动电子邮件软件以提升生产力和工作流自动化的公司Superhuman,于2026年6月宣布收购GPTZero。Superhuman计划将GPTZero整合到其Superhuman Go AI助手中,而GPTZero则表示此次收购将有助于将其工具部署到用户已在阅读和写作的产品中。
机制
首次推出时,GPTZero使用其称为困惑度和突发性的特征来尝试判断一段文字是否由AI撰写。据该公司称,困惑度衡量句子中文本的随机性,以及句子结构对语言模型而言是否异常或出乎意料。语言更混乱或对语言模型更陌生的文本(即可能使模型感到困惑的文本)被认为更可能由人类撰写。相比之下,突发性则比较句子之间的相似性。人类文本更具不连续性,意味着人类写作时往往比AI展现出更多的句子变化。
2023年秋季,GPTZero停止使用困惑度和突发性,转而采用基于端到端深度学习的分类器,该分类器在来自创意写作、科学写作和新闻文章等领域数百万文档的数据集上训练。该分类器预测文本是完全由人类撰写、完全由AI生成,还是两者的混合,例如由AI润色的人类文本。它在文档和句子层面提供分类结果,并为其预测分配置信度分数。
截至2025年9月,免费层用户每月可扫描10,000个单词,每次扫描最多10,000个字符。
使用场景
学术界曾尝试使用GPTZero来应对AI生成内容引发的抄袭担忧。包括普林斯顿大学在内的教育机构已讨论在学术环境中使用GPTZero来打击AI生成内容,但意见不一。2023年10月,GPTZero与美国教师联合会合作。
到2024年,Tian报告称,GPTZero在招聘经理中也获得了大量采用,用于招聘和求职信分析。
有效性
在2023年3月题为“AI生成文本能否被可靠检测?”的论文中,马里兰大学的计算机科学家Vinu Sankar Sadasivan、Aounon Kumar、Sriram Balasubramanian、Wenxiao Wang和Soheil Feizi从经验和理论上证明,多种AI文本检测器在实际场景中并不可靠。
科技网站Futurism测试了该工具,并表示尽管结果令人印象深刻,但根据其错误率,依赖该工具的教师最终会错误指控近20%的无辜学生学术不端。《华盛顿邮报》在2023年8月指出,GPTZero存在误报问题,强调即使误报率很小,也意味着一些学生可能被错误指控。2025年9月,Business Insider将该工具与其他七种AI检测工具进行比较,并称GPTZero为“最佳免费AI检测器”。