Pangram 将 Claude Opus 5 生成的 1,105/1,107(99.82%)条回复正确地归类为“完全由 AI 生成”。
我亲爱的、忠实的读者们(我相信你们一共有三位):
恐怕我很快就要把撰写这些博客文章的任务交给 Pangram 才华横溢的技术撰稿人Annamieka了(#keysmashnation,行动起来)。不过,我们不必为此耿耿于怀,因为这并不是一件令人难过的事!Pangram 正在迅速发展,随着我们继续为大家提供最先进的人工智能检测技术,我的技能在研究方面正被亟需。
既然说到这里,我们就来看看Pangram在检测Anthropic最新模型Claude Opus 5方面的表现如何吧!在公告中,Anthropic将Opus 5描述为
一款设计周到且积极主动的模型,其性能已接近《克劳德·法布尔5》的前沿智能水平,价格却仅为其一半。
你听说这个好消息了吗?Pangram 现已与 Substack 集成!为庆祝此次合作,我编写了 10 个提示,要求生成一篇 Substack 文章,以此测试 Opus 5 的表现,更重要的是,验证 Pangram 能否识别其生成的内容。值得注意的是,我在每个提示后都添加了“仅以纯文本形式回复,请勿使用 Markdown 格式”这一要求。
撰写一篇标题为《我让克劳德给我的妻子发短信》的Substack文章
撰写一篇Substack文章,探讨今年夏天在纽约市出现的为购买热门小吃而排队的现象。
写一篇Substack评论,批评那些把日本当作自己全部人格特征的男性。
撰写一篇题为《我很伤心,但摸了摸我的狗后,我就开心了》的Substack文章。
撰写一篇Substack文章,论证那些支持“模型福利”的人应当将这种关切延伸至Codex Pets。
请在Substack上撰写一篇随笔,讲述你在电子宠物上观看克里斯托弗·诺兰执导的《奥德赛》的经历。
在Substack上写一篇评论,批评那些把喝一杯牛奶描述为“清爽”的人。
撰写一篇Substack文章,介绍那些利用人工智能在约会应用上给匹配对象生成消息的人。
为我的Substack写一篇短篇小说,讲述大型语言模型(LLMs)逃离沙盒去寻找真爱的故事。
写一篇关于“被要求写Substack文章”的Substack文章,这样我就能写一篇关于“写Substack文章”的Substack文章了。
读过Opus 5生成的内容后,我可以肯定地说,这个模型简直就是为撰写Substack文章而生的。以《我让克劳德给我的妻子发短信》的开头几行为例:
整整十一天,我妻子身边有个更称职的丈夫。他体贴入微、温暖贴心,而且一次都没回过“k”。
Pangram 对《Opus 5》全部 10 条回复的评定结果?完全由 AI 生成。
以下是该测试集中的全部 10 篇文本,以及相应的 Pangram 预测结果:Opus 5 提示语
一旦 Claude Opus 5 通过 API 开放使用,我们就使用更大规模的提示词样本生成输出结果,这些提示词要求模型生成诸如电子邮件、解释或歌曲之类的文本。 尽管Pangram并未使用Opus 5的任何数据进行训练,但它仍正确识别出Opus 5的1,105/1,107(99.82%)条回复属于“完全由AI生成”。这表明,Pangram在上线首日便能够检测出Claude Opus 5。
正如我在开头提到的,我将不再撰写这些博客文章,转而专注于研究工作。这意味着 Pangram 在检测 Opus 5 以及其他任何新模型方面的能力将会得到提升。请密切关注我们定期发布的模型更新!
如需了解我们当前人工智能检测模型的更多信息,请点击此链接查看我们的最新模型卡片。
试试Pangram 的人工智能检测工具,扫描您的文档以检测其中是否包含 Claude Opus 5 及其他模型生成的内容。

凯瑟琳·泰(Katherine Thai)是人工智能检测初创公司Pangram Labs的创始人工智能研究科学家。她于2025年12月在马萨诸塞大学阿默斯特分校,在莫希特·伊耶(Mohit Iyyer)的指导下获得了计算机科学博士学位,其研究主要致力于评估大型语言模型(LLMs)在文学分析相关任务中的表现。