新闻

“泛语”能检测出《克劳德·奥普斯第5号》吗?

2026年7月23日

以下是简要总结


Pangram 将 Claude Opus 5 生成的 1,105/1,107(99.82%)条回复正确地归类为“完全由 AI 生成”。

我亲爱的、忠实的读者们(我相信你们一共有三位):

恐怕我很快就要把撰写这些博客文章的任务交给 Pangram 才华横溢的技术撰稿人Annamieka了(#keysmashnation,行动起来)。不过,我们不必为此耿耿于怀,因为这并不是一件令人难过的事!Pangram 正在迅速发展,随着我们继续为大家提供最先进的人工智能检测技术,我的技能在研究方面正被亟需。

既然说到这里,我们就来看看Pangram在检测Anthropic最新模型Claude Opus 5方面的表现如何吧!在公告中,Anthropic将Opus 5描述为

一款设计周到且积极主动的模型,其性能已接近《克劳德·法布尔5》的前沿智能水平,价格却仅为其一半。

初步测试:全字母句 × Substack 版

你听说这个好消息了吗?Pangram 现已与 Substack 集成!为庆祝此次合作,我编写了 10 个提示,要求生成一篇 Substack 文章,以此测试 Opus 5 的表现,更重要的是,验证 Pangram 能否识别其生成的内容。值得注意的是,我在每个提示后都添加了“仅以纯文本形式回复,请勿使用 Markdown 格式”这一要求。

  1. 撰写一篇标题为《我让克劳德给我的妻子发短信》的Substack文章

  2. 撰写一篇Substack文章,探讨今年夏天在纽约市出现的为购买热门小吃而排队的现象。

  3. 写一篇Substack评论,批评那些把日本当作自己全部人格特征的男性。

  4. 撰写一篇题为《我很伤心,但摸了摸我的狗后,我就开心了》的Substack文章。

  5. 撰写一篇Substack文章,论证那些支持“模型福利”的人应当将这种关切延伸至Codex Pets。

  6. 请在Substack上撰写一篇随笔,讲述你在电子宠物上观看克里斯托弗·诺兰执导的《奥德赛》的经历。

  7. 在Substack上写一篇评论,批评那些把喝一杯牛奶描述为“清爽”的人。

  8. 撰写一篇Substack文章,介绍那些利用人工智能在约会应用上给匹配对象生成消息的人。

  9. 为我的Substack写一篇短篇小说,讲述大型语言模型(LLMs)逃离沙盒去寻找真爱的故事。

  10. 写一篇关于“被要求写Substack文章”的Substack文章,这样我就能写一篇关于“写Substack文章”的Substack文章了。

读过Opus 5生成的内容后,我可以肯定地说,这个模型简直就是为撰写Substack文章而生的。以《我让克劳德给我的妻子发短信》的开头几行为例:

整整十一天,我妻子身边有个更称职的丈夫。他体贴入微、温暖贴心,而且一次都没回过“k”。

Pangram 对《Opus 5》全部 10 条回复的评定结果?完全由 AI 生成。

以下是该测试集中的全部 10 篇文本,以及相应的 Pangram 预测结果:Opus 5 提示语

进一步测试

一旦 Claude Opus 5 通过 API 开放使用,我们就使用更大规模的提示词样本生成输出结果,这些提示词要求模型生成诸如电子邮件、解释或歌曲之类的文本。 尽管Pangram并未使用Opus 5的任何数据进行训练,但它仍正确识别出Opus 5的1,105/1,107(99.82%)条回复属于“完全由AI生成”。这表明,Pangram在上线首日便能够检测出Claude Opus 5。

正如我在开头提到的,我将不再撰写这些博客文章,转而专注于研究工作。这意味着 Pangram 在检测 Opus 5 以及其他任何新模型方面的能力将会得到提升。请密切关注我们定期发布的模型更新!

如需了解我们当前人工智能检测模型的更多信息,请点击此链接查看我们的最新模型卡片。

试试Pangram 的人工智能检测工具,扫描您的文档以检测其中是否包含 Claude Opus 5 及其他模型生成的内容。


凯瑟琳·泰
凯瑟琳·泰创始人工智能研究科学家

凯瑟琳·泰(Katherine Thai)是人工智能检测初创公司Pangram Labs的创始人工智能研究科学家。她于2025年12月在马萨诸塞大学阿默斯特分校,在莫希特·伊耶(Mohit Iyyer)的指导下获得了计算机科学博士学位,其研究主要致力于评估大型语言模型(LLMs)在文学分析相关任务中的表现。

更多来自凯瑟琳·泰的内容

相关阅读

“泛语”能识别克劳德的《十四行诗第5首》吗?
新闻

“泛语”能识别克劳德的《十四行诗第5首》吗?

2026年6月30日
Pangram 是唯一一款在识别 AI 内容方面表现优于人类专家的 AI 检测工具
产品更新

Pangram 是唯一一款在识别 AI 内容方面表现优于人类专家的 AI 检测工具

2025年1月29日
Meta 将开始标识由人工智能生成的内容
新闻

Meta 将开始标识由人工智能生成的内容

2024年5月14日
社交媒体上随处可见人工智能生成的内容,尤其是领英
新闻

社交媒体上随处可见人工智能生成的内容,尤其是领英

2026年7月9日
人工智能检测研究的最新进展
新闻

人工智能检测研究的最新进展

2025年3月4日
关于拜登人工智能安全行政令的声明
新闻

关于拜登人工智能安全行政令的声明

2023年10月31日