我们推出了迄今为止最先进的模型:Pangram 4!点击此处了解详情。
今天,我们正式发布 Pangram 4:这是我们迄今为止功能最强大、准确率最高的人工智能检测工具。
Pangram 4 的规模是其前代模型的六倍多,在“人性化”检测、AI辅助文本识别以及人类与AI内容交织情况下的边界检测方面均展现出显著提升。它同时也是检测最新前沿模型的强大工具。我们认为它是全球同类产品中的佼佼者。
有关完整的评估数据、训练详情和已知局限性,请参阅Pangram 4 技术博客文章和Pangram 4 模型卡片。您也可以在此处查看完整的技术报告。
在内部基准测试中,Pangram 4 的误报率仅为 0.0041%,即每 24,000 份文档中大约出现一次误报。
Pangram 4 的漏检率也有显著降低,在我们的新挑战数据集上,其漏检率降至 0.3396%,而 Pangram 3 的漏检率为 1.99%。
据我们所知,Pangram 4 是首个能够在单次处理中同时区分由 AI 编辑的文本与人类与 AI 混合创作内容的 AI 检测模型。
该系统对人性化处理和对抗性提示具有很强的抗干扰能力,在13款流行的商业工具中,其识别出人性化输出中存在AI介入的准确率高达98.83%。
该方法可推广至各类前沿模型:每个模型家族的假阴性率(FNR)均低于0.7%,且模型的发布日期与其可检测性之间不存在显著相关性。
除了推出新机型外,我们还将调整积分的计算方式以及套餐中的积分数量。今后,每次扫描将按每100词消耗1个积分,而非像以前那样将每次扫描的词数向上取整至1,000词,这样您就能更充分利用积分。此外,我们还将调整扫描量,以更好地反映机型升级和当前用户的实际使用情况。
最后,我们很高兴能在不提高价格的情况下,为所有套餐新增图像扫描功能。
以下是计划变更的“变更前”与“变更后”对比分析:
之前的月度套餐
月度套餐之后
API 也适用相同的计费调整。API 调用按每 100 词 0.05 美元计费,这意味着短文档的费用将上涨 1 至 2 倍,而长篇文档的费用最高将上涨 10 倍。
未来两个月内,我们将继续支持 Pangram 3,其计划停用日期为 2026 年 9 月 30 日。未指定模型的默认请求将继续通过原计费系统路由至 Pangram 3,直至 Pangram 3 停用为止。
有关完整的评估数据、训练详情和已知局限性,请参阅Pangram 4 技术博客文章和Pangram 4 模型卡片。您也可以在此处查看完整的技术报告。

马克斯是一位经验丰富的机器学习工程师。他最近在Nuro从事自动驾驶汽车相关工作,负责领导该公司的主动学习项目。此前,他在谷歌、Two Sigma和Yelp拥有丰富的成功部署机器学习产品的经验。
马克斯拥有斯坦福大学理论计算机科学学士学位和人工智能硕士学位。除了对游戏开发的热情外,他还是《万智牌》Cube社区的活跃成员。