Pangram 检测器:并非损坏,而是脆弱
I wouldn't say Pangram is broken, but I would say that it's brittle

有人指控我用 AI 写了文章,理由是 Pangram 检测出某段落为 100% AI 生成。作为作者,我当然知道那是人写的。于是我自己买了 Pangram 账号测试,结果发现了一个荒谬的“俄罗斯套娃”现象:整篇文章被判定为 100% 人类创作,但其中一段却被标为 100% AI;而把这段拆开,又变成了 100% 人类创作。更离谱的是,百分比计量器似乎完全失效,无论混合比例如何,结果往往非黑即白。这种根本性的不一致让我对 Pangram 作为“一击必杀”的工具深感怀疑。当这些工具开始影响职业作家的声誉时,我们必须正视其脆弱性。
我不会说 Pangram 坏了,但我会说它很脆弱。
HN 评论区
37- timpera
我不确定我会用“脆弱”这个词来形容蛇油。
- btown
我最近试了试 Pangram,注册了账号,写了几句关于我一天过得怎么样的内容,结果被标记为疑似 AI 生成。这玩意儿显然根本不管用。
更糟糕的是,他们一直坚称效果非常好,这可能会导致成千上万的人因此被错误地指控使用了 AI。
- runako
> 如果我想让 TSA 的机场扫描仪误报,我可以在包里放个枪形的物体。如果我想让 Waymo 的停车标志检测系统误报,我可以自己画个标志牌,立在杆子上。
这简直是稻草人谬误大爆发,Pangram 的创始人不仅对真正的批评毫无回应,反而觉得有必要编造一些完全不同的场景,试图说明一些完全无关的观点……好吧,至少创始人愿意出面回应算他有点担当,毕竟 deBoer 确实提出了很多关于人们为何不该依赖像 Pangram 这类“工具”的合理观点和批评。可惜创始人完全没能回应那些更严重的质疑,反而只是说“嗯,会有误报,能怎么办呢?”