Pangram 测试一个可以将由 AI 撰写的电子邮件移至垃圾箱的 Gmail 过滤器
该工具会扫描 Pangram 的服务器上的消息,应用 AI、Mixed 或 Human 标签,并自动化决定被标记邮件的去向。
By Ryan Merket · Published · Updated
Primary source: X
Why it matters
Pangram is turning AI detection from an advisory score into an inbox gate. Automatic filtering raises the cost of false positives while requiring server-side access to private email.

Pangram, the AI-detection business founded by Max Spero (@max_spero_) and Bradley Emi (@bradley_emi), 正在测试一项 Gmail 集成,该集成会扫描传入邮件,并能自动将被判定为 AI 编写的邮件发送到垃圾邮件或废纸篓。
以揭露未发布应用功能而闻名的安全研究员兼逆向工程师 Jane Manchun Wong (@wongmjane) 在 8 月 11 日公布了该集成的屏幕截图。图像显示一个通过 Google OAuth 连接到 Gmail 的 Pangram 仪表盘,带有暂停扫描、排除选定发件人和域名以及选择 Pangram 将被标记为 AI 生成的邮件如何由 Gmail 处理的控制选项。
该功能仍在开发中。Wong 表示 Pangram 正在“致力于”该集成,截图将该连接描述为在 Pangram 自己的服务器上扫描传入电子邮件。新邮件会在 Gmail 向 Pangram 发送投递通知后被检查,然后在收件箱内被标记为 Pangram/AI、Pangram/Mixed 或 Pangram/Human 标签。
A detector becomes an inbox rule
重要的变化是附加到 Pangram 得分的动作。Pangram 现有的工具通常允许人们检查选定的文档、网页和社交帖子。Gmail 集成将持续运行并使用分类结果来决定一封邮件是否保留在收件箱中。
一张截图显示了一个汇总已检查、已跳过和已标记线程的仪表盘,以及列出产生最多 AI 标记邮件的发件人列表。用户可以在 Pangram 抓取邮件正文之前,为发件人、域、群组和邮件列表建立排除规则。另一个设置允许用户将被标记为 AI 的邮件移出收件箱。
这一设计可能为用户提供一种抑制自动化推销、群发外联以及其他通过常规垃圾邮件检查但为机器撰写的消息的新方式。它也可能拦截使用 AI 助手起草的合法电子邮件。Pangram 自己的 服务条款 将其检测系统描述为概率性分类器,并告诉其文本消息检测服务的用户将每次预测作为众多信号中的一个来对待。一个自动化的收件箱规则会让该预测产生直接的操作性后果。
Spero 和 Emi 在斯坦福大一时相识,随后在创建 Pangram 之前一起从事应用机器学习系统的工作。Spero 曾在 Nuro、Google、Two Sigma 和 Yelp 工作,而 Emi 在加入 Absci 领导深度学习研究,之前曾在 Tesla Autopilot 的计算机视觉团队工作。Pangram 已将其业务建立在为学校、出版商、平台和其他组织检测合成文本之上。(Pangram's company history)
Gmail 测试是在 Pangram 原始文档检查器之外迅速扩展之后进行的。Substack began using Pangram 从 7 月 21 日起在发布的文章和笔记上使用 Pangram,让读者估算文本中有多少是人写或 AI 协助撰写的。随后 Pangram 宣布了 Pangram 4,并在 7 月 29 日完成了由 Menlo Ventures 领投、Haystack、ScOp Venture Capital、Script Capital 和 Cadenza 参与的 900 万美元融资轮,详情见 TechCrunch 的报道。
The inbox raises the privacy stakes
与 Gmail 的连接要求 Pangram 处理一类可能包含私人通讯、收据、账户提醒和工作场所讨论的文本。截图强调了 Google OAuth、可撤销的访问权限和按发件人级别的排除,同时也明确指出 Pangram 在其服务器上执行扫描,而不是完全在 Gmail 内部进行。
Pangram 当前的 隐私政策 表示其会收集为检测提交的文本,以及注册客户的元数据。Pangram 表示客户内容不会被用于训练或改进其 AI 模型,不会用于广告,并且可以从查询历史中删除。另一份 数据隐私常见问题 表明提交的内容在账户处于激活状态期间会被保留,除非用户将其删除。
Pangram 的最新技术报告 表示 Pangram 4 在其评估中实现了 0.0041% 的假阳性率和 0.3396% 的假阴性率。这些是 Pangram 报告的基准结果,收件箱的实际表现将取决于真实邮件的长度、风格和模型来源。报告还表示 Pangram 4 被设计用于分类混合人类与 AI 写作并识别较小的 AI 编辑片段——当许多消息以人为草稿开始并在发送前经过 AI 写作工具处理时,这是一项必要的能力。
Gmail 集成将 Pangram 的核心赌注从识别机器撰写的材料扩展到对其执行用户偏好的层面。如果发布,Pangram 将位于发件人与收件人之间,在用户打开消息之前将作者判定转化为投递决策。