攻击手法听起来很技术官僚,做起来却很简单:找一个活跃的群组,偷偷把里面一则旧消息改掉,换上经过AI修改的违法内容,内容藏在群组成员平常不会回头去看的地方,所以不会被真人举报。接着,操作者用一批自动化帐号集体检举自己粘贴去的这则消息,把信号做给Apple看——这里有违法内容,快处理。Telegram创办人Pavel Durov把这整套流程称为「takedown extortionist」,是他这周在X上解释App被短暂从App Store下架时给出的说法。

Durov的说法里最尖锐的一句,是Apple在下架Telegram之前,并没有先联系Telegram本人。换句话说,整套判断是Apple单方面依照检举信号做出的反应,Telegram这边完全被排除在流程外,等到App已经消失才收到结果。Durov的推论是,这类操作者的目的其实是勒索:如果平台不付钱换平安,他们就会持续用同样的手法制造检举信号,逼平台一次次面对下架风险。

他把这件事定性为「潜在的系统性风险」,而且刻意强调对象不只是Telegram,是所有承载用户生成内容的App。这句话拆开来看,其实是在质疑Apple审核机制本身的判断顺序——当自动检举数量到达某个门槛,App Store会不会在没有人工核实、没有通知开发者的情况下就先运行下架。

用户生成内容该由谁负责,这个问题本来就缠着社区平台很多年,Telegram和Durov也不是第一次被放在这个争论的中心。这次不一样的地方,是AI让「制造一段看起来违法的内容」变得比以前快也比以前容易,而Apple的审核流程如果主要依赖检举量而不是内容核实,等于给了这类操作者一个现成的杠杆。Durov的贴文没有提供更多技术细节或后续处理时间点,Apple方面目前也没有公开回应。