Notebookcheck Logo

WhatsApp诈骗警报:该AI仅会核查陌生人,不会核查您的联系人

绿色 WhatsApp 对话气泡,内含文字“诈骗警报:设计即私密”
ⓘ Meta
Meta为“诈骗警报”制作的宣传图片。不过,只有来自您通讯录以外发件人的消息才会被检查。
WhatsApp 正在测试一项人工智能功能,可直接在您的手机上检测诈骗信息。消息内容不会离开设备,加密功能也保持完整。但问题在于 Meta 自己的描述:该功能仅会检查通讯录中没有的联系人。而最危险的诈骗恰恰就藏在这里。
Security AI Software Android iOS Smartphone

8月12日,Meta发布了关于WhatsApp新功能“诈骗预警”(Scam Alert)的技术概述。该功能旨在在用户上当受骗之前,就对其发出诈骗消息的警告。验证过程完全在用户的手机上进行。

启用该功能后,WhatsApp会将一个小型AI模型下载到设备上。 该模型会分析收到的消息,并将其与已报告诈骗案例中的模式进行比对——即已知诈骗中典型的对话串和措辞。在此过程中,没有任何消息内容会离开手机。端到端加密机制(即只有发件人和收件人能看到明文)依然完好无损。

仅收件人会看到警告

如果模型检测到疑似诈骗企图,聊天界面中会直接显示一条通知。发件人不会收到任何通知。此时,用户可以屏蔽发件人、举报对方,或者继续对话。WhatsApp不会自动向Meta报告任何信息。只有当用户主动点击“举报”时,才会发生这种情况。

仅对通讯录中未保存的发件人消息进行检查

这是该功能的局限性,Meta 自身的说明中也明确指出这一点。该模型仅对来自未保存在用户通讯录中的发件人的消息进行分类。来自通讯录中已有联系人的消息则不会被检查。

这意味着,讽刺的是,最有效的诈骗手段反而被排除在外。如果朋友或亲戚的 WhatsApp 账号被劫持,诈骗消息便会来自一个真实且熟悉的账号。 在这种情况下,“诈骗警报”功能不会发出提示。此前有假冒应用劫持 WhatsApp 账号的案例,就展示了此类劫持的具体运作方式。即使是那通令人震惊的克隆语音通话,也能够绕过这一检测,因为它根本不是通过 WhatsApp 发送的。

只要标记一次“可信”,就再也不会看到警告了

如果你认为某条警告是错误的,可以将该聊天标记为“可信”。这样,针对该联系人的警告就会永久消失。这虽然方便,但也正是其薄弱环节:当技术娴熟的诈骗者已经与你建立对话时,你往往会在压力下做出这样的决定。 以这种方式标记聊天的人,还可以自愿将收到的最后五条消息提交给 WhatsApp。

专为可验证性而设计

在透明度方面,Meta 走得比往常更远。每个模型版本在部署前都会连同其校验和一起记录在公共注册表中。该签名由 Cloudflare 提供;Meta 并不持有此所需的密钥。 模型权重已公开发布,以便研究人员验证该模型是否确实仅检测诈骗信息。用户可在“账户” > “请求信息” > “诈骗警报活动”中查看日志,了解哪些消息经过了检查以及当时运行的是哪个模型版本。

关于警告触发频率及用户响应情况的统计数据,均在隔离的计算环境中进行处理。在 Meta 查看这些数据之前,数据会经过聚合和混淆处理,以确保无法据此推断出任何关于个别用户的信息。

该功能尚未上线

“诈骗警报”目前作为有限测试版功能,与Meta的漏洞赏金计划同步运行。该公司尚未公布正式上线的具体日期,也未透露将覆盖哪些国家。截至目前,尚未有关于德国的相关声明。 在此之前,请遵循旧规则:若收到索要钱财或声称更换新电话号码的请求,请通过其他渠道联系对方,最好是拨打原号码进行确认。若想了解即使没有密码,账户也会在多快时间内被入侵,请参阅关于被盗会话 Cookie 的报告。

Google LogoAdd as a preferred source on Google
Mail Logo
> Notebookcheck中文版(NBC中国) > 新闻 > 新闻档案 > 新闻档案 2026 08 > WhatsApp诈骗警报:该AI仅会核查陌生人,不会核查您的联系人
Steffen Zahn, 2026-08-16 (Update: 2026-08-16)