X 上的 Flirty OnlyFans 推广者可能正在使用人工智能来表现人类

个性化回复和语音注释使您越来越难以判断您正在与人类、聊天机器人还是人工智能代理交谈。

来源:Malwarebytes Labs 博客

在最近的一篇文章中,我们查看了有关《英雄联盟》玩家在比赛后不久收到可疑好友请求的报告。这些帐户很快将对话引向 Discord,他们在那里推广付费成人内容页面。

当时,一个悬而未决的问题是这些对话中有多少是自动化的。人们是否根据帐户背后的脚本进行工作?它们是遵循有限决策树的传统的、基于规则的聊天机器人吗?或者他们是否使用生成式人工智能来生成更自然、更灵活的回复?

人们更有可能信任他们认为对他们个人感兴趣的人。人工智能可以在许多对话中同时创造这种印象,从而更容易说服人们点击链接、花钱或分享个人或私密信息。同样的方法也可以用于更有害的欺诈,包括爱情诈骗和性勒索。

现在,开发人员 Álvaro Martínez Majado 调查了几个在 X 上推广 OnlyFans 页面的调情帐户,看看他们的回复是否是脚本编写的、由人工智能生成的,还是由人编写的。数字版权组织 Protecció de la Frontera Electrònica 主席 Majado 与 Malwarebytes 分享了他的证据。尽管它没有提供明确的答案,但它显示了遵循严格对话脚本的帐户,同时还动态响应异常请求。曾经表明是真人的迹象,例如不寻常的回复或个性化的语音留言,已经不再可信。

脚本继续进行

Majado 与 X 上的几个帐户进行了互动,遵循熟悉的模式。他们以类似的随意、调情的语言开始,并问了大致相同的限定问题:他住在哪里,他喜欢什么,以及他做什么工作。

这种重复结构正是我们所期望的具有商业动机的消息传递活动。目标不一定是进行有意义的对话。它是为了识别可能做出回应的人,建立融洽关系,并最终将他们转移到付费页面或运营商控制的另一个目的地。

当面对明显试图将其暴露为机器人的行为时,这些帐户也保持了特征。这可能是硬编码回复、人工智能系统周围的护栏或两者兼而有之的结果。

但后来的一些互动更难以解释为一组简单的预先设定的调情回应。

更有趣的测试之一涉及以 ASCII 十六进制而不是普通文本编写的指令。编码后的消息告诉该帐户用一个词回复:“菠萝”。

根据提供给 Malwarebytes 的屏幕截图,该帐户以普通文本回复“Pineapple”。

这并不能最终证明使用了哪种技术。它不识别模型、提供商或帐户背后的人员。但它与能够解释编码指令并相应改变其输出的自动化系统是一致的。

当然,一个简单的脚本机器人理论上可以包含一个十六进制解码器。但这对于基本的成人内容促销机器人来说是不寻常的,尤其是与其他灵活且有时容易出错的响应示例相结合时。

在另一次交互中,Majado 要求帐户提供正好 12 个字符的回复。它用“Imnotabotfr”(一个 11 个字符的答案)进行回应,然后似乎认识到了自己的计数错误。

语音注释不能解决问题

这是其中一个语音注释。这是一个非常轻浮的女孩,还是人工智能生成的?听听并看看您的想法:

如何保持安全

任何花时间尝试大型语言模型的人都可能认识到这种模式。语言模型可以非常擅长生成听起来自然的文本,但仍然会犯一些令人惊讶的基本错误,涉及字符计数、字数计数和其他精确约束。

故意设计的机器人可以模仿这种错误,因此它不是人工智能的证明。但该帐户理解了一条意想不到的指令,尝试遵循它,并在得到错误答案时做出反应。这表明它可能是动态生成回复,而不是从预先写好的回复列表中进行选择。此类帐户可以适应对话,使它们更难被识别为自动化帐户。

这些帐户还发送了语音留言。在一个示例中,一个帐户大声朗读对话期间提供的 Unix 时间戳。在另一个例子中,它说出了所请求的用户名。

这些回复表明,这些帐户可以将对话中的异常信息合并到音频消息中。他们没有告诉我们这些剪辑是由人录制的,还是由文本转语音工具生成的。

文本转语音工具可以快速且廉价地生成简短、令人信服的剪辑。操作员可以手动生成它们,但该过程也可以自动化:接收消息,将选定的文本传递给语音生成服务,然后将生成的音频发送回收件人。

提供的音频元数据提供了有关所涉及工具的可能线索,但不足以将语音注释归因于特定服务。平台和其他软件可以更改音频文件及其元数据。

更重要的一点是,语音注释是个性化的,并且即使在交互似乎不太可能导致销售之后仍然继续。这与旨在保持对话顺利进行而无需人工监督每个对话的系统是一致的。

人工智能不会取代漏斗

证据并不意味着来自每个调情垃圾邮件帐户的每条消息都是由人工智能编写的。它也没有证明 X 账户是由针对英雄联盟玩家的同一个人操作的。

它确实暗示了一种看似合理的混合模型,由不同帐户之间的相同回复以及更灵活的响应支持。

操作的重复部分可以编写脚本:打开消息、有关位置和兴趣的问题、链接以及尝试将人们转移到另一个平台。当有人提出意想不到的问题、改变话题或试图测试账户是否真实时,人工智能驱动的对话层可以让交流感觉不那么重复。

这种组合对于垃圾邮件发送者来说具有实际意义。脚本提供一致性并使对话朝着转换的方向发展。生成式人工智能可以帮助帐户处理与真人交谈时不可预测的部分。

这也意味着传统的“机器人测试”变得越来越没有用处。要求帐户回答不寻常的问题、解码消息或发送语音留言可能不再区分真人与假人。

谨慎对待不请自来的调情消息,尤其是当它们很快变得具有交易性时。

  • 不要假设个性化响应或语音消息可以证明帐户是真实的。
  • 如果新联系人反复尝试将您转移到 Discord、Telegram、Signal、其他消息应用程序或付费内容平台,请务必小心。
  • 请勿向仅在网上认识的人发送金钱、礼品卡、加密货币、私密图像、身份证件或帐户凭据。
  • 避免从意外联系您的帐户中打开链接或下载文件。
  • 反向图像搜索个人资料照片并查找复制的传记、重复使用的图像或真实活动非常有限的帐户。
  • 向平台报告可疑帐户,特别是如果他们冒充某人、发送恶意链接或向用户施压,要求其提供金钱或露骨材料。
  • 与你交谈的对象是人类、聊天机器人还是人工智能代理,这是一个重要的问题。人工智能可以使这些操作更有说服力并且更容易扩展。一名操作员可以与许多人进行调情对话,调整消息,而无需亲自管理每次交流。

    这使得更容易产生错误的联系感并说服人们点击链接、为内容付费或分享个人或私密信息。

    脚本化的垃圾邮件帐户和响应式对话伙伴之间的界限越来越难以区分。判断这个账户的标准是它想让你做什么,而不是它所说的有多么令人信服。

    感觉有些不对劲?点击之前先检查一下。

    Malwarebytes Scam Guard 可帮助您立即分析可疑链接、文本和屏幕截图。

    适用于所有设备的 Malwarebytes Premium Security,以及适用于 iOS 和 Android 的 Malwarebytes 应用程序。

    免费试用 →