警惕AI内容审核的边界:技术无法取代人类对“同意”的理解

尽管大型科技公司日益依赖AI进行内容审核,但其核心缺陷在于无法理解用户“同意”的复杂语境,这使得海量用户面临潜在风险,凸显了人类干预的不可替代性。

警惕AI内容审核的边界:技术无法取代人类对“同意”的理解

大型科技企业,包括Meta在内,正日益倚重人工智能进行内容审核。然而,正如Muse Image事件所引发的强烈反弹所示,由于AI无法真正理解并考量用户“同意”的复杂性,其在用户保护方面存在根本性局限。

Hera Hussain,全球性非营利组织Chayn的创始人兼首席执行官,致力于解决线上性别暴力问题。

近期,Meta发布了AI图像生成器Muse Image,允许任何人在未经授权的情况下,对拥有公开个人资料的Instagram用户图片进行二次创作与篡改。这与Meta此前推出的可佩戴式智能眼镜(该设备具备面部识别功能,并允许佩戴者未经他人同意录制影像)如出一辙,均是极具争议性的功能。其问题症结在于,基于图像的滥用已成为技术助长型性别暴力中增长最快的形式之一。

那些日常生活中看似无害、非露骨的图像,极易被恶意利用并武器化——Grok事件已为此提供了前车之鉴。这种伤害的蔓延速度,已远超现有法律法规或产品安全防护措施的更新步伐。由此产生的管理真空,不仅为一对一的剥削行为提供了温床,更催生了围绕此类侵害形成的有组织灰色市场。

此外,在大型科技公司的政策体系中,对“基于图像的滥用”的界定仍存在显著漏洞。这些政策多数源自西方文化对“私密图像”的理解,通常将其限定于露骨的性内容和裸体图像。然而,这种将有害图像狭隘地定义为仅限于包含明确内容的假设,与现实情况相去甚远,使得数百万女性及其他弱势群体在缺乏有效保护的情况下,面临风险。

人工智能固然能在内容审核的某些环节提供助力,但其能力并非无所不能。

我们的最新研究,在巴基斯坦及其侨民社区中展开,揭示了一个重要现象:对数百万女性而言,基于图像的滥用往往与露骨或裸体图像的传播无关。相反,一张平时习惯佩戴头巾的女性未戴头巾的照片、一段她在婚礼上跳舞的视频,或是她与男同学并排站立的合影,都可能引发严重的后果。在南亚、中东及其侨民社区的许多女性看来,这些日常照片一旦被恶意利用,便能被曲解为品行不端或暗示不轨关系。

我们访谈的一位受害者,其身着日常服装、与朋友合影、展示新眼线或新发型的自拍照,被前夫恶意利用,成为其长期虐待活动的一部分。他将这些被篡改的图像发送给她的WhatsApp联系人,旨在破坏她在职场的声誉,挑拨她与兄弟的关系,并危及她与父母的亲情。尽管WhatsApp平台和当地官员均表示这些图片不构成露骨内容,因此无法采取行动,但对受害者造成的伤害却是真实而深远的,即便现有政策未能将其识别。

报告中许多女性也提及,她们因类似的日常照片而遭受性剥削或勒索。在某些社群中,报警被视为禁忌,或可能面临家庭反对甚至暴力风险,受害者们因此将希望寄托于大型科技公司,期待其能提供便捷有效的渠道,删除相关图像并追究施暴者的责任。然而,大型科技公司在此方面未能满足她们的期望。

科技公司声称,在阻止平台上滥用行为与保护言论自由之间存在固有张力,同时也在采信受害报告与防范恶意举报之间寻求平衡。这些担忧并非空穴来风,但当前风险与危害的权衡,并未充分校准至实际社会层面。

当前的网络信任与安全领域充满了矛盾。一方面,各国政府正积极采取行动,出台针对线上危害和基于图像滥用的具体立法,例如美国的《Take It Down 法案》和英国的《线上安全法案》,促使科技公司加紧确保合规。另一方面,对信任与安全领域的投入却在减少,内容审核团队规模持续缩减,Meta、亚马逊、TikTok和Alphabet等公司均进行了大规模裁员。此外,美国前特朗普政府曾表示,参与内容审核和线上安全工作的人员将面临更严格的审查和签证拒签,这进一步降低了这些关键领域工作的优先级别。

这一趋势加速了向利用人工智能识别、标记和审核内容的转变,其中涵盖了儿童性虐待材料、暴力及极端主义内容。然而,人权组织和联合国代表对此表达了担忧,他们指出AI在内容审核中的应用可能导致歧视、审查以及关键文档被错误删除的问题。科技公司则辩称,AI具有更快的速度、更高的效率和潜在的准确性提升,同时也能使人工审核员免受处理困难内容的精神创伤。

然而,AI无法真正理解“同意”这一核心概念。对于女性及其他边缘化社群而言,问题的关键并非图像本身的内容,而是缺乏明确同意、所遭受的真实伤害,以及施虐者实施侵害的恶意意图。在特定情境下分享一张图片,并不等同于同意该图片被转发、截图或重新语境化。例如,一位女性在Instagram上发布个人资料照片,并不意味着她同意该照片被AI篡改后上传至Facebook群组或在WhatsApp群聊中传播。真正的伤害在于未经当事人知情或同意的情况下,对图像进行获取、篡改、分享或威胁分享,而非图像所呈现的内容。

这正是为何全球和本地都需要训练有素的人工内容审核团队。企业必须转向以“同意”为核心的审核框架,因为它能够跨越国界和文化差异,发挥作用。这不仅是大型科技公司亟需投入的领域,也是各国政府应加强监管的重点。人工智能能在内容审核的某些方面提供辅助,但它无法解决所有挑战。

Muse Image发布后仅72小时内,Meta便因其潜在的滥用风险引发的强烈反弹而将其下架。每个人都应享有对自己肖像的权利,这一基本前提有助于更有效地应对深度伪造(deepfakes)、名人冒充式网络诈骗以及未经同意的内容分享等问题。为了使内容审核真正发挥作用,并让用户——无论其年龄、地理位置或语言如何——感受到更安全的网络环境,大型科技公司必须在关注内容的同时,同等重视其语境。在实现这些目标之前,智能眼镜和图像生成器等产品或许可以暂缓推出。

返回 | FIRST CLASS VIP Lounge 专属情报频道