预防性审查:当算法先于你做出决定

点击“发送”,你的帖子在被人阅读之前就消失了。欢迎来到算法预防性封锁的时代。到2026年,社交网络的审核将依赖人工智能系统,能够在几分之一秒内删除内容(事前审核)。在本深度分析中,我们剖析这种预防性限制的影响,探讨人工智能无法理解语境(讽刺、行话、举报)的问题,并分析欧洲《数字服务法案》(DSA)如何施加新的透明度、申

你输入一篇帖子,点击“发布”,然而它没有出现在信息流中,而是消失了,取而代之的是一条冰冷的红色警告:此内容违反了我们的社区准则。没有人工审核员阅读过它;也没有其他用户举报它。它是在几毫秒内被人工智能判定、审判并删除的。

在关于网络言论自由的辩论中,我们习惯于讨论事后移除(即当可见内容被举报后被移除)。然而,当代数字平台的审核基础设施绝大多数依赖于事前审核,即预防性过滤。

在本期“场景与反思”专栏的深度分析中,我们将探讨为何发布前的自动拦截有可能构成一种真正的言论预防性限制。我们将探讨算法在理解语境方面的局限性,以及欧洲法规如何试图遏制将数字广场变成贫瘠、沉默的生态系统的风险。

1. 新的“事先限制”(预防性限制)

从法律上讲,国家审查与私营公司实施的审核有很大不同。然而,对公共辩论的影响却越来越趋同。

法律和社会学文献,特别是 SagePub 上题为 No Amount of “AI” in Content Moderation Will Solve Filtering’s Prior-Restraint Problem 的论述,解释了发布前的自动过滤会产生一种事先限制的形式。即使系统具有极高的准确性,在每天数十亿次互动中的误差率也等同于预防性地压制数百万条合法声音。

正如《哈佛法律评论》关于互联网新治理者(The New Governors)的调查所述,问题在于这一过程以日益复杂的方式展开。平台不仅限于拦截或删除,而是通过四个不同的强度层级运作:

行动类型时间点对公共辩论的影响
事后移除发布之后。内容已被曝光,引发了反应,然后才被质疑。
事前拦截发布之前。预防性消失:该声音从未进入公共领域。
预防性暂停立即。内容被暂时冻结,等待(通常是人工)核查。
隐形降级始终(在后台)。帖子保持在线,但被排除在推荐系统之外(影子禁令)。

2. 算法的局限:无法理解语境

当算法判定某个内容甚至不能被看到时,我们面对的不仅仅是技术错误。我们目睹的是辩论片段的消失。为什么算法会如此系统性地出错?因为人类语言是模糊的、分层的,并且由语境主导。

信息法研究所(IViR)关于人工智能、内容审核与言论自由的研究,以及关于算法审核对少数群体语言(例如 LGBTQ+)的影响的研究表明,基于主流语言数据训练的模型在捕捉细微差别方面存在严重困难。

仇恨言论检测算法看到的是文本字符串。它无法区分:

  • 真正的暴力煽动;
  • 对暴力行为的新闻报道;
  • 政治讽刺作品;
  • 边缘化社区重新使用曾经具有冒犯性的词语的语言(reclaiming)。

正如关于DSA 下算法审核的大学研究所强调的,其结果是过度移除现象。为了避免制裁或声誉损害,平台将算法校准到最大严格程度,宁愿删除一千条合法内容,也要清除唯一真正非法的内容。

3. 欧洲的防线:数字服务法案(DSA)

面对数字广场日益严重的不透明性,欧洲通过数字服务法案(DSA)进行了干预。

正如欧盟委员会关于DSA 影响的文件所阐明的那样,该法规并未禁止使用算法过滤内容,但强制规定了严格的透明度和理由说明义务。当内容被移除时,用户必须收到清晰具体的理由说明,使他们能够对决定提出异议。

这一架构催生了 DSA 透明度数据库,这是一个庞大的官方档案库,收集了审核决定的理由,对于分析哪些内容被限制以及限制频率至关重要。

该法规的关键点在于人工保障。正如 Cambridge Core 上关于审核中人工参与(Platforms on the Hook?)的深入分析所述,DSA 要求存在程序性保障和有效的申诉程序。机器可以作为第一道过滤器,但申诉必须包含真正的人工监督。

关键操作要点(给用户的建议)

  • 了解算法规避:在高度审核的数字空间中,故意使用拼写变体、星号或委婉说法(所谓的 Algospeak)已成为一种普遍策略,用以绕过针对脱离上下文的“敏感”关键词的自动过滤器。
  • 行使申诉权:如果您的内容被预防性拦截,请务必使用申诉功能。欧洲监管体系要求平台提供申诉机制,最终分析必须由人工审核员进行。
  • 监控降级:不仅要关注被移除的内容,还要关注那些可见度异常下降的内容。算法降权是最隐蔽且最难证明的审查形式。

常见问题解答:理解算法预防性审查

1. 社交网络的自动审核是否违宪?

不,因为平台是制定自己“服务条款”的私营公司。宪法保护公民免受国家的审查。然而,由于这些平台拥有巨大的社会权力,像 DSA 这样的法规会介入,强制规定透明度规则以保护基本权利。

2. 既然算法会在语境上犯错,为什么公司还要使用它们?

因为数据量巨大。托管每天数十亿次互动的平台无法实际雇佣足够数量的人工审核员。算法充当筛子,即时清除垃圾邮件和明显非法内容,即使以在灰色地带产生误报为代价。

3. 究竟什么是“事先限制”?

这是一个法律概念,指在传播发生之前对言论自由施加的限制或禁令。在数字世界中,算法的事前拦截模仿了这种效果,阻止信息到达其受众。

结论:谁控制过滤器?

关于网络言论自由的辩论已经演变:我们不再仅仅讨论说话的权利,而是讨论被看到和被听到的权利。预防性算法审核是维持巨型平台可用性所必需的工程胜利,但它带来了极高的民主成本。

当算法基于缺乏深层语义理解的语言模式对帖子进行分类、屏蔽或降级时,就会产生对公共辩论的无菌化清洗,不可避免地损害讽刺、社会举报和少数群体。欧洲规则代表了重新将人类责任引入这一过程的第一道、也是至关重要的防线。然而,核心问题仍然悬而未决,并回避了所有纯粹技术性的保证:谁控制着决定哪些词语今天值得被倾听的过滤器?

参考书目和来源

  1. 预防性审核、审查与事先限制:
    • SagePub – No Amount of “AI” in Content Moderation Will Solve Filtering’s Prior-Restraint Problem. 链接
    • 哈佛法律评论 – The New Governors: The People, Rules, and Processes Governing Online Speech. 链接
    • 信息法研究所(IViR) – Artificial Intelligence, Content Moderation, and Freedom of Expression. 链接
    • Diritti Comparati – Freedom of Expression and AI-Driven Content Moderation. 链接
  2. 过滤中的文化影响与偏见:
    • 马斯特里赫特大学 – Algorithmic Content Moderation and Freedom of Expression Under the DSA. 链接
    • UNITN (IRIS) – Algorithmic Content Moderation and LGBTQ+ Expression. 链接
    • Redalyc – Artificial Intelligence, Algorithms and Freedom of Expression. 链接
  3. 欧洲法规(DSA)与权利:
    • 欧盟委员会 – The impact of the Digital Services Act. 链接
    • 欧盟委员会 – DSA Transparency Database. 链接
    • 欧洲议会 – 关于自动化审核的答复. 链接
    • Cambridge Core – Platforms on the Hook? Human Involvement in Content Moderation. 链接

文章由 La Bussola dell’IA 编辑部编辑