算法时代的集体记忆

算法不仅管理着我们的信息流:它们正在重写集体记忆,决定我们在线上记住什么,以及什么会消失在数字噪音中。在全球档案、生成式人工智能和虚假信息之间,理解这种新型记忆的运作方式,已成为一项根本性的政治行动。探索其中的风险、机遇,以及如何在这一新格局中找到方向。

集体记忆是社会通过共享的故事、图像、档案和仪式来记住自身的方式。如今,这一过程越来越多地由算法来驱动,这些算法筛选、排序并重新呈现我们在线上看到的内容,将互联网转变为一种动态且不稳定的“全球档案”。

引言:为何这是当今的紧迫议题

当你打开社交媒体、在谷歌上搜索内容,或让虚拟助手为你总结某个事件的历史时,你正在将选择哪些过往片段值得被记住的权力委托给算法。这不仅关乎你的照片或信息,更关乎整个社群的记忆:战争、创伤、成就、不公、欢庆时刻与危机时刻。

数字化已将记忆从“过去的盒子”转变为持续流动的、被提示的回忆流:“历史上的今天”通知、重新出现的帖子、因突然再次走红而被重新推送的文章。借助生成式人工智能,这种流动不再仅限于保存:它重新加工、综合、重写,并基于我们在线上留下的痕迹创造新的叙事。

在此背景下,谈论集体记忆就意味着谈论权力:谁决定什么被归档、什么被置于首页、什么被边缘化或被噤声。正是在这里,不仅技术人员,公民、机构、教育者以及像联合国教科文组织《世界记忆》计划这样的全球项目都参与其中,该计划试图以数字形式保护人类的文献遗产。

数字时代的集体记忆是什么?

从经典意义上讲,集体记忆是一个社会通过机构、媒体、学校、仪式和文化所构建并传承的记忆、符号和叙事的集合。在数字时代,正如当代社会学关于记忆的研究所强调的,这些渠道与全球平台、云存储、社交媒体和搜索引擎交织在一起,这些平台已成为共享记忆的核心基础设施。

如今,集体记忆的重要组成部分建立在存储一切的平台上:视频、评论、帖子、文章、数字化的历史文献。与此同时,成千上万的本地和全球倡议(如关于大屠杀的档案、摄影收藏、合作性文献项目)利用数字化技术使历史记忆更易获取。

但集体记忆不仅仅是保存下来的内容:它也是在当下被突出、被语境化、被重新诠释的内容。而这一部分如今在很大程度上由算法中介,这些算法根据注意力、参与度和用户画像等标准,决定推送哪些内容、建议哪些链接、重新推荐哪些新闻。平台不仅仅是消极的档案库,更是社会记忆的算法编辑者。

算法如何正在重写集体记忆?

支配社交媒体、搜索引擎和推荐系统的算法不仅限于保存信息:它们筛选哪些内容变得可见、易于传播和令人难忘。它们如同一种“隐形的档案管理员”,决定哪些故事浮现,哪些故事被深埋,而用户往往对此毫无察觉。

关于这个主题,我们已经展示过算法如何放大偏见和隐形歧视,影响人们获取机会和社会正义。同样的机制也作用于集体记忆:如果算法训练和运行所基于的数据不完整或有偏差,那么由此产生的对过去的叙述也将如此。

在人工智能助长的虚假信息案例中,算法常常奖励具有煽动性和情感冲击力的内容,助长虚假或被操纵的叙事传播,这些叙事最终会沉淀为公众的“虚假记忆”。正如近期关于人工智能驱动的虚假信息(哈佛大学虚假信息评论)的研究所分析,生成式工具能够制造出几乎与真实新闻无异的虚假政治新闻,直接影响人们对近期历史和民主进程的认知。

走向全球档案?机遇与风险

我们真的能谈论一个全球记忆档案吗?某种程度上是的:得益于数字化,海量的文件、图像、证词和作品得以在线提供,世界任何地方都可以访问。

然而,这个“全球档案”远非中立或完整。有整个部分的集体记忆被排除在外:未数字化的档案、被边缘化的声音、少数民族语言、没有资源记录自身历史的社群。向数字化的转变深刻地改变了什么被记住、什么被遗忘,既倍增了材料,也增加了信息过载和“噪音”的风险。

人工智能可以帮助组织和梳理这片数据海洋,但如果缺乏监管,也可能扭曲对现实的感知。在此背景下,关于数字情感麻木的思考变得至关重要,有助于理解重新呈现给我们的内容如何不仅影响我们记住什么,还影响我们作为社会认为自己经历过什么。

实例分析:当今正在发生什么?

为了使这一场景更具体,我们可以关注三类案例:

  • 数字化历史档案与人工智能: 许多博物馆、图书馆和研究中心正在使用人工智能来索引和检索大型数字馆藏。这涵盖了从联合国教科文组织支持的文献遗产,到利用机器学习连接新型历史见证的复杂开放获取学术数据库
  • 社交媒体作为“连接记忆”: 社交媒体创造了一种“连接性”记忆形式,个人记忆通过分享和标签与公共记忆交织在一起。算法决定在“今日回忆”中重新呈现什么,以及哪些叙事会随着时间被强化。
  • 虚假信息与近期历史: 关于选举、疫情或冲突的虚假叙事可以迅速传播并沉淀为“公共记忆”。正如我们在《假新闻与人工智能:一场信息战》一文中探讨的,人工智能可被用来操纵我们对当下以及近期过去的感知。

关键要点

  • 数字集体记忆产生于机构档案、私营平台和推荐算法的交织,这些算法筛选什么是可见的,什么是隐藏的。
  • 人工智能可以促进全球文献遗产的获取,但也可能放大偏见、虚假信息和集体“虚假记忆”。
  • 尚不存在真正中立的全球档案:尽管存在国际保护项目,但许多社群的记忆仍处于大型数字系统的边缘。
  • 作为公民,我们可以培养对算法机制的认识,选择可靠的信息源,并支持那些保护记忆多样性的倡议。

常见问题解答

1. “算法集体记忆”意味着什么? 这意味着我们越来越多的共享记忆——历史事件、社会叙事、象征性图像——是由算法筛选、排序和重新呈现的。决定我们记住什么的,不再仅仅是学校或电视,而是根据行为模式优化信息流和结果的数字平台。

2. 数字化的全球档案真的可能实现吗? 从技术角度看,存储海量文件并使其随处可访问是可能的。但一个真正的全球档案需要关于保存什么、如何描述、由谁管理以及如何防止排斥和扭曲等方面,具有共享、包容和透明的标准。

3. 人工智能如何可能扭曲集体记忆? 通过放大有偏见或虚假的内容,系统性地排除某些声音或事件,以及通过过度简化历史复杂性的综合来重写过去。当这些影响在我们日常使用的平台中隐形地发挥作用时,尤其危险。

4. 作为个人,我们可以做些什么来保护数字记忆? 我们可以培养“算法素养”:理解我们在线上看到的内容是经过过滤的,核实信息来源,并支持多元化的项目。我们还可以选择提供更高透明度的平台,应用我们在《算法时代的数字隐私》指南中建议的原则。

5. 为什么联合国教科文组织和相关机构如此重视数字档案? 因为如果没有长期保存计划,文件、照片和记录有丢失的风险。像“世界记忆”这样的倡议旨在确保至少部分此类遗产作为公共资源保持可访问性。

结论:我们想走向怎样的集体记忆?

一个宏伟的全球记忆档案库的想法很吸引人:一个人类保存自身痕迹的数字场所,任何人、任何时间都可以访问。但如果我们仔细观察,会发现一个碎片化的图景,由不同的利益所主导,并被那些过滤、分级和重新诠释被记忆内容的算法所贯穿。

正如联合国教科文组织在其宣言中所写:“世界的文献遗产属于所有人,应得到充分保存和保护,并应不受阻碍地供所有人访问。” 这一原则如今常常与往往不透明且私有化的数字基础设施发生冲突。

因此,真正的问题不仅仅是“我们会有全球档案吗?”,而是“我们想借助算法的帮助构建何种集体记忆?”。做出选择意味着参与其中:获取信息、参与讨论并支持那些不将记忆视为可货币化的简单数据库,而是将其视为共同培育的公共资源的项目。