我们仍在谷歌搜索,因为我们仍期待互联网知道一切。这种固执的希望支撑着几乎所有关于信息获取的争论。当搜索质量下降时,我们抱怨谷歌已经变得糟糕。当AI产生幻觉时,我们说模型不严谨。当虚假信息传播时,我们安慰自己真相仍“就在那里”,耐心等着我们拼凑出更好的查询。即使网络被AI垃圾污染,我们仍坚信这是技能问题,并分享搜索技巧。
但如果“真相”之所以更难在网上找到,是因为曾经存储它的基础设施正在崩溃呢?其中一些是自然磨损。链接腐坏每天都在抹除页面。美国宪法关键部分曾因编码错误短暂从国会图书馆网站消失。但通过在原始来源和我们之间插入一个容易出错的AI,谷歌已经确保即使底层页面存在,也可能几乎无法被发现。与此同时,污染正向上游移动:404 Media报道,企业正在Reddit上植入内容,以影响AI搜索生成的答案,污染了这些系统提取摘要的公共记录。
语料库正在实时崩溃。这种退化的数字空间应促使人们对文化主权进行更广泛的理解。目前,这场辩论主要被框定为外国大型平台如Netflix、YouTube或Spotify是否应支持加拿大内容的斗争。这种充满火药味的对话回避了更深层的问题:谁保存并控制着我们的文化记录——不仅是现在,还有后代?
搜索不能再假装是通往稳定知识体系的中立门户。虽然网络一直围绕着决定哪些内容能在网上存续、谁能看到的中介来组织,但今天,互联网的存档功能正在来自优先级不同且往往相互冲突的利益相关者的无情压力下崩溃。至少禁书是摆在明面上的:有反派、有学校董事会会议、有耸人听闻的头条。数字抹除则更为隐蔽,在某些方面更具破坏性。被禁的书仍然可以找到。被清除的网页可能消失得如此彻底,以至于很少有人会意识到它曾存在。
想想FiveThirtyEight的遭遇。这家美国网站专注于民调分析、政治、经济和体育博客。沃尔特·迪士尼公司通过其子公司拥有该博客十多年。其创始人纳特·西尔弗于2023年离开,到2025年3月,剩余员工已被解雇。一旦迪士尼认定该网站不再是活跃资产——没有新的新闻产出,也没有可观的广告收入——它直接删除了整个档案。
检索危机甚至波及维基百科——世界上最重要的志愿者运营的公共知识资源之一。多年来,搜索引擎将数十亿用户引导至其页面。但现在,AI系统在展示结果时会直接抓取并吸收维基百科的内容,使用户无需点击进入。维基百科已成为自身消亡的基础设施:流量减少意味着注意力和捐赠不再可靠地流回这部百科全书,以维持其生存。
互联网档案馆(Internet Archive)正在发生的事情同样令人震惊。它是一个非营利性数字图书馆,收集并提供那些原本可能消失的资料——从录音到历史文件再到书籍。它以“回溯机”(Wayback Machine)最为知名,这项服务在不同时间点捕获了数千亿个网页快照。记者、研究人员、历史学家、律师和公众使用它来恢复已删除的页面、核实过去的声明、记录在线内容的变化。回溯机是网络最接近万无一失的备份记忆的东西。
然而,整个项目不仅因索引和存储不断增长的信息库而承受工程压力,还受到网络攻击和高昂诉讼的打击。在出版商就数字借阅计划成功起诉互联网档案馆,称其为未经授权的复制之后,新闻机构开始阻止回溯机的爬虫,担心存档页面可能为AI公司提供受版权材料的间接来源。每一条新限制都削弱了该档案馆作为全面后盾的能力。
即使是Instagram快拍和WhatsApp状态更新等短暂格式的日益普及,也意味着大部分文化、社会和政治传播从一开始就从未被保存。作为一个社会,我们也许能在糟糕的搜索结果中幸存,并找到另一种方式来安排一场日落亲热约会。但如果我们无法保留和检索集体记忆,就无法企及主权。
目前,你仍然可以用谷歌来了解其他政府如何建设替代品。法国已将外国平台视为对技术主权和国家网络安全的威胁。在2018年底的一项先见之明举措中,法国国民议会和武装力量部开始采用Qwant——一项托管在欧洲的法国服务。Qwant采用不同模式:不存储搜索数据、不出售个人信息、不基于浏览历史使用定向广告。欧洲议会及其720名民选议员和数千名行政人员也完成了切换,反映出人们日益相信信息检索本身就是一种战略资产。
每一次与科技巨头的小告别,都为可能性打开了更宽的门。法国现在要求公务员使用Tchap——一款本土即时通讯应用,在政府通信中取代WhatsApp和Signal等外国平台。欧洲各国政府也纷纷效仿,向硅谷说不,在数十万台工作站上用开源替代品替换微软产品。欧盟委员会刚刚宣布将加入W Social——一个由瑞典初创公司创建的新独立社交网站。正如丹麦数字化部长卡罗琳·斯塔格·奥尔森所说:“如今,太多的公共数字基础设施掌握在极少数外国供应商手中。这让我们变得脆弱。”
这种战斗情绪正推动一些国家走得更远。在一项可能成为里程碑式先例的裁决中,一家德国法院最近裁定谷歌对其AI概览功能生成的虚假陈述承担责任。案件起因是谷歌AI错误地将两家出版公司与骗局式商业行为联系起来。法院推理称,由于搜索引擎用自己的话提取和改写信息,它做的不仅仅是公正地将用户指向公共记录。它正在创建一个全新的内容层——随之而来的是编辑责任。如果外国科技公司不能再声称自己是被动的信息管道,政府将有更大的监管空间。
谷歌正在就该裁决提起上诉,但观点已经明确:维护信息经济不能再是资金不足机构的副业。维基百科之奇妙,正如回溯机之不可或缺。但我们仍需停止假装仅靠志愿者精神就能支撑公共互联网。我们在其他领域对这一责任的理解更清晰。毕竟,道路不由拼车公司管理;支付应用不制定货币政策;云服务提供商不决定国家安全框架(至少目前还没有)。然而,我们在治理数字依赖方面却惊人地漫不经心。
很难想象一个AI战略得到谷歌首席经济学家认可的国家,会决定停止让国家日常政策工作流经一家广告公司。转向默认保护隐私的设置,将帮助加拿大减少不必要的数据泄漏,并表明公共机构将搜索视为数字主权的关键基础设施,而非“免费”消费者服务。
信息具有经济价值;即使单次搜索看起来平凡无奇,聚合模式也能揭示关于社会及其公民的相当敏感的洞察。如果政府想认真治理无形经济,就必须首先治理使信息持久且可发现的条件。我们并非完全从零开始。我们身边就有一些这种公共利益架构的组件:加拿大图书馆和档案馆(Library and Archives Canada),负责保存联邦网络记录和其他历史信息;以及加拿大互联网档案馆(Internet Archive Canada),它与主组织协同工作,并在加拿大大学托管数据备份。
加拿大此前也曾建设过此类数字基础设施。CANARIE(最初为加拿大研究、工业和教育促进网络)帮助为大学、研究人员和创新者建立了全国研究和教育网络。在1990年代,SchoolNet和社区接入计划在连接性被视为理所当然之前,就让学校和图书馆上了网。西蒙弗雷泽大学的公共知识项目为世界带来了开放期刊系统(Open Journal Systems),从2002年开始帮助数千家学术期刊在主要商业平台的控制之外出版。MapleMusic在流媒体吞噬文化发现之前,为加拿大音乐建立了一个在线市场。这些项目共享一个我们应该重新拾起的前提:加拿大不必等待私人平台来组织和控制我们的数字生活。
与谷歌的旧契约正在落幕:把你的好奇心交给我们,我们就把世界给你。接下来崛起的可能更陌生、更合成:一个由机器随机记忆、被中介货币化的互联网。或者它可能更坚固:一个被视为基础设施的公共互联网,保存历史记忆不是因为它有利可图,而是因为它是我们的。
公共知识的未来不仅取决于现存之物,还取决于谁有主动性和动力去保存它。甚至这篇文章也不会永远在线。它应该吗?