
AI 正在吃掉互联网的集体记忆:当搜索不再可靠,谁来保存我们的数字历史?
Google 的 AI 摘要开始编造日落时间,迪士尼直接删掉了 FiveThirtyEight 的全部存档,Wikipedia 的流量被 AI 截胡——The Walrus 这篇长文系统梳理了 AI 时代互联网记忆正在崩塌的多个层面。
原文来源:The Walrus — Google 搜索正在死亡,而接替它的 AI 摘要正在加速互联网集体记忆的崩塌:链接腐烂、存档被删、Wikipedia 流量枯竭,谁来保存我们的数字历史?
有个细节很能说明问题。美国科罗拉多斯普林斯的一位用户,把投影仪搬到户外等着看日落,结果 Google 的 AI 摘要告诉他日落"已经发生过了"。他想看的是一场还没到来的日落,AI 却言之凿凿地宣告它已经结束。这当然是个小错误,甚至有点好笑。但这类错误指向一个更大的问题:全世界最主流的搜索引擎,现在连基本事实都开始拿不准了。
The Walrus 的这篇长文把这个问题往前推了一步:与其说搜索变差了,不如说支撑互联网记忆的基础设施正在崩塌。我们还在用"再搜搜总能找到"的心态安慰自己,但现实是——AI 摘要不仅经常出错,还让原本存在的页面变得"实际上不可发现";污染已经上溯到源头,有公司正在往 Reddit 里植入内容来操纵 AI 搜索的答案。数字档案正在实时消失。
数据不会说谎:档案消失的三种方式
文章给出了几个非常具体的案例。
主动删除。FiveThirtyEight,那个做民调分析出名的美国网站,被迪士尼拥有超过十年。创始人 Nate Silver 2023 年离开,2025 年 3 月剩下的人也被裁光。一旦迪士尼认定这个网站不再是有价值的资产——没有新内容,没有像样的广告收入——就直接把整个存档删了。注意,不是下线、不是归档,是删除。几十年的政治分析、数据报道,说没就没。
被动枯竭。Wikipedia 是全球最大的志愿者知识库,多年来搜索引擎给它的页面带来了数十亿访问量。但现在 AI 系统在展示结果时直接抓取和消化 Wikipedia 的内容,用户根本不需要点击跳转。流量下降意味着注意力和捐款不再回流到这个百科全书,维持它运转的血液断流了。Wikipedia 成了自己衰亡的基础设施。
系统性收缩。Internet Archive 是网络备份记忆的"保险丝"——Wayback Machine 抓取过数千亿个网页快照,记者、研究者、律师都靠它恢复被删页面、核实历史陈述。但这个项目正在被多线夹击:存储索引日益膨胀的工程压力、网络攻击、昂贵的诉讼。出版商赢了数字借阅案之后,新闻机构开始封锁 Wayback Machine 的爬虫,怕的是被归档的页面成为 AI 公司获取版权材料的间接来源。每加一道限制,这个后备方案就少一分完整性。
还有一类消失更隐蔽:Instagram Stories、WhatsApp 状态这类短暂格式,让大量文化、社会、政治交流从一开始就没有被保存。不是丢失,是根本没留下。
—— 广告 ——
数字擦除比禁书更可怕
文章里有一个对比让人印象很深:至少封禁一本书是摆在明面上的——有反派、有校董会会议、有耸人听闻的标题。而数字擦除要隐蔽得多,也更致命。被禁的书还能找到;被抹掉的网页会消失得如此彻底,几乎没人知道它曾经存在过。
德国法院最近的一个判例正在打开新局面:法院裁定 Google 要为其 AI 摘要生成的虚假陈述承担责任。起因是 Google 的 AI 错误地把两家出版公司与诈骗商业行为联系在一起。法院的理由是:搜索摘要用自己的话提取和改写信息,这不只是"中立地指向公共记录",而是在创作一个全新的内容层——随之而来的是编辑责任。如果外国科技公司不能再自称是被动信息管道,政府就有更大的空间去监管它们。
主权视角:这不是加拿大的问题,是所有人的问题
文章从加拿大视角出发,但核心关切是普遍的:信息经济时代的文化主权。它质疑一个荒谬现状——我们连"国家的 AI 战略得到 Google 首席经济学家背书"这种事都能接受,却默认把国家日常政策工作的信息路由交给一家广告公司。
欧洲已经在行动。法国从 2018 年就开始让政府和军方改用欧洲托管的搜索引擎 Qwant——不存储搜索数据、不卖个人信息、不做定向广告;欧洲议会也切换了过去。法国公务员被要求用国产通讯应用 Tchap 替代 WhatsApp 和 Signal。欧洲委员会刚宣布加入一个瑞典初创公司做的独立社交平台 W Social。丹麦数字化部长的话说得直白:"今天太多公共数字基础设施被绑在极少数外国供应商身上,这让我们很脆弱。"
文章提醒,加拿大其实有过这类公共数字基础设施建设的传统:90 年代的 SchoolNet 把学校图书馆接上网,CANARIE 建了国家科研教育网络,SFU 的 Public Knowledge Project 做出了 Open Journal Systems,让成千上万学术期刊摆脱大型商业平台的掌控。这些项目的共同前提是:加拿大不需要等私人平台来组织和控制我们的数字生活。
我的几点延伸思考
这篇文章信息密度高,观点也稳,但我觉得可以再补三个层面。
第一,"AI 摘要让原页面不可发现"这个点被低估了。它不只是体验问题,而是权力结构的转移:以前搜索引擎至少把你导向源头,让源头获得流量和利益;现在 AI 直接消费源头、产出自己的答案,源头什么也得不到。这是价值链上赤裸裸的截胡,Wikipedia 只是最显眼的受害者。
第二,"真相还在那里"的信念本身需要修正。我们习惯把信息获取问题理解成技能问题——搜得不够好、关键词不对、不会用引号。但文章揭示的是,这个前提正在失效:不是你不会搜,而是那个"稳定的知识库"本身在缩水。当页面被删、爬虫被封、存档被诉讼拖垮,再好的搜索技巧也搜不出不存在的东西。
第三,个人层面的应对可能比想象中简单。既然互联网的集体记忆不可靠,重要信息就要自己留存:本地备份、独立存档、关键文档下载保存。文章结尾那句"这篇文章自己也不会永远在线"不是修辞——它是对所有依赖"网上应该还在"的人的提醒。
The Walrus 的结论值得记住:旧交易——"交出好奇心,我们给你全世界"——正在日落。取而代之的可能是一个更陌生、更合成的互联网:由机器随机记住、被中间商变现。或者,如果我们认真对待它,一个被当作基础设施的公共互联网:历史记忆不是因为有利可图而被保存,而是因为它是我们的。
© 2026 四月
原文链接:https://www.aprilzz.com/ramble/google-search-dying-memory
相关文章
别让 AI 把话说得太好听:人性化输出是 Agent 时代的错误抽象
越来越多人给 LLM 加"人性化"指令——短句、通俗、像人说话。但一位开发者的观点值得停下来想想:人性化是在错误的地方做压缩,Agent 之间传递的应该是高保真的原始状态,而不是加工过的漂亮话。
别再用 AI 生成图配你的博客了:它正在赶走真正的读者
793 分登顶 Hacker News 的一篇短文:读者看到 AI 配图,第一反应是怀疑正文也是 AI 写的。对个人博客来说,AI 生成图不是装饰,是信任流失的开始。
“代码从来不是最难的部分”,这句话为什么惹恼了程序员
AI 时代流行一种说法:“LLM 写代码很行,但软件从来不是难在写代码。”资深开发者 Senko Rašić 逐条拆穿这个观点:如果写代码真的容易,为什么行业里充满加班、压力和 bug?