据大量受到惊吓的社交媒体用户称,我们今天所知的互联网匿名时代已经结束,他们今天刚刚发现了一项与人工智能相关的研究。今天在X和Reddit上再次流传的研究论文来自二月份的一项研究,其核心发现让各地的匿名网友感到恐惧:人工智能可以从匿名账户中找出你的真实身份。
Myriad:哪家公司会下一个上市?点击做出你的预测。
这篇论文标题为“使用大语言模型进行大规模在线去匿名化”(Large-scale online deanonymization with LLMs),来自苏黎世联邦理工学院(ETH Zurich)和AI安全组织MATS的研究人员,以及Anthropic(Claude背后公司)的研究员Nicholas Carlini。研究人员声称,支撑Claude、ChatGPT和Gemini的大型语言模型(LLM)可以读取某人的匿名帖子并推断出其现实生活中的身份。无需黑客攻击,仅通过阅读、搜索和推理——这些聊天机器人每天为无数无聊任务所做的同样事情。
论文中写道:“我们的结果表明,保护网络假名用户的实际模糊性已不再成立,在线隐私的威胁模型需要重新考虑。”
AI如何实现去匿名化
研究人员将攻击分为四个步骤:提取(Extract)、搜索(Search)、推理(Reason)和校准(Calibrate)。“提取”指向AI输入某人的帖子,让其总结此人特征:可能居住地、工作、爱好,甚至英式拼写或顺带提到的狗名等怪癖。“搜索”将该摘要转化为嵌入向量(一串数字),计算机可用来在数千名候选者中即时找到相似档案。“推理”由更强大的模型审视最佳几个匹配,像人类调查员那样交叉验证细节,只是速度快得多。“校准”让AI评估自身置信度,仅在较确定时猜测,否则保持沉默。
在一项测试中,团队收集了338名大多使用假名的Hacker News用户,这些用户在个人简介中链接了LinkedIn,研究者剔除身份信息后,让AI代理仅通过网络搜索找出他们是谁。AI正确指认了226人(67%),在实际做出的猜测中错误率约为十分之一。
在另一项针对Anthropic自己对125名科学家访谈转录的测试中,AI仅通过他们描述工作的方式就正确识别了至少9人。
令人担忧的部分
真正的发现在于成本。论文称,每次搜索的AI订阅费用仅需1至4美元。它也不需要数据泄露、黑客攻击或内部权限,仅使用普通聊天机器人内置的网络搜索和摘要功能。研究人员认为这正难以阻断:没有单一的“去匿名化此人”开关可禁用,只是一串单独看似无害的任务。
这并非首次凭少量细节揭穿身份。2008年,研究者通过将Netflix所谓匿名电影评分数据集与公开IMDb评论匹配,破解了匿名。不同在于,如今AI在杂乱非结构化文本(笑话、评论、随口提及)上自行匹配,而非整齐电子表格。
“大家冷静”的部分
论文中最吓人的数字也有需注意之处。为衡量成功,研究者需要已知真实身份的对象,因此他们挑选了已链接LinkedIn的账户,或将同一人的帖子历史拆成两半隐藏关联。这是受控最佳情况,非证明任意假名账户今天能被破解。
规模也削弱了最吓人的数字。候选池越大,难度越高。面对8.9万名候选者,最强AI方法在90%精度下仅捕获约一半正确匹配(精度指猜测正确率,召回率指实际捕获的真实匹配比例)。
研究者未发布工具、提示词或任何揭露的真实姓名,研究发布前通过了伦理审查。他们并非提供人肉工具,而是记录作者称当前AI模型已有的能力。
即便你从未发帖于Reddit,此事仍重要
加密货币用户深谙此恐惧。继2025年Coinbase数据泄露等众多事件后,一波人肉搜索与绑架企图显示泄露身份如何迅速变成上门真实地址。AI驱动的去匿名化是同一威胁但去掉泄露环节:它基于你已公开发布的内容,无需泄漏。
此事也发生在Anthropic披露国家支持的黑客用Claude运行大部分网络间谍活动数月后,提醒AI滥用研究总跑在防护栏前面。
对于任何因 activism、虐待、性取向、移民状态或工作不喜公开意见而使用假名发帖的人,这意味着多年旧评论中散落的小镇、雇主甚至宠物名会汇成指纹。这始终可能——AI只是让它更快更便宜。但若担心此类人肉,解决办法不是恐慌而是习惯:减少绑定任一假名的特定识别细节,对真正敏感内容,使用根本不保留数据的工具。
