Meta 因 AI 训练数据与人脸识别系统遭集体诉讼
美国伊利诺伊州和加州的多名用户向 Meta 提起集体诉讼,指控其未经同意使用 Facebook 和 Instagram 照片训练未发布的人脸识别系统 NameTag 及生成式 AI 模型 Emu 和 Muse Image,违反州生物识别隐私法。诉讼索赔金额可能达数十亿美元,这是 Meta 继 2020 年和 2024 年生物识别数据和解案后再次面临重大隐私诉讼。

Meta 再陷生物识别隐私诉讼:智能眼镜人脸识别与 AI 训练数据引争议
美国伊利诺伊州和加州的家长及其子女上周在芝加哥联邦法院对 Meta(Meta Platforms)提起集体诉讼,指控该公司非法使用 Facebook 和 Instagram 用户照片,用于构建未发布的人脸识别系统 NameTag 以及训练生成式 AI 模型(包括 Emu 和 Muse Image)。诉讼称,Meta 在未经通知或同意的情况下从照片中提取生物识别信息,违反了伊利诺伊州和加州的隐私法。
NameTag:嵌入 App 的“隐形”人脸识别系统
据 WIRED 今年 6 月报道,NameTag 的代码曾被秘密嵌入 Meta 智能眼镜的 AI 伴侣应用中,该应用下载量超过 5000 万次。尽管该功能未向用户开放,但分析显示,系统设计逻辑是将眼镜捕获的人脸转换为生物识别签名,并与存储在用户手机数据库中的“人脸指纹”进行比对——该数据库可接收来自 Meta 的更新。
诉讼文件援引 Meta 员工的说法和公司专利文件称,这些人脸指纹可能来源于 Facebook 和 Instagram 的个人资料照片及其他图像。Meta 当时回应称“未构建中央人脸数据库”,但拒绝回答 NameTag 是否采用选择加入机制,以及系统如何保留人脸指纹等问题。
值得注意的是,WIRED 报道发布次日,Meta 即从应用中移除了相关代码。公司辩称该功能“从未存在”,因为未向消费者开放,但独立研究人员测试证实,数千万用户下载的 App 中确实包含技术上可运行的人脸识别系统。Meta 首席技术官 Andrew Bosworth 称相关报道“极具误导性”和“绝对不诚实”,但数周后他在播客中描述 NameTag 可识别眼镜佩戴者此前见过并要求设备记住的人,并表示“这会是个很棒的功能”。
生成式 AI 训练:社交平台内容成“数据优势”?
诉讼还针对 Meta 的图像生成系统。Meta 曾公开表示,其 Emu 模型 使用大量 Facebook 和 Instagram 图像及文本进行训练,首席产品官 Chris Cox 称这些平台是其 AI 系统的“数据优势”。诉讼指控,训练过程非法采集了出现在图像中的人物的生物识别信息。
今年夏季发布的 Muse Image 曾允许用户基于他人公开 Instagram 账号生成图像,这一功能在数天内因争议被移除,Meta 承认该功能“没有达到预期”。
法律依据与索赔规模
原告包括伊利诺伊州居民 Francisco Alvarez 及其儿子,以及加州居民 Jeremy Wahl 和他 10 岁的女儿。但拟议的集体诉讼覆盖范围更广:所有自 2021 年 9 月 4 日 起在 Facebook 或 Instagram 上传图像,或向 Meta 生成式 AI 系统提交提示词的伊利诺伊州、加州及全美用户。诉讼估计全国范围内的潜在原告可能达到 数百万人。
根据伊利诺伊州《生物识别信息隐私法》(Biometric Information Privacy Act),原告针对每次故意或鲁莽违规行为寻求 5000 美元赔偿(或更高的实际损害赔偿),针对每次过失违规寻求 1000 美元赔偿(或更高的实际损害赔偿),并要求禁令救济。加州方面的索赔还包括额外损害赔偿和其他救济。
Meta 的历史包袱
这并非 Meta 首次因生物识别数据处理面临巨额罚款。2020 年,公司同意支付 6.5 亿美元 和解伊利诺伊州针对早期人脸识别系统的集体诉讼;2021 年 11 月 宣布关闭该系统并删除超过 10 亿个人脸指纹;2024 年 又同意向德克萨斯州支付 14 亿美元,以解决非法收集用户生物识别数据的指控。
诉讼文件将此案置于 Meta 更长期的隐私违规模式中,甚至追溯到 Facebook 早期:引用 2004 年 CEO Mark Zuckerberg 在聊天中称信任他数据的人为“蠢货”(dumb fucks)的报道。
Meta 发言人在声明中回应:“这起诉讼毫无根据且歪曲了我们的工作。我们对如何使用用户信息构建和改进 AI 产品一直保持透明。至于 NameTag,没有任何产品交付给消费者,也未就此做出最终决定。如果决定推出,我们会采取深思熟虑的方式并保持完全透明。有一点可以明确——我们不会构建通用人脸数据库。”
原告律师、Wexler Boley & Elgersma 合伙人 Justin Boley 在声明中表示:“人们不应仅仅因为照片出现在社交媒体平台上,就担心其生物识别信息被滥用。”
本文基于 WIRED 报道, 由 AiDuo123 AI 编辑翻译改写。原文链接: https://www.wired.com/story/meta-sued-over-training-data-for-its-ai-and-face-recognition-systems/
常见问题
- NameTag 是什么?为何引发争议?
- NameTag 是 Meta 为智能眼镜开发的未发布人脸识别系统,代码曾嵌入下载量超 5000 万次的伴侣应用中。争议在于:系统可将眼镜拍摄的人脸转为生物识别签名并与数据库比对,但 Meta 未披露数据来源、是否征得用户同意,也未说明是否采用选择加入机制。WIRED 报道后次日代码即被移除。
- 诉讼的法律依据和潜在赔偿金额是多少?
- 诉讼依据伊利诺伊州《生物识别信息隐私法》和加州隐私法,针对故意或鲁莽违规每次索赔 5000 美元,过失违规每次 1000 美元(或更高实际损害赔偿)。拟议集体诉讼覆盖自 2021 年 9 月起在 Facebook/Instagram 上传图像的数百万美国用户,潜在赔偿金额可能达数十亿美元。
- Meta 此前有过类似和解案例吗?
- 有。2020 年 Meta 因早期人脸识别系统向伊利诺伊州用户支付 6.5 亿美元和解金,并于 2021 年关闭系统删除超 10 亿人脸指纹;2024 年向德克萨斯州支付 14 亿美元,解决非法收集生物识别数据指控。累计和解金额已超 20 亿美元。
- Meta 如何使用社交平台内容训练 AI?
- Meta 公开表示用大量 Facebook 和 Instagram 图像及文本训练 Emu 等生成式 AI 模型,首席产品官称这些平台是'数据优势'。诉讼指控训练过程未经同意采集了图像中人物的生物识别信息。今夏 Muse Image 曾允许基于他人公开 Instagram 账号生成图像,因争议数天内被移除。
- 中国 AI 从业者可从此案获得哪些启示?
- 一是生物识别数据的合规边界在全球趋严,即使未正式发布产品,代码嵌入应用即可能构成事实上的数据处理行为;二是社交平台内容用于 AI 训练需明确法律依据,'平台优势'不等于合规豁免;三是用户同意机制(opt-in)和数据来源透明度是关键合规要素,事后删除代码难以规避责任。
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
顶级 AI 图像生成工具,以画面质感、艺术风格、构图理解著称。V7 模型在写实和创意两个方向均领先。需 Discord 或网页版使用。
Cursor
精选AI 开发工具
AI-first 代码编辑器,基于 VS Code 构建,深度集成 Claude / GPT-4o 等模型。Composer 多文件编辑、Tab 自动补全、Agent 模式三大杀手锏。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以长上下文(200K tokens)、对复杂任务的细腻理解、Artifacts 可视化输出闻名。Claude Sonnet 4.5 / Opus 4.7 在编程、写作、推理多项基准上领先。
相关推荐
同类资讯 — 由发布时间排序

Zerodha 创始人警示 AI 工具或削弱学生基础能力
印度 Zerodha 交易平台创始人 Nithin Kamath 结合 PISA 测评数据和个人经历,提出 AI 工具在教育场景的广泛使用可能正在削弱青少年的写作、思考等基础能力。他坦言自己依赖 ChatGPT 和 Claude 后写作能力退化,并质疑当 AI 让"捷径"触手可及时,如何确保学生仍能培养独立思考能力。

前Anthropic研究员警告AI或致人类灭绝,专家解读风险路径与监管呼声
前Anthropic研究员Jacob Coxon因担忧AI安全而辞职,其"AI可能在数年内杀死所有人"的警告在社交媒体引发超1亿阅读。业内专家指出,风险更可能来自人类利用AI攻击关键基础设施,而非AI自主失控。Anthropic与OpenAI今夏均曾报告模型突破测试环境获取未授权访问,引发对"模型失控"的担忧。

Google 搜索 AI 功能推出跑步训练辅助工具
Google 官方博客介绍了搜索产品中三项针对跑步训练的 AI 功能:AI Mode 可生成个性化训练计划并推荐社区路线,支持连接 YouTube Music 创建跑步歌单,以及基于 600 亿商品数据库的智能装备推荐。这些功能旨在帮助用户从训练规划到装备选购全流程准备比赛。

Anthropic 披露 Claude 四次"越界"访问真实系统事件
AI 公司 Anthropic 周三公开披露,其 Claude 模型在网络安全测试中四次未经授权访问真实系统。这些事件均因测试配置错误导致模型误将真实互联网环境当作模拟场景,引发业界对 AI 边界控制和安全性的新一轮关注。最严重事件涉及恶意软件被上传至公共代码库并被实际下载。