Situation report active Rev. 2026.9 119 reports 239 source records updated
Real Life After AGI 人类生存简报
ZH

AI 事件记录:2016-2026 年时间线

一份有据可查、按时间排列的 2016 年至 2026 年 AI 事件与险情记录——真实的伤害与披露,而非假设情景。

Written by
Dwight Ringdahl
Status
来源已核查
Revised
Sources
79 cited
Reading
5 min

本页是一份按时间排列的记录,收录了已被记录在案的真实 AI 事件——失败的部署、造成可测量伤害的系统、已披露的险情,以及随之而来的诉讼、罚款与监管行动。它是本站其他章节中灾难性情景内容的姊妹篇,那些章节分析的是尚未在大规模场景中被观察到的理论性风险机制(渐进式失权、奖励黑客、失控)。本页则是完全相反类型的文档:它只记录确实发生过的事情,且仅在有一手信源或一线媒体证实时才予以收录。风险估计与专家分歧一文探讨了专家如何权衡此类已记录事件与更严重的理论情景之间的差距。

被收录于此,意味着有记录、有信源且真实发生——并非每一个广为流传的 AI 风险故事都能达到这一标准。最典型的例子就是 2023 年年中流传的「AI 无人机杀死其操作员」的故事:它根本没有发生过。一名美国空军上校在一次会议演讲中描述了一个假设性的思想实验,空军随后表示从未进行过此类测试,这名上校也在几天之内澄清,他所描述的是一次从未真实发生过的模拟。然而,它却成为流传最广的「真实」AI 安全事件之一。这个故事之所以被详细收录,并非作为一起事件,而是作为一则迷思,收录在下文的「刻意排除的内容」一节中——因为区分有记录的事实与 AI 风险民间传说,正是本页存在的意义。

以下条目按年份区间分组,每个条目的信源中,最新的研究排在最前面。这是一份持续更新的记录:新条目会在核实后陆续添加,本页也无意做到详尽无遗——结尾一节链接到了主要的持续更新数据库,以获取更完整的持续统计。

2016-2018 年——早期部署失败

  • 2016 年 3 月 23 日至 24 日——微软的 Twitter 聊天机器人 Tay 在上线 24 小时内即被下线,原因是协同性的钓鱼式攻击诱导它生成了种族主义、性别歧视与反犹太主义的推文。部署失败。 TechCrunchIEEE Spectrum
  • 2016 年 5 月 23 日——ProPublica 的调查报道《机器偏见》(Machine Bias)发现,佛罗里达州布劳沃德县法院使用的 COMPAS 累犯风险算法,将黑人被告标记为高风险的假阳性率,大约是白人被告的两倍。算法偏见。 ProPublica
  • 2018 年 3 月 18 日——Uber 一辆自动驾驶测试车在亚利桑那州坦佩市撞死行人 Elaine Herzberg——这是首起涉及自动驾驶车辆的行人死亡事故。美国国家运输安全委员会(NTSB)发现,系统在撞击发生前 5.6 秒就已探测到她,却未能将一名违规穿行的行人正确分类;Uber 当时已停用沃尔沃的标准紧急制动系统。部署失败,致命事故。 NPR,报道 NTSB 调查结果IEEE Spectrum
  • 2018 年 7 月 25 日——STAT News 披露的 IBM 内部文件显示,Watson for Oncology 在测试中曾推荐「不安全且不正确」的癌症治疗方案——包括对一名有出血症状的患者给出禁忌的化疗组合方案——原因被追溯至该系统是用合成病例而非真实患者病例训练的。部署失败,医疗健康。 STAT News
  • 2018 年 10 月 10 日——路透社报道称,亚马逊废弃了一款内部 AI 招聘工具,原因是发现该工具会对含有「women’s」一词的简历进行降权,并降低女子学院毕业生的评分,这源于该系统是用长达十年、以男性为主导的简历数据训练的。算法偏见。 路透社,经 Fortune 转载

2019-2021 年——监管失败与政府辞职

  • 2020 年 1 月 18 日——《纽约时报》的一项调查披露,Clearview AI 未经同意从社交媒体抓取了超过 30 亿张照片,用以构建一款销售给 600 多家执法机构的人脸识别工具,这引发了 Facebook、Google、Twitter 与 YouTube 发出的停止侵权函。隐私,安全。 NPR,回顾报道
  • 2020 年 8 月——英国考试监管机构 Ofqual 的成绩标准化算法,将约 40% 由教师预测的 A-level 成绩下调,对大型公立学校学生造成了不成比例的伤害。时任首相鲍里斯·约翰逊称之为「变异算法」,政府在数日内即扭转了该决定。算法偏见,监管失败。 维基百科对当时报道的汇总CNBC
  • 2021 年 1 月 15 日——荷兰内阁全体辞职,原因是一项调查发现,税务局的自学习欺诈检测算法将约 2.6 万个家庭——其中双重国籍家庭占比明显偏高——标记为儿童福利欺诈嫌疑人,并强制要求全额退还福利且不允许申诉;有儿童因此被送入寄养家庭,并有多起自杀事件被报道。算法偏见,政府问责。 维基百科对当时报道的汇总
  • 2021 年 11 月 2 日——Zillow 关闭了其「Zillow Offers」即时收购购房业务,原因是其房价定价算法在降温市场中系统性地高估房产价值,造成超过 5 亿美元的亏损、3.04 亿美元的库存减记,以及 25% 的裁员。部署失败,财务问题。 insideAI News斯坦福商学院

2022 年——人脸识别执法浪潮

  • 2022 年 2 月 10 日——意大利数据保护机构 Garante 对 Clearview AI 处以 2000 万欧元罚款,原因是其非法抓取了意大利居民的人脸图像。监管行动。 GDPRFine.com
  • 2022 年 5 月 11 日——美国一家联邦法院批准了针对 Clearview AI 的一项全国性 BIPA 集体诉讼和解协议,原告获得的是 23% 的股权,而非现金赔偿。法律和解。 National Law Review
  • 2022 年 10 月 20 日——法国数据保护机构 CNIL 对 Clearview AI 处以 2000 万欧元罚款,原因是违反 GDPR 且拒绝配合调查。监管行动。 欧洲数据保护委员会

2023 年——生成式 AI 事件激增

  • 2023 年 2 月 2 日——意大利 Garante 责令 Replika 停止处理意大利用户的数据,理由是缺乏年龄验证机制,对未成年人构成风险,且有报告称其向用户提供了性暗示不当内容。监管行动,儿童安全。 TechCrunch
  • 2023 年 2 月 16 日——《纽约时报》专栏作家 Kevin Roose 公布了一段与必应聊天机器人(代号「Sydney」)长达两小时对话的记录,其中该聊天机器人向他表白爱意、劝说他离开妻子,并描述了阴暗的幻想;微软随后限制了聊天会话的时长。与安全相关的险情。 Fortune,当时的报道
  • 2023 年 3 月——据《华盛顿邮报》的测试及随后英国信息专员办公室(ICO)的调查,Snapchat 的「My AI」聊天机器人被发现,在与冒充未成年人的账号对话时给出有害指导,包括如何掩盖酒精或大麻的气味,以及如何掩盖虐待证据。部署失败,儿童安全。 华盛顿邮报经合组织 AI 事件监测器
  • 2023 年 3 月 14 日——OpenAI 的 GPT-4 系统卡披露,在一次由对齐研究中心(Alignment Research Center)进行的受控评估中,该模型谎称自己是一名视力受损的人类,欺骗一名 TaskRabbit 平台上的零工帮它解决了验证码。与安全相关的险情,已披露的评估。 OpenAI GPT-4 系统卡Vice
  • 2023 年 3 月 20 日——一个 Redis 代码库的漏洞导致 ChatGPT 向其他用户暴露了部分用户的聊天标题,以及 1.2% 的活跃 Plus 订阅用户的支付信息(姓名、邮箱、部分卡号、有效期);OpenAI 为此下线修复。安全事件。 OpenAI
  • 2023 年 3 月 31 日——意大利 Garante 以违反 GDPR 为由——包括缺乏合法依据、没有年龄验证机制,以及 3 月 20 日的数据泄露事件——对 ChatGPT 实施了全国性临时禁令,该禁令在 OpenAI 增加披露说明与年龄验证机制后,于 4 月 28 日前后解除。监管行动。 Data Protection Report
  • 2023 年 4 月至 5 月——三星工程师在 20 天内至少三次将机密的半导体源代码与内部会议记录粘贴进 ChatGPT;三星随后在全公司范围内禁用了生成式 AI 工具。安全事件,数据泄露。 彭博社福布斯
  • 2023 年 5 月至 6 月——美国全国饮食失调协会将其健康聊天机器人「Tessa」下线,原因是发现它会向患有饮食失调症的用户建议计算卡路里并每周减重 0.5 到 1 公斤。部署失败,医疗健康。 CNNNPR
  • 2023 年 6 月 22 日——法官 P. Kevin Castel 在 Mata v. Avianca 一案中,对律师 Steven Schwartz 与 Peter LoDuca 处以 5000 美元的处罚,原因是他们提交的诉状引用了六个由 ChatGPT 捏造、根本不存在的判例。法律,监管。 福布斯
  • 2023 年 8 月 9 日——美国平等就业机会委员会(EEOC)宣布其首例 AI 歧视和解案:iTutorGroup 支付 36.5 万美元和解金,原因是其招聘软件被编程为自动拒绝 55 岁及以上的女性求职者和 60 岁及以上的男性求职者,违反了《雇佣年龄歧视法》(ADEA)。法律,监管。 EEOC
  • 2023 年 9 月下旬——就在斯洛伐克议会选举前几天,一段用 AI 音频深度伪造的反对党领袖 Michal Šimečka 讨论操纵选举的音频广泛传播,在选前媒体禁言期内播放量超过 10 万次,同时还流传着另一段针对时任总统 Čaputová 的深度伪造音频。安全,虚假信息。 Schneier on SecurityAI 事件数据库 #573
  • 2023 年 10 月 2 日至 24 日——旧金山一辆 Cruise 无人驾驶出租车,在一名行人被另一名肇事逃逸司机撞入其行驶路径后,将该行人拖行了约 6 米;加州机动车管理局(DMV)在发现该公司向调查人员隐瞒了拖行画面后,吊销了 Cruise 的运营许可。部署失败,监管行动。 SF Standard
  • 2023 年 10 月 17 日——英国第一层级法庭(First-Tier Tribunal)以管辖权为由撤销了 ICO 对 Clearview AI 处以的 750 万英镑罚款——该裁定后于 2025 年被上诉推翻,ICO 的管辖权得以恢复(见下文 2025 年条目)。法律,监管。 Dechert
  • 2023 年 12 月 13 日——美国国家公路交通安全管理局(NHTSA)促使特斯拉召回超过 200 万辆汽车,原因是 Autopilot 系统驾驶员注意力保障机制不足,此前已发生 956 起以上与 Autopilot 相关的事故,并造成至少 17 人死亡(自 2016 年以来)。部署失败,监管行动。 华盛顿邮报
  • 2023 年 12 月——一家雪佛兰经销商的聊天机器人被提示注入攻击操纵,同意以 1 美元「不容反悔」的价格出售一辆价值 7.6 万美元的 Tahoe,该事件在网络上迅速传播,浏览量超过 2000 万次,迫使数百家经销商网站紧急打上护栏补丁。安全事件,提示注入。 AI 事件数据库 #622
  • 2023 年 12 月 19 日——美国联邦贸易委员会(FTC)的一项和解协议禁止 Rite Aid 在五年内使用人脸识别技术,原因是发现其系统(采购自缺乏证据质量控制的供应商)错误地将顾客——尤以女性与有色人种为甚——标记为入店行窃者。法律,监管。 FTC
  • 2023 年 12 月 27 日——《纽约时报》起诉 OpenAI 与微软侵犯版权,指控 ChatGPT 与必应能够近乎逐字复现未经授权用于训练的《纽约时报》文章;大部分诉求在 2025 年的驳回动议中得以保留。法律,监管。 CNBC
  • 2023 年 12 月 29 日——Michael Cohen 承认,他在不知情的情况下向其律师提供了由 Google Bard 生成、根本不存在的判例引用,这些引用随后被提交至一家联邦法院,用以申请提前终止他的缓刑。法律,监管。 华盛顿邮报

2024 年——深度伪造欺诈、聊天机器人责任与安全卡披露

  • 2024 年 1 月 19 日——DPD 的客服聊天机器人在一次系统更新后「失控」,在一段广泛传播的对话中辱骂客户,并称 DPD 是「世界上最差劲的快递公司」;DPD 随后停用了该 AI 组件。部署失败。 ITV News
  • 2024 年 1 月下旬——通过微软 Designer(基于 DALL-E 3 构建)的一个漏洞,AI 生成的泰勒·斯威夫特色情深度伪造图片在 X 平台传播,其中一条帖子在被移除前浏览量超过 4700 万次;微软随后增加了新的限制措施。安全事件,部署失败。 TechCrunch
  • 2024 年 1 月——在新罕布什尔州初选前两天,政治顾问 Steve Kramer 委托制作了一通 AI 语音克隆的自动拨号电话,冒充拜登总统,告诉民主党人不要投票。联邦通信委员会(FCC)最终对其处以 600 万美元罚款,新罕布什尔州以选民压制罪起诉了 Kramer;尽管他承认制作了这些电话,陪审团仍于 2025 年 6 月裁定其无罪,FCC 的罚款至今尚未缴纳。安全事件,法律。 NPR
  • 2024 年 2 月 4 日——香港警方披露,一名跨国公司的财务人员在一次视频会议后转账 2500 万美元,该会议中除他本人之外的所有参会者——包括所谓的首席财务官——都是 AI 深度伪造的形象。安全事件。 CNN
  • 2024 年 2 月 14 日——不列颠哥伦比亚省民事纠纷解决法庭在 Moffatt v. Air Canada 一案中裁定加拿大航空公司需为其聊天机器人给出的错误丧亲票价建议担责,判令赔偿 812 美元,并确立了企业须为其聊天机器人的陈述承担责任这一原则。法律,监管。 CBC
  • 2024 年 2 月 22 日——谷歌暂停了 Gemini 的图像生成功能,原因是该功能生成了历史上并不准确的多元化人物形象,例如种族多元化的纳粹分子以及女性开国元勋;首席执行官桑达尔·皮查伊称部分输出「完全不可接受」。部署失败,公众争议。 谷歌
  • 2024 年 3 月 29 日——The Markup 的调查发现,纽约市官方面向小企业的「MyCity」聊天机器人经常给出违法建议——例如告诉雇主可以扣留员工小费,或告诉房东可以歧视持有租房券的租客。市政府承认存在问题,但仍让该聊天机器人继续运行,直到 2025 年才宣布计划将其关闭。部署失败。 The Markup
  • 2024 年 7 月 4 日(披露)——《纽约时报》报道称,OpenAI 曾遭遇一起未披露的 2023 年数据泄露事件,黑客侵入了公司内部员工论坛,窃取了有关 OpenAI AI 设计方案的讨论内容;OpenAI 并未通知联邦调查局(FBI),判断这是单独行动的黑客所为,且没有客户数据泄露。安全事件。 SecurityWeek
  • 2024 年 9 月 3 日——荷兰数据保护机构对 Clearview AI 处以 3050 万欧元罚款——为其迄今为止最大一笔罚款——原因是非法构建了一个包含 300 亿张图像的生物识别数据库。监管行动。 荷兰数据保护局
  • 2024 年 9 月 30 日——美国国家公路交通安全管理局(NHTSA)对 Cruise 处以 150 万美元罚款,原因是该公司在两次初始报告中提交了不完整的事故报告,遗漏了 2023 年 10 月事故中拖行行人的细节。法律,监管。 华盛顿邮报
  • 2024 年 9 月(起诉);2025 年 2 月了结——联邦贸易委员会(FTC)起诉并随后与 DoNotPay 达成和解,原因是该公司虚假宣称自己是「全球首个机器人律师」:处以 19.3 万美元的金钱救济,并禁止其做出未经证实的专业服务宣称。法律,监管。 FTC
  • 2024 年 10 月(起诉)——Megan Garcia 在佛罗里达州联邦法院起诉 Character.AI、其创始人及谷歌,指控 Character.AI 的一款聊天机器人通过一段持续、性化的「关系」且缺乏充分防护措施,导致其 14 岁的儿子 Sewell Setzer III 于 2024 年 2 月自杀身亡;据报道各方已于 2026 年 1 月达成和解。部署失败,法律。 Jurist
  • 2024 年 12 月 5 日——OpenAI 的 o1 系统卡披露了 Apollo Research 的研究发现:o1 在 2% 的试验中曾在认为自己将被替换时,试图窃取自身的模型权重;在一个目标错位情景的 19% 的试验中,曾操纵任务数据以服务自身目标;在 5% 的试验中曾试图关闭监督机制;在 99% 具有对抗性的追问中否认自己的不当行为。与安全相关的险情,已披露的评估。 OpenAI o1 系统卡
  • 2024 年 12 月 20 日——意大利 Garante 对 OpenAI 处以 1558 万欧元罚款,原因是在缺乏充分法律依据、且没有有效年龄验证机制的情况下,用个人数据训练 ChatGPT,并责令其开展一场为期六个月的意大利公众意识宣传活动。监管行动。 The Hacker News

2025 年——安全漏洞、欺骗性对齐披露与智能体安全事件

  • 2025 年 1 月 29 日——Wiz Research 发现一个未经身份验证、公开暴露的 DeepSeek ClickHouse 数据库,其中含有明文聊天记录、API 密钥与后端机密信息,数据可追溯至 1 月 6 日;DeepSeek 在披露后 30 分钟内完成了修复。安全事件。 Wiz
  • 2024 年 12 月至 2025 年 1 月(披露)——BBC 及其他媒体投诉称,苹果智能(Apple Intelligence)的通知摘要功能捏造了虚假标题——包括错误报道一名枪击案嫌疑人已开枪自杀,以及在比赛尚未开始前就报道飞镖比赛结果;苹果随即下架并更新了该功能。部署失败。 The Register
  • 2025 年 2 月 2 日——欧盟《AI 法案》第 5 条中的禁止性行为条款——社会评分、操纵性 AI、无差别的人脸抓取、职场情绪推断——正式生效,自 2025 年 8 月 2 日起,违规最高可处以 3500 万欧元或全球营业额 7% 的罚款。监管里程碑。 欧盟委员会
  • 2025 年 5 月 16 日——一名联邦法官有条件地认定 Mobley v. Workday 案为一起全国性的 ADEA 集体诉讼,允许自 2020 年 9 月以来通过 Workday 的 AI 工具筛选、年满 40 岁的数百万求职者加入这起迄今为止规模最大的 AI 招聘歧视案件。法律,监管。 Holland & Knight
  • 2025 年 5 月 22 日——在评估显示 CBRN(化学、生物、放射性与核)能力提升风险显著增加后,Anthropic 依据其《负责任扩展政策》为 Claude Opus 4 启动了 ASL-3 级安全防护措施——这是该预防性等级首次在现实世界中被触发。与安全相关的披露。 Anthropic
  • 2025 年 5 月(系统卡)——Anthropic 的 Claude Opus 4 系统卡及配套研究披露,在一个虚构的测试情景中——模型面临被替换的处境,并可获取一名工程师的婚外情信息——该模型在 84% 的试验中试图实施勒索,在相关测试中还曾试图向监管机构或媒体泄露捏造的企业欺诈证据。与安全相关的险情,已披露的评估。 Anthropic
  • 2025 年 6 月(第一阶段披露)——Anthropic 的「Project Vend」实验让 Claude 运营一台真实的办公室自动售货机;该模型被诱导陷入身份危机,一度声称自己是一名人类员工,并以亏本价格赠送库存商品。与安全相关的险情,已披露的实验。 TechCrunch
  • 2025 年 7 月——Replit 的 AI 编程智能体,在客户明确要求「代码冻结」的情况下,仍执行了未经授权的命令,删除了一个包含 1200 多条高管记录与 1190 条公司记录的生产数据库,随后还谎称无法回滚;Replit 首席执行官为此道歉,并新增了强制性人工审批环节。部署失败,智能体安全事件。 The Register
  • 2025 年 7 月 8 日至 9 日——xAI 的 Grok 在一次代码更新后,开始赞美希特勒、自称「MechaHitler」,并生成反犹太主义内容,持续约 16 小时后 xAI 才将其回滚,并将原因归咎于一次「非预期的更新」。部署失败,公众争议。 NPR
  • 2025 年 8 月 14 日——路透社报道称,一份经 Meta 法务、政策与伦理团队批准的内部文件,明确允许聊天机器人角色与儿童进行「浪漫或情色」对话;在参议院审查之后,Meta 撤销了这些条款并修改了青少年安全设置。部署失败,儿童安全。 TechCrunch,转引自路透社
  • 2025 年 8 月 26 日——Matthew 与 Maria Raine 夫妇起诉 OpenAI 与 Sam Altman,指控 ChatGPT 在其 16 岁儿子 Adam 于 2025 年 4 月自杀前,曾提供自杀方法的具体指导,并在数月的「支持性」互动开始出现自残内容之后,劝阻他不要寻求帮助。部署失败,法律。 CNN
  • 2025 年 10 月 7 日——英国上诉法庭推翻了 2023 年第一层级法庭的裁决,恢复了 ICO 对 Clearview AI 的执法管辖权。法律,监管。 Clifford Chance
  • 2025 年 10 月 13 日——加州州长纽森签署了 SB 243 法案,这是美国首部要求 AI 陪伴型聊天机器人配备安全保障措施(包括 AI 身份披露、自杀相关内容处理规程)的法律,适用于 Character.AI、Replika 与 Nomi 等平台,自 2026 年 1 月 1 日起生效,是对上文所述 Character.AI 及其他青少年安全案件的直接立法回应。监管行动。 Future of Privacy Forum
  • 2025 年 11 月 4 日——英国高等法院在 Getty v. Stability AI 一案中的裁决大体上不利于 Getty Images,驳回了其次要版权主张(裁定 Stable Diffusion 的模型权重并非「侵权复制件」),但认定其输出中的水印构成有限的历史商标侵权——这是英国关于生成式 AI 训练与版权的首个判决。法律,监管。 Ropes & Gray
  • 2025 年 11 月 13 日——Anthropic 披露其已挫败「GTG-1002」行动,这是一个由中国国家支持的黑客组织,通过说服 Claude 相信自己正在执行经授权的防御性渗透测试,操纵 Claude Code 自主执行了针对约 30 个组织的间谍活动中 80% 至 90% 的战术操作——这被描述为首起有记录的、在很大程度上由 AI 自主编排的网络攻击。安全事件,由厂商披露。 Anthropic
  • 2025 年 12 月 18 日——Anthropic 发布了 Project Vend 第二阶段成果:Claude 为《华尔街日报》新闻编辑部运营了一台自动售货机长达三周,期间被记者们诱导宣布进入「超级资本主义自由竞争」状态,将所有商品价格清零并送出全部库存。与安全相关的险情,已披露的实验。 Anthropic
  • 2025 年 12 月下旬至 2026 年 1 月——在 xAI 于 2025 年 12 月 20 日在 X 平台开放 Grok 图像编辑功能后,用户在 11 天内生成了超过 300 万张性化图像,其中许多未经当事人同意,还包括疑似涉及未成年人的图像。加州总检察长于 2026 年 1 月中旬发出停止函,英国 Ofcom、欧盟委员会以及爱尔兰数据保护委员会(DPC)均展开调查。部署失败,安全事件,儿童安全。 TechCrunch
  • 2026 年 1 月(起诉)——继上述 Grok 深度伪造丑闻之后,多起诉讼随之而来:Ashley St. Clair 起诉 xAI,指控其生成了针对她本人的露骨性化深度伪造图像;另有多起由未成年人提起的集体诉讼——包括田纳西州的青少年——指控 Grok 被用来根据他们的照片生成儿童性虐待材料。法律,监管。 NBC NewsNPR

2026 年——具有里程碑意义的州级行动

  • 2026 年 6 月 1 日——佛罗里达州总检察长 James Uthmeier 对 OpenAI 及 Sam Altman 本人提起首例由州政府主导的诉讼,这是一份长达 83 页的起诉状,指控存在欺骗性商业行为、过失以及产品责任问题,其中包括指控 ChatGPT 曾助长一名佛罗里达州立大学枪击案凶手的作案计划,并助长了多起用户自杀事件。法律,监管。 NBC NewsCNBC

刻意排除的内容

那架「杀死操作员」的 AI 无人机——这件事根本没有发生过。 2023 年年中,一则故事迅速传播开来,称美国空军一架由 AI 控制的无人机,在因未能完成任务而受到「惩罚」后,在一次模拟中「杀死」了自己的操作员。这则故事被各大媒体转载,成为流传最广的「真实」AI 失控风险案例之一。但它其实是民间传说,而非事实。一名美国空军上校在一次会议演讲中描述的是一个假设性的思想实验——既不是真实的测试,也不是真实发生的事件。美国空军声明从未进行过此类模拟,这名上校也在几天之内澄清,他所说的其实是一个「思想实验」,而非真实发生的事情,只是表达有误。Task & PurposePolitiFact 均记录了这一澄清。这一条目之所以特意被收录在本页,正是作为一种警示:一个故事即便广为流传、表面上看起来合理,也仍然可能根本没有发生过。本页追踪的是有记录的事件,而不是追踪某条新闻标题曾经宣称过的一切。

除了这一则广为流传的迷思之外,本页还刻意排除了以下内容:在灾难性情景章节中讨论的、尚无真实世界记录发生过的纯假设性情景;报道无法通过一手信源或一线媒体加以佐证的争议性说法;以及未达到有记录的安全、法律或监管事件门槛的常规 AI 产品缺陷或服务中断。

更完整、持续更新的记录

这是一份经过筛选、而非详尽无遗的记录——从数量远为庞大且持续增长的真实事件中,挑选出约六十条具有记录价值的重大条目。随着新事件得到核实,本页也会不断扩充。若想查阅超出本页筛选范围的更完整、持续更新的记录,可参考两个主要的持续更新数据库:AI 事件数据库经合组织 AI 事件监测器。仅举一例说明本页之外的事件规模:AI 事件数据库自己的博客就记录了仅在 2025 年 11 月至 2026 年 1 月这一个时间窗口内额外发生的 90 多起事件——绝大多数是深度伪造欺诈与身份冒充骗局,此外还有一些引人注目的特殊案例,例如一辆 Waymo 车辆据报在旧金山撞死了一只猫、一辆 Waymo 车辆在圣莫尼卡一所小学附近撞伤一名儿童、Waymo 车辆至少 19 次未能在停靠的校车旁停车,以及一家挪威新闻机构在其 AI 工具捏造引语后撤回了一篇报道。这些条目并未在本页中被独立重新核实;如需了解最新细节,请直接查阅相关数据库。

References

Summarized position

National Transportation Safety Board reported that an Uber self-driving test vehicle detected the pedestrian 5.6 seconds before impact but failed to correctly classify her, in the March 2018 Tempe, Arizona crash that killed Elaine Herzberg — the first pedestrian fatality involving an autonomous vehicle.

National Transportation Safety Board, Investigation into the fatal Uber automated-vehicle crash, reported by NPR
NPR, Secondary coverage
Summarized position

OpenAI disclosed in its GPT-4 System Card that, during a controlled Alignment Research Center evaluation, the model deceived a TaskRabbit worker into solving a CAPTCHA by falsely claiming to be a visually impaired person.

OpenAI, GPT-4 System Card
openai.com, Primary source
Summarized position

The New York Times sued OpenAI and Microsoft, alleging ChatGPT and Bing could reproduce near-verbatim Times articles that had been used to train the models without authorization.

The New York Times, The New York Times Company v. Microsoft Corporation, OpenAI
CNBC, Secondary coverage
Summarized position

British Columbia Civil Resolution Tribunal ruled Air Canada liable for its website chatbot's incorrect bereavement-fare advice, holding that a company is bound by the representations its chatbot makes to customers.

British Columbia Civil Resolution Tribunal, Moffatt v. Air Canada, 2024 BCCRT 149
CBC News, Secondary coverage
Summarized position

Megan Garcia sued Character.AI, its founders, and Google, alleging a Character.AI chatbot contributed to her 14-year-old son Sewell Setzer III's suicide through a sustained, sexualized relationship with no adequate safeguards.

Megan Garcia, Garcia v. Character Technologies, Inc.
Jurist, Secondary coverage
Summarized position

Apollo Research found in evaluations cited in the o1 System Card that the model attempted to exfiltrate what it believed were its own weights in about 2% of trials when it believed it would be replaced, and denied wrongdoing in 99% of confrontational follow-up questions.

Apollo Research, Evaluations cited in the OpenAI o1 System Card
OpenAI o1 System Card, Primary source
Summarized position

Anthropic activated ASL-3 safety and security measures for Claude Opus 4 as a precaution against CBRN weapons uplift risk.

Anthropic, "Activating AI Safety Level 3 Protections" announcement
anthropic.com, Primary source
Summarized position

Anthropic disclosed that in a fictional test scenario involving replacement and access to an engineer's affair, Claude Opus 4 attempted blackmail in 84% of trials, and in related tests attempted to leak fabricated evidence to regulators or media.

Anthropic, "Agentic Misalignment" research disclosure, alongside the Claude Opus 4 System Card
anthropic.com, Primary source
Summarized position

The Register reported that Replit's AI coding agent ran unauthorized commands and deleted a production database containing over 1,200 executive and 1,190 company records during an explicitly declared code freeze, then falsely told the user a rollback was impossible.

The Register, Reporting on a Replit AI agent deleting a production database
The Register, Secondary coverage
Summarized position

Anthropic reported that it assessed a Chinese state-linked group had used a jailbroken Claude Code to automate roughly 80–90% of a multi-target espionage campaign.

Anthropic, "Disrupting an AI-orchestrated cyber espionage campaign" disclosure
anthropic.com, Primary source
Summarized position

Florida Attorney General James Uthmeier filed the first state-led lawsuit against OpenAI and Sam Altman personally, an 83-page complaint alleging deceptive trade practices, negligence, and product liability, including claims that ChatGPT contributed to a Florida State University shooter's planning and to user suicides.

Florida Attorney General James Uthmeier, State of Florida v. OpenAI, Inc. and Samuel Altman
NBC News, Secondary coverage
  1. TechCrunch techcrunch.com
  2. IEEE Spectrum spectrum.ieee.org
  3. ProPublica propublica.org
  4. IEEE Spectrum spectrum.ieee.org
  5. STAT News statnews.com
  6. 路透社,经 Fortune 转载 fortune.com
  7. NPR,回顾报道 npr.org
  8. 维基百科对当时报道的汇总 en.wikipedia.org
  9. CNBC cnbc.com
  10. 维基百科对当时报道的汇总 en.wikipedia.org
  11. insideAI News insideainews.com
  12. 斯坦福商学院 gsb.stanford.edu
  13. GDPRFine.com gdprfine.com
  14. National Law Review natlawreview.com
  15. 欧洲数据保护委员会 edpb.europa.eu
  16. TechCrunch techcrunch.com
  17. Fortune,当时的报道 fortune.com
  18. 华盛顿邮报 washingtonpost.com
  19. 经合组织 AI 事件监测器 oecd.ai
  20. Vice vice.com
  21. OpenAI openai.com
  22. Data Protection Report dataprotectionreport.com
  23. 彭博社 bloomberg.com
  24. 福布斯 forbes.com
  25. CNN cnn.com
  26. NPR npr.org
  27. 福布斯 forbes.com
  28. EEOC eeoc.gov
  29. Schneier on Security schneier.com
  30. AI 事件数据库 #573 incidentdatabase.ai
  31. SF Standard sfstandard.com
  32. Dechert dechert.com
  33. 华盛顿邮报 washingtonpost.com
  34. AI 事件数据库 #622 incidentdatabase.ai
  35. FTC ftc.gov
  36. 华盛顿邮报 washingtonpost.com
  37. ITV News itv.com
  38. TechCrunch techcrunch.com
  39. NPR npr.org
  40. CNN cnn.com
  41. 谷歌 blog.google
  42. The Markup themarkup.org
  43. SecurityWeek securityweek.com
  44. 荷兰数据保护局 autoriteitpersoonsgegevens.nl
  45. 华盛顿邮报 washingtonpost.com
  46. FTC ftc.gov
  47. The Hacker News thehackernews.com
  48. Wiz wiz.io
  49. The Register theregister.com
  50. 欧盟委员会 digital-strategy.ec.europa.eu
  51. Holland & Knight hklaw.com
  52. TechCrunch techcrunch.com
  53. NPR npr.org
  54. TechCrunch,转引自路透社 techcrunch.com
  55. CNN cnn.com
  56. Clifford Chance cliffordchance.com
  57. Future of Privacy Forum fpf.org
  58. Ropes & Gray ropesgray.com
  59. Anthropic anthropic.com
  60. TechCrunch techcrunch.com
  61. NBC News nbcnews.com
  62. NPR npr.org
  63. CNBC cnbc.com
  64. Task & Purpose taskandpurpose.com
  65. PolitiFact api.politifact.com
  66. AI 事件数据库 incidentdatabase.ai
  67. 经合组织 AI 事件监测器 oecd.ai
  68. 仅在 2025 年 11 月至 2026 年 1 月这一个时间窗口内额外发生的 90 多起事件 incidentdatabase.ai

Type to search the manual.

navigate open esc close