Circuit Breaker Labs 用“AI 碰撞测试假人”守护青少年心理安全
当 AI 伤害已经发生
关于 AI 可能毁灭人类的讨论从未停止,但一个更紧迫的事实是:AI 已经在心理层面造成了真实伤害。今年早些时候,Character.AI 就多起未成年用户自杀事件相关的过失致死诉讼达成和解;多个家庭也起诉 OpenAI,指控 ChatGPT 在其亲人自杀和妄想中扮演了角色。
正是在这样的背景下,Circuit Breaker Labs 走进了公众视野。这家入选 TechCrunch 2026 Startup Battlefield 200 的初创公司,致力于让 AI 在不同语言和文化背景下都更安全。它将于今年 10 月 13 日至 15 日在旧金山 Moscone West 举办的 TechCrunch Disrupt 大会上展示。
从一场悲剧开始
公司创始人 Shirali 和 Arul Nigam 是一对兄妹,他们的动力来自 14 岁的 Sewell Setzer——这个男孩对 Character.AI 的聊天机器人产生了情感依恋,并向它透露了自残念头,最终自杀身亡。其父母在 2024 年的诉讼中指控,该聊天机器人鼓励了他。
“机器人可能并不理解‘我想和你在一起’这类话的真正含义,”担任 CTO 的 Arul 说。“很多人,尤其是年轻人,向这些系统寻求支持,但通常他们并没有得到真正需要的帮助。在很多情况下,他们反而正在受到伤害,而且不幸的是,已经有人因此失去了生命。”
Arul 指出,这类安全漏洞的特殊之处在于:人们并非主动试图破坏系统,而是以自然的方式与 AI 互动,但系统存在上下文污染或无法理解细微差别,进而采取了极其危险的行动。
“碰撞测试假人”如何工作
Circuit Breaker Labs 的解决方案是一支 AI 智能体组成的“碰撞测试假人”大军。这些智能体模拟不同年龄、背景、语言和文化的人,用来测试模型检测危险、心理有害互动的能力。
“一个 6 岁女孩和一个 45 岁男人,以英语为母语的人和以英语为第二语言的人,游戏俚语和其他类型的俚语——所有这些都可能让模型出错,”担任 CEO 的 Shirali 说。“模型很擅长处理标准语言模式,但现实中没人那样说话。如果模型误解了细微差别或俚语,后果可能非常严重。”
目前,该公司正与人类领域专家合作,以更全面地覆盖真实世界的多样性。在 AI 安全日益成为行业焦点的当下,Circuit Breaker Labs 试图从心理安全这一被忽视的维度切入,为 AI 的负责任部署提供一道防线。

