爷爷被AI克隆声音骗走赎金后,她创办了DetectifAI让手机本地识别假声音
一通电话,让Tarini Padmanabhuni的祖父以为自己的兄弟被绑架了。电话那头的声音逼真到让他毫不犹豫地支付了赎金——直到后来才发现,兄弟根本不在任何危险之中,那声音完全是用AI合成的。
这件事发生在约两年前。Padmanabhuni说,最让她难以释怀的并非金钱损失,而是祖父完全没有任何办法分辨真假。
如今,她创办的旧金山公司DetectifAI正试图解决这个问题。该公司正在开发一种足够小、能直接运行在智能手机上的AI模型,实时标记出伪造声音。DetectifAI已入围TechCrunch Disrupt的Startup Battlefield竞赛。
一个快速膨胀的诈骗市场
AI驱动的诈骗正在急剧增加。根据FBI的数据,去年美国人因AI相关诈骗损失了近9亿美元,较2024年增长了24%。其中,60岁及以上人群的损失是50至59岁人群的两倍。
深度伪造语音检测领域并不缺竞争者,已有Reality Defender、Pindrop、Resemble AI、微软Azure AI Content Safety以及微软旗下的Nuance等公司。但Padmanabhuni指出,当前的检测产品大多运行在远程云服务器上,手机制造商无法将其直接内置到设备中,这意味着被诈骗目标在通话时几乎得不到任何保护。
从零设计小型模型,而非压缩云端模型
DetectifAI的技术路线与一些公司不同:它并非将大型云端模型缩小后塞进手机,而是从底层开始设计紧凑的AI模型,使其小到足以在智能手机操作系统内运行。目标是在通话、语音消息和其他音频中即时判断声音是否为AI生成,且音频数据全程不离开设备。
DetectifAI首先面向手机制造商销售,授权其软件工具,让检测功能作为手机操作系统的内置特性出厂。Padmanabhuni用了一个类比:就像AT&T在初代iPhone发布时的角色一样,运营商通过独家协议脱颖而出——第一个搭载DetectifAI的手机厂商将获得竞争优势。
产品的核心是DetectifAI的软件开发工具包(SDK),这是一套可供其他公司嵌入自身产品的代码包,可通过现有渠道授权。Padmanabhuni表示,第二条收入来源将来自向企业和反欺诈公司授权该技术。她透露,这家初创公司已有早期收入。
从祖父被骗到创办公司,Padmanabhuni的路径折射出AI时代的一个尖锐现实:当伪造声音的成本趋近于零,防御必须变得无处不在——最好就藏在每个人的手机里。