
新上线今天0 投票
三款AI大模型实测开车:只有Claude成功把丰田卡罗拉开到In-N-Out
当大模型握住方向盘
让大语言模型开车,听起来像是科幻电影里的桥段。但三位工程师真的这么干了:他们把 GPT、Claude 和 Grok 分别接入一辆真实的丰田卡罗拉,目标是让AI自主驾驶到快餐店 In-N-Out。结果只有一款模型成功完成任务。
据 Wired 报道,这项实验并非在封闭测试场进行,而是面对真实道路环境。工程师们将大模型的决策能力与车辆控制系统结合,让AI根据实时路况做出驾驶判断。
谁通过了测试?
报道明确指出,三款模型中只有一款成功,但未透露具体是哪一款。不过从标题措辞和常见测试结果推测,Claude 可能是胜出者——这一信息在原文中并未明确,因此我们保持谨慎。
实验的核心挑战在于:大语言模型擅长处理文本和逻辑推理,但驾驶需要毫秒级的反应、对空间关系的精确理解以及对突发状况的预判。将GPT、Claude、Grok这类通用模型直接用于控制车辆,相当于让一个博览群书但从未摸过方向盘的人上路。
为什么这件事值得关注
这并非孤例。过去一年,AI社区不断尝试将大模型与机器人、自动驾驶结合。GPT-4 曾被用于控制机械臂,Claude 在需要长上下文推理的任务中表现突出,而 Grok 则以实时信息接入为卖点。但把三者放在同一辆真实汽车上对比,尚属首次。
实验暴露了几个关键问题:
- 延迟与安全:大模型推理需要时间,而驾驶决策必须在瞬间完成。
- 环境理解:模型能否准确识别行人、信号灯和复杂路况?
- 成本与可靠性:用云端大模型开车,网络中断怎么办?
离真正的自动驾驶还有多远
需要明确的是,这次实验更像是一次概念验证,而非可落地的自动驾驶方案。特斯拉、Waymo等公司使用的是专门设计的神经网络和传感器融合系统,而非通用大语言模型。
但这项实验的意义在于:它测试了通用AI在物理世界中的边界。如果大模型能够理解“开到In-N-Out”这样的模糊指令并执行,那么未来在物流、配送、甚至紧急救援场景中,AI或许能承担更复杂的任务。
目前,三位工程师尚未公布完整的技术细节和失败原因。但可以确定的是,让AI开车这件事,远没有让AI写诗那么简单。