Waymo CEO:纯视觉自动驾驶为何无法实现完全自主
Waymo CEO explains why Tesla's camera-only self-driving falls short

Waymo 联合 CEO Dmitri Dolgov 在 Y Combinator 的演讲中直截了当地指出,仅靠摄像头的“弱感知”方案存在安全天花板,无法达到超越人类水平的完全自动驾驶。虽然摄像头能实现辅助驾驶,但在黑暗、强光或恶劣天气下表现受限。Waymo 坚持融合摄像头、Lidar 和雷达,以应对摄像头失效的极端场景。Dolgov 用“九的指数阶梯”理论解释,从 99% 到更高可靠性的提升难度呈指数级增长,而纯视觉方案容易在早期快速提升后陷入瓶颈。相比之下,Tesla 坚持纯视觉路线,其 Robotaxi 服务目前仍处于低里程演示阶段,事故率数据也未达到 Waymo 的水平。随着硬件成本快速下降,Lidar 不再是昂贵的代名词,纯视觉方案的成本优势正在减弱。
如果目标是实现完全自动驾驶并达到远超人类的性能,你会发现弱感知会导致安全曲线过早趋于平缓。
HN 评论区
88- theshrike79
激光雷达(Lidar)能在单个数据点上直接给出 XYZ 坐标(z 代表距离),而摄像头只能提供 XY 坐标,你需要通过多个摄像头来计算 Z 轴距离。
激光雷达虽然又丑又贵,但计算距离所需的算力要少得多。而且它能穿透雾气和某些障碍物,也不受眩光影响,更不会像摄像头那样被阴影“吓到”。
如果车上的算力是无限的,摄像头显然是最佳方案……但现实并非如此。用摄像头你或许能实现“相当不错”的效果,但人们总能找到一些特定场景,让车 100% 确信桥下的阴影是一辆车,或者发生其他类似的愚蠢误判。
- tito
带传感器的车只要 6 万美元?听到 Waymo 可能即将把价格压到这么低,我简直乐坏了:
“我们听说 Waymo 即将把整套方案(车辆 + Waymo 传感器套件 + 驾驶员)的成本控制在 6 万美元左右”。
- marlow_congdon
这是我的个人体验,我的 Tesla Model 3 能完成绝大多数从起点到终点的行程。如果必须我介入,通常是因为其他司机不让它变道,我不得不表现得激进一些。我在达拉斯和奥斯汀的朋友(那里的街道比我住的地方更简单、更友好)说他们现在几乎完全不用自己开车了。也许它现在还不足以支撑机器人出租车服务,但自 2022 年我开上第一辆 Tesla 以来,进步速度简直疯狂,尤其是过去一年。
相反,我在奥斯汀和旧金山多次尝试过 Waymo,虽然整体体验不错(比 Uber 好多了),但它似乎犯了一些我的 Tesla 不会犯的错误。在奥斯汀,它们很难停到正确的上车点,还走了一些非常奇怪的偏僻小路(据说是因为某些路口搞不定);在旧金山,一次远程驾驶员不得不接管驾驶,因为我的 Waymo(连同后面的一辆)被一辆双排停车的车堵住了。
有真正的 Tesla 车主想在这里发表看法吗?
- devy
我读 Electrek 快十年了。看到它的编辑 Fred Lambert 从在电动车(EV)对抗燃油车(ICE)时超级亲 Tesla/马斯克,转变为马斯克涉足政治后的反 Tesla/马斯克,这很有意思。
当然,马斯克早就知道多模态才是赢得真正 L4 级自动驾驶的关键。当初在 Tesla 深陷生产地狱、面临生存危机时,选择先攻克视觉方案是一个经过计算的权衡,因为那时的激光雷达(组件成本高达数万美元且连续运行不可靠)和雷达(组件成本数千美元)都太贵了。
如今,数百万辆 Tesla 上路,数十万个超级充电站建成,激光雷达变得既可靠又实惠(就像 Tesla 让锂电池变得实惠一样)。
未来 Tesla 会不会把激光雷达和雷达重新整合进感知栈?我认为是的!毕竟,就在几年前,Tesla 还抛弃了基于 MobileEye 原厂方案的 30 多万行 C++ 初始 AI 软件栈,转而采用自研的基于深度学习的神经网络模型。现在,他们可能仍然认为纯摄像头/视觉辅助驾驶技术还有空间。
Waymo 改装的捷豹车型全配三种模态,单车成本高达 15 万至 20 万美元。而 Tesla Cybercab 的生产成本低于 3 万美元。它们处于完全不同的细分市场。拿它们做比较就像拿丰田卡罗拉和法拉利比发动机输出一样荒谬!
所以,这篇文章感觉又是 Lambert 在 Electrek 上对马斯克进行情绪化偏见的攻击,这种事现在天天都在发生。
- bryanlarsen
> 比人类驾驶员少 94% 的严重事故
这是一个惊人的数字。你自己做一个好司机可以避免 50% 的多车事故,但另外 50% 是由其他司机造成的。要想超过 50% 的安全率,你就必须防御性驾驶,并出色地模拟其他司机的行为。