当自动驾驶技术逐渐从实验室驶入街头,人们开始思考一个问题:在车内解放双手的这段时间里,乘客究竟需要什么?谷歌母公司Alphabet旗下Waymo给出的答案,是一辆名为Ojai的自动驾驶网约车,以及一个名为Gemini in Waymo的AI工具。这款AI工具不仅让乘客能通过语音调节空调、查询沿途信息,还通过三块屏幕的协同设计,把车舱从一个单纯的运输载体变成了由乘客自主定义的空间。本文将从产品设计、技术架构、用户体验和行业影响四个维度,深度剖析Ojai如何用AI工具重新定义“坐车”这件事。
从零设计:Ojai的诞生与行业困境
Waymo在自动驾驶领域深耕多年,但Ojai是其首次从零开始设计的网约车专用车型。此前的自动驾驶测试车大多基于量产车型改装,车舱布局、座椅朝向、屏幕位置都受限于原车架构。而Ojai的设计逻辑完全不同——它把“乘客体验”作为第一优先级,甚至为了腾出灵活空间而取消了传统驾驶座。这种设计思路的背后,是Waymo对网约车场景的深刻洞察:乘客在自动驾驶车内,不再需要关注路况,而是希望获得一个类似“移动客厅”的体验。
然而,行业内其他玩家并非没有尝试。特斯拉的“全自动驾驶”模式虽然提供了娱乐屏,但交互仍以手动为主;Cruise的Origin车型同样强调空间,但缺乏一个像Gemini这样的AI工具来主动理解乘客意图。Ojai的差异化在于,它把语音交互和屏幕显示结合,让乘客可以用自然语言完成操作,而不是在菜单中层层查找。例如,说一句“我想看日落”,系统会自动调暗灯光并调整车窗色调——这种体验的流畅度,依赖于背后强大的AI工具对语义的理解。
值得注意的是,Ojai的诞生正值AI技术从“感知”向“认知”跃迁的关键节点。过去几年,AI技术在自然语言处理上取得了突破性进展,而Waymo将其与科技产品的硬件设计深度融合,打造出首个真正意义上的“对话式乘车空间”。这不仅是技术的堆叠,更是一种产品哲学的转变:乘客不再需要学习如何操作机器,而是机器学会理解人的需求。
Gemini AI:车内对话式助手的进化与边界
Gemini in Waymo是Ojai最核心的AI工具,但它并非一个简单的“车载版Siri”。Waymo的工程师在博文中强调,Gemini是独立于Waymo Driver驾驶系统的存在——它不控制车辆移动、不读取实时驾驶数据,也无法更改路线。这种架构设计从一开始就划清了“娱乐交互”与“安全控制”的界限,避免了类似特斯拉车主误用“自动驾驶”功能的风险。
在实际体验中,乘客可以通过语音或屏幕上的Gemini图标唤出助手,完成三类操作:第一,调节车内环境,如空调温度、座椅加热、氛围灯颜色;第二,查询行程信息,包括剩余时间、途经地标、未来天气;第三,获取日常知识,例如附近咖啡店的评分、某栋建筑的历史。Waymo还特别提到,乘客可以提出“靠边停车”的请求,但Gemini会将这个指令传递给Waymo Driver,由驾驶系统评估是否安全执行——这再次体现了AI工具与驾驶系统的严格隔离。
这种设计引发了一个有趣的问题:为什么不让Gemini直接参与驾驶决策?答案在于安全与责任的边界。如果乘客通过语音要求“加速超车”,系统必须判定这是否合理。Waymo选择让Gemini保持“信息中介”角色,只负责传递需求,不参与决策,从而将安全责任完全交给经过数百万英里测试的Waymo Driver。这种保守主义策略,恰恰是{{LINK:AI技术}在关键场景落地的正确姿态:先做好辅助,再考虑替代。
三屏协同:重新定义乘客空间的信息架构
Ojai的车内配备了3块屏幕,但它们的排列方式并非简单复制。系统会根据座位上的乘客数量动态调整内容:如果右后座只有一位乘客,该座位前方的屏幕会显示完整的控制面板,包括音乐、导航、空调和Gemini对话界面;而另外两块屏幕则自动切换为“行程状态显示”或“环境媒体播放器”——比如播放一段舒缓的风景视频,或者显示当前车速和剩余里程的简化信息。
这种设计背后是对“信息过载”的理性抵抗。传统汽车的中控屏往往试图把所有功能塞进一个界面,导致驾驶时操作分心。而在Ojai中,三屏协同让每个乘客只关注自己需要的信息。例如,左后座的乘客可能只想看窗外的风景,那么面前的屏幕就可以调暗,仅显示一个小小的“到达时间”浮动窗口。这种个性化体验,需要科技产品在硬件与软件之间做到精密配合,而Waymo用了数年时间来打磨这个交互逻辑。
值得一提的是,Waymo还提供了一个名为“Calm Mode”的选项。开启后,所有屏幕会大幅降低亮度,只保留最基础的行程信息,配合车内降噪和香氛系统,营造出类似冥想空间的氛围。对于通勤疲惫的乘客来说,这可能是最实用的功能之一。而实现这种体验,离不开AI工具对乘客状态的理解——Gemini可以检测到乘客是否在闭眼休息,并自动建议开启Calm Mode。这种主动式交互,比用户手动设置更贴合“智能”的定义。
安全与隐私:AI工具不触碰的“红线”
在Ojai的发布会上,Waymo反复强调一个关键点:Gemini AI不访问实时驾驶数据。这意味着,即便乘客在车内大声交谈,助手也无法获取车辆的速度、位置、传感器数据等敏感信息。这种设计既是为了避免数据泄露,也是为了防止AI误读驾驶情况而发出错误指令。例如,如果车辆正在高速行驶,乘客却要求“靠边停车”,Gemini只会将请求传给Waymo Driver,由后者根据当前车速、车流和道路条件决定何时执行。
这种安全边界的设定,与当前AI Agent技术的成熟度密切相关。AI Agent技术虽然能执行复杂任务,但在涉及人身安全的场景中,必须设置“人类监督”或“独立系统审核”的机制。Waymo的做法是让Gemini成为一个“高权限的秘书”,而不是“驾驶员”。乘客可以命令它播放音乐,但不能命令它闯红灯。这种泾渭分明的权限划分,值得其他自动驾驶公司借鉴。
此外,隐私问题也是Ojai设计中的重点。车内麦克风仅在乘客主动唤醒Gemini时开启,且录音数据不会上传用于训练模型,而是采用本地处理的方式。虽然目前尚不清楚具体的技术细节,但Waymo明确表示,乘客的对话内容不会被用于广告或第三方分析。在数据安全日益敏感的今天,这种透明化承诺有助于建立用户信任。
用户体验的巧思:从“操作”到“对话”的转变
Ojai的交互界面经历了Waymo“数年来首次重大更新”。新界面不再像传统车机那样堆砌按钮,而是以“行程卡”为核心,把音乐控制、空调设置、Gemini对话等模块整合成卡片式布局。乘客可以点击屏幕上的Gemini图标,然后直接说出“帮我把空调调到20度,音量调低,顺便推荐一首适合下雨天听的歌”——系统会依次执行,并在屏幕上显示动作反馈。
这种“多指令链”的识别能力,是Gemini相比普通语音助手的一大优势。传统车载语音往往只能理解单句指令,比如“调高音量”或“导航到某地”,而Gemini可以解析复合请求。例如,乘客说“我想去机场,但中途想买杯咖啡”,系统会先规划路线,然后搜索沿途的咖啡店,并提供时间预估。这种体验的流畅度,依赖于大语言模型对上下文的理解能力。
更值得一提的是,Ojai还支持一种“无声交互”模式:乘客可以通过屏幕上的手势或滑动来完成操作,而不必发出声音。例如,在会议中接听电话时,可以用手指在屏幕边缘向左滑动,开启“静音模式”。这种对人性化细节的考量,使得Ojai不仅是一个AI工具,更是一个懂人的“空间伴侣”。
未来展望:AI工具如何重塑出行生态
Ojai的推出,标志着自动驾驶网约车从“技术验证”进入“体验设计”阶段。未来的竞争将不再局限于掌握多少公里的测试数据,而是谁能设计出更自然、更安全的AI工具来填补乘客的“空白时间”。Waymo的Gemini AI给出了一个方向:让AI工具成为乘客的“数字管家”,而不是“电子宠物”。
从更宏观的视角看,AI工具的普及将推动整个出行生态的变革。例如,当乘客能在车内完成工作、娱乐、社交,甚至用AI画图生成旅行纪念品时,网约车就不再是“位移服务”,而是一个“移动空间订阅”。这种变化将倒逼汽车制造商、内容提供商、广告商重新思考自己的角色。也许不久的将来,你会在Ojai的屏幕上看到AI诗词生成的旅途诗句,或者用AI网名功能为下次出行起个有趣的昵称。
当然,挑战依然存在。Gemini AI目前仅支持英语,且对复杂口音的识别率尚未公布。此外,三屏协同的硬件成本较高,可能影响Ojai的规模化量产。但无论如何,Waymo已经向业界展示了如何用AI工具把“自动驾驶”从技术叙事转化为用户叙事。这或许就是科技产品最迷人的地方:它让我们相信,未来的出行不仅更安全,也更温暖。