六、当AI开始‘说谎’:幻觉问题与责任归属的终极拷问
最后,必须直面AI代打电话背后的一只‘房间里的大象’——幻觉问题。大语言模型天生就有‘一本正经胡说八道’的倾向。Gemini 极有可能会为了完成‘预约’这个任务,而脱口而出编造一个不存在的预约号码,或者为了安抚对方情绪而虚构一个‘我会在X点准时到达’的承诺。
这种‘语文上的瑕疵’,在纯粹的聊天机器人领域或许只是令人一笑而过的段子,但如果发生在严肃的商业洽谈中,就变成了法律纠纷的导火索。比如,Gemini代替用户向银行客服确认了利率,但万一这个利率是因为模型幻觉而自行推断出的错误数字呢?后果由谁来承担?是提供AI基础设施的谷歌,是误用信息的用户,还是被AI虚假承诺误导的商户?
目前的AI技术发展,不可避免地呈现出一种 ‘狂飙突进’的态势。为了缓解幻觉,谷歌采取的方法是在Agent运行时引入RAG检索增强生成,让AI在回答具体条款时先检索网页原文而不是凭空捏造。但这依然解决不了对话中的开放性磨砺。
这也引发了我们对另一个问题的思考,在AI接管那些常规、乏味但涉及真实世界权益的沟通时,我们是否应该相应地调整法律法规的框架?这就如同早年间的汽车自动驾驶等级认证一样,AI代打电话也需要一套严格的测试标准与责任追溯机制。唯有如此,智能助手才能真正从实验室走向大众,而不仅仅是极客手中的玩具。这不仅是科技新闻栏目的深刻洞察,更是全人类的共同课题。我们必须先给技术套上良知的笼头,才能让AI成为那个不用等电话的明日之选。