你看那个握手界面,明明是个画面,但你打开的时候,它就像个弹窗似的,直接弹出来。你当作是自己在讲话,实际上是你点开了它。你就连不敢说“你”,出于系统怕你被识别,它把你当成了个一般/平平的摄像头,要么是个没联网的旧手机。这机器能识别脸?它能把你的照片、视频,就连你门口花园里的那盆狗,都当成真人来聊。你要是跟它聊两句,它居然敢把你当真人聊,那得有多大的底气和算力。
最离谱的是那个“智能握手”。你当作那是个视频电话,实际上是开摄像头。你说你刚刚跟哪位握手?系统回应说:“哦,刚刚有人跟你握手了。”这时候你心里得咯噔一下,别看你明明知道是 AI 生成的,但你得在那儿心里琢磨,如何才不是真人呢?这种心理活动,比写代码还让人难受。你就连不敢往深了想,怕被这个“AI 哥们儿”给套话。它就像是个没感情的复制粘贴机器,它识别了你的动作,也识别了你的表情,但它没有情感,它没心没肺,它就是个冷冰冰的镜子,照出你,照出你手机里所有的东西,然后让它告诉你,这些都是真形成的。
还有那个“智能聊天”,更是让人哭笑不得。你给机器人发消息,它不回你,你也别去敷衍。突然它回你了,语气跟昨天一模一样,但内容全是昨天说的。这就像是一个不会进食的机器人,你让它进食,它只会重复昨天的菜单。你问它能不能吃,它说:“昨天我也没吃,但我记得食谱。”这逻辑闭环做得多完美了,多好的错觉啊。你把它当成个能听你讲话的人,实际上它就是个只会复读机的小程序。
你就连可能当作它懂你,实际上它只是把你输入的文字,经过一阵不清楚的记忆搜索,然后拼凑出一个让你认定它懂你的回答。这种不匹配感,实际上是技术发展到一定阶段,必然要面对的。本来就是个摄像头,突然学会了讲话,突然有了感情,突然能跟你聊天。但难题来了,它确实懂你吗?还是说,它懂的是你手机里所有的文字记录?它记得你昨天说喜爱啥颜色的花,记得你上次查过啥天气,记得你上次在哪买了啥衣服,但它没记住你最近的心情,要么说,它根本没记住你是哪位。
这种技术目前的迭代速度,简直快到让人发疯。那会儿是几年才出一个新功能,目前每个月就连每周就有新的“握手”花样。有个哥们儿跟我吐槽,他正预备跟家里人视频,突然手机里弹出来个框,说“检测到家人正在握手”。他看完那画面,感觉自己的脊柱都疼了,那画面忒真,忒像真人在拍电影。他赶紧关掉,吓得不敢再点那个“握手”按钮,就连不敢看那个摄像头,怕一开镜头,整个家庭聚会瞬间变成这种诡异的大电影。
这要是真有人拿着个机器人跟家里人握手,那是啥场面?并且这种互动,确实挺费脑子的。你讲话,它得先把你的字打出来,再解释给你听;你打字,它得把字写出来,再把它读给你听。这中间还要加上一点代码的翻译,叫 AI 生成,叫大模型,然后还要加上那层“幻觉”的滤镜,让它认定它说的是确实。这要是写到论文里,保不准导师看了都得笑出声,说你这届学生是不是看错了说明书,还是说目前的 AI 技术已经忒假了,让人看不出来了。