如果说过去三年的人工智能(AI)浪潮,是一场“谁的模型更聪明”的军备竞赛,那么Meta最新推出的Muse,或许代表了下一阶段的转折点:AI不再只是回答问题,而是开始替人执行任务。

今年9月,Meta正式发布个人人工智能体(AI Agent)——Muse。和我们已经熟悉的ChatGPT式聊天机器人相比,Muse的定位更接近一名“数码管家”。根据Meta公布的资料,Muse能够浏览网页、填写表格、连接获得授权的应用程序,也可以处理多步骤任务,例如协助购物、预订行程、处理客服,以及发送电邮等。

这看似只是AI功能进一步升级,但背后的变化其实相当大。

过去二十多年,我们使用互联网的方式,基本上都是“人操作软件”。我们打开Google寻找资料,再进入不同网站;打开电商平台,自己比较产品;打开航空公司、电讯公司或银行App,再一步一步完成任务。

但智能体(Agent)时代的逻辑可能完全不同。

未来我们未必需要面对几十个App,而是直接告诉AI:“我要完成什么。”至于过程中需要打开哪个网页、使用哪个服务、填写哪些资料,则由AI负责处理。

例如,一个消费者发现信用卡每个月仍然被某项早已忘记的订阅扣款。传统方式是先找出是哪家公司,再登录账户,寻找订阅管理页面,最后完成取消。美国媒体报道,Muse已经可以协助用户处理类似的订阅管理任务。

这正是人工智能体和传统聊天机器人的最大分别。

过去我们问AI:“我要怎样取消这个订阅?”

未来,我们可能直接告诉AI:“帮我处理掉。”

从“告诉我怎么做”,变成“替我去做”,这看起来只有几个字的差别,实际上却可能重新定义我们与互联网的关系。

Meta显然不只希望Muse留在电脑或手机屏幕里。

现实世界入口

在今年的Meta Connect大会上,Meta首席执行员朱克伯格(Mark Zuckerberg)也宣布Muse将进一步进入Meta旗下的AI智能眼镜。智能眼镜之所以值得关注,是因为它让AI开始拥有对现实世界的视觉和声音入口。

过去消费者面对智能眼镜,经常会问一个很现实的问题:我为什么需要戴它?

如果智能眼镜只是把手机通知搬到眼前,使用价值确实有限。但当眼镜能够理解用户正在看到和听到的环境,再结合人工智能体执行能力,情况就不一样了。

未来,当用户看到一个商品、一家餐厅、一张活动海报,理论上可以直接向AI询问相关资料,再进一步要求它采取行动。这里需要强调的是,这代表Muse与智能眼镜结合后可能的发展方向,而不是说所有类似情境今天都已经成为成熟功能。

Meta同时还展示了一款被媒体形容为类似“Tamagotchi电子宠物”的小型Muse装置。根据科技媒体报道,这款名为Muse Charm的设备仍处于开发阶段,Meta当时表示计划在之后正式推出。

为什么Meta如此积极布局?

因为AI竞争最终可能不只是模型能力的竞争,而是谁能够成为用户每天接触数字世界的主要入口。

谷歌(Google)过去拥有搜索入口,苹果(Apple) 掌握智能手机入口,微软(Microsoft)长期掌握个人电脑和Office生产力入口,而Meta本身则拥有WhatsApp、Instagram、脸书(Facebook)以及Messenger等庞大用户平台。

如果未来用户习惯先告诉AI自己要做什么,而不是直接打开某个App,那么人工智能体就有机会成为互联网的新入口。

这也可能催生所谓的“智能体经济”(Agent Economy) 。

过去电商网站是为人设计的。网站首页应该怎样摆放、广告应该怎样出现、怎样让消费者多浏览几个产品,这些设计都是建立在“人会亲自进入网站”的假设之上。
但如果未来越来越多购物行为,是由人工智能体代替消费者搜索、比较,再把几个结果直接呈现给用户,那么很多商业模式都会被重新思考。

现在已经出现一些迹象。

Shopify已经开始支持Muse相关的AI购物体验,让符合条件的商家能够通过智能体接触消费者。相反,亚玛逊(Amazon)则曾经阻止Muse直接在其平台上代表用户进行购物操作,并提出包括隐私、安全、透明度以及第三方智能体身份识别等问题。

这其实预告了未来互联网一个非常重要的争论:如果AI开始代表“人”上网,那么网站有没有权阻止它?平台应该如何知道,正在操作网站的是本人,还是一个获得授权的AI?

而更大的问题,其实是信任。

现实使用考验

一个只能回答问题的Chatbot,即使答错了,最多是我们不采用答案。

可是,一个能够替你购买商品、发送电邮、处理订阅,甚至代表你与其他网站互动的智能体,一旦判断错误,影响就完全不同。

因此,人工智能体真正的竞争力,未必只是“聪明”,而是“可不可信”。

Meta表示,Muse在执行购买、发送电邮等较敏感操作前,会要求用户确认;用户也可以决定连接哪些服务,并查看AI执行过的操作记录。Meta也强调,一些敏感资料会通过独立的安全机制处理。

不过,这些都是科技公司对系统设计的说明,真正的考验仍然来自现实使用。

Muse推出后,美国科技媒体已经报道过一些隐私与权限相关的争议。例如,有用户质疑Muse为什么能够引用来自Messages的信息;Meta回应称相关系统权限此前已经获得开启,同时也承认Muse对资料来源的解释并不准确。

这件事情很值得注意。

未来我们面对的,可能已经不只是“这个AI知不知道很多东西”,而是“它究竟知道我多少事情”。

而这也是智能体时代最需要社会认真讨论的问题。

交给AI代劳

我一直认为,判断一项科技是否真正成熟,不应该只看它能够做出多少令人惊叹的Demo,而应该看它每天能够帮普通人省下多少时间。

AI生成一张漂亮图片,很惊艳。AI写一篇文章,也很方便。但如果AI每天能够替一个人省下30分钟,用来整理电邮、处理订阅、比较商品、安排日程、追踪订单,甚至完成各种琐碎的线上行政工作,一年下来就是超过180个小时。

这可能才是人工智能体真正有颠覆性的地方。

过去几年,我们讨论AI时,经常问:“AI会不会取代我的工作?”

Muse这样的产品出现之后,另一个问题可能会越来越重要:未来我们会不会首先让AI取代我们生活中那些最麻烦、最重复,却又不得不做的事情?

当AI从一个“聊天对像”,慢慢变成拥有视觉、记忆、工具以及行动能力的数字助理,智能手机之后的下一个计算平台,也未必只是一部更强大的手机。

它可能是一副眼镜,也可能是一个随身装置。

但真正重要的,并不是硬件长什么样子。而是有一天,我们可能不再亲自操作互联网。

我们只需要告诉AI:“这是我要的结果,你替我完成。”

到了那个时候,我们面对的问题也会从“AI到底有多聪明”,变成一个更加现实的问题:我们的生活里,到底有多少决定和行动,愿意交给AI代劳?

本文观点,不代表《东方日报》立场。

陈奕强

本地上市科技公司Agmo的首席执行员兼创办人,国家数码经济和工业革命4.0的委员会成员,也是一些新创科技公司的顾问和大学的工业咨询顾问团成员。

热门新闻

阅读全文

【新加坡大选】行动党蝉联执政 工人党政治版图扩大

阅读全文

烧烤摊违反行管令 老板顾客全被对付

阅读全文
档案照

哈萨克爆发不明肺炎 致死率远高于新冠病毒

阅读全文

CNN记者讲述北京防疫 女主播惊讶摇头