Meta 那个能帮人砍价和填表的 Muse 助手到底能不能把 AI
如果一个 AI 助手只能在对话框里出主意,那它顶多算个聊天机器人;但如果它能直接接管浏览器、帮我填申请表,甚至在购物时帮我跟卖家砍价,这才是我想象中的 Agent。Meta 刚推的 Muse 看起来就在往这个方向走,它不再是单纯的问答,而是试图通过模拟人的操作来完成闭环任务。
要把这个功能跑通,Meta 内部肯定做了大量的动作。首先是 Llama 系列模型的工具调用(Tool Use)能力必须极强,否则在面对不同网页的 DOM 结构时很容易崩溃。其次,Muse 必须能处理长链路的规划,如果第一步搜索错了,后面的填表全部失效。
从目前披露的信息来看,Muse 这种“个人 AI 代理”的逻辑是目标驱动。你给它一个指令,比如“帮我策划一次去京都的旅行并订好酒店”,它不再是给你列一张清单让你自己去订,而是直接打开浏览器,搜索酒店,对比价格,最后把订单填好。这种从 Llama 这种底层模型到具体执行端的跨越,其实是 Meta 在试图挽回在 OpenAI 和 Google 面前失去的先机。
最让我觉得有意思的细节是 Muse 的“自主执行权”。在实际场景中,它能够处理这种流程:
- 浏览器接管: 自动跳转页面,识别网页元素。
- 表单填充: 把用户的个人信息自动填入各种复杂的预订界面。
- 代表谈判: 这点比较激进,Meta 声称它能代表用户进行沟通(比如砍价),这意味着它得具备一定的策略分析和实时对话能力,而不是死板的模板回复。
要把这个功能跑通,Meta 内部肯定做了大量的动作。首先是 Llama 系列模型的工具调用(Tool Use)能力必须极强,否则在面对不同网页的 DOM 结构时很容易崩溃。其次,Muse 必须能处理长链路的规划,如果第一步搜索错了,后面的填表全部失效。
我在想,如果 Muse 真的能大规模铺开,最核心的挑战其实不在于 AI 聪明不聪明,而在于“信任”和“授权”。给一个 AI 权限去操作浏览器、填写个人信息甚至花钱,这中间的安全链路怎么打通?如果它在砍价时把价格谈高了,或者在填表时填错了日期,责任算谁的?
不过,比起那些只会在对话框里写代码的助手,这种能直接操作软件的 Agent 显然更有实用价值。Meta 这次投入数十亿美元做战略调整,显然是不想只做一个模型供应商,而是想通过 Muse 把 AI 强行塞进每个人的日常琐事里。如果它能把 Llama 的开源生态和这种端到端的执行能力结合起来,那么它的竞争力就不再是某个 Benchmark 的分数,而是用户每天省下了多少时间。
我对 Muse 的预期是:它能不能处理那些没有 API 的老旧网页?如果它能通过视觉识别(VLM)直接操作任何网页,而不是依赖于特定的插件或接口,那这才是真正的突破。
事件追踪 · 相关报道
Meta内部那个「合规领域AI专家」到底是怎么搭出来的
5天前
纽约州长强推 AI 监管新政,数据中心暂停令背后的技术博弈
8天前
Instagram 怎么看待那些伪装成真人的 AI 账号?这次清理行动释放了什么信号
8天前
这事儿要是发生在普通用户身上估计得崩溃
8天前
Meta 的 Project OT 计划:AI Agent 正在接管大厂的业务中台
9天前
扎克伯格这波砸 100 亿美金投 Anthropic 到底在下一盘什么样的棋
12天前
免费 AI 工具箱 · 全部完全免费
