上一篇 Meta Muse 介绍与注册指南:一个会替你跑腿的个人 AI Agent 把 [[Muse]] 是什么、怎么注册、额度怎么算都整理了一遍,但是留了一个结尾:注册完之后到底该让它干什么。Muse 上线这几周,我查阅了一些测评体验,整理了 X 和 Threads 上用户晒出来的用法,发现大家的使用路径其实很像:从提醒和文件这类零风险的任务开始,确认它靠谱之后再慢慢接入邮箱、日历,最后才让它碰钱。这篇就按这个顺序来整理,从界面和设置讲起,再到具体的案例和踩过的坑。

Meta Muse 使用案例概念配图

先认识一下界面

Muse 的 App 结构不复杂,但几个入口藏得比较深,第一次用很容易找不到自己要的东西。和它对话、布置任务都在 Chat 标签页,它的交互方式就像发消息,你可以连着发好几条,不用等它回复。不知道能让它做什么的时候,可以去 Ideas 标签页看看官方推荐的任务,或者直接问它「你能帮我做什么」。它生成的文件,比如 PDF、表格、仪表盘,都会放到 Library 标签页里。

想做的事 入口
对话、布置任务 Chat 标签页
找任务灵感 Ideas 标签页
查看它生成的文件 Library 标签页
提醒和定时任务 助手图标 → Upcoming
查看它做过什么 助手图标 → Activity log
连接或断开应用 Settings → Connectors
设置什么时候需要先问你 Settings → Permissions
导入记忆、关闭训练 Settings → Data controls

另外一个很实用的功能是侧边对话(side chat),在 Chat 标签页左上角的菜单里点铅笔图标就能新开一个。它适合把不同主题分开,比如一个专门聊旅行计划,一个专门处理账单。Muse 的记忆是跨对话共享的,所以分开聊并不会让它忘掉你在别处说过的事,只是让每个对话的上下文更干净。

上手前的三步设置

第一步在对话中告诉 Muse 你的名字、时区和偏好,比如「回答尽量简短」「我不吃辣」「周末不要安排工作」,Muse 会把这些存成记忆,之后的任务都会参考。你也可以让它换个名字、换种说话语气,这些都不用去设置里找,直接说就行。

第二步是设置权限,这一步个人认为最重要。在 Settings → Permissions 里,连接器和网页访问都有两档:「Ask for some actions」表示所有会改变东西的操作(发送、购买)以及一部分重要的读取操作要先问你;「Always ask」表示任何操作都先问你。刚开始用的时候建议全部设成 Always ask,虽然会多点几次确认,但你能清楚看到它每一步想干什么,这是建立信任最快的方式。

第三步是只接一个应用,而且先给只读权限。直接说「连接我的 Gmail」,或者去 Settings → Connectors 点 Connect 登录。大多数连接器都可以设成只读,也就是它能看你的数据但不能替你做事。比较稳妥的顺序是先接日历只读,再接邮箱只读,用顺手了再考虑放开写权限。Facebook、Instagram、Threads 只要在同一个账户中心里会自动连上,这一点注意一下,不想让它看的话要手动去断开。

审批卡片怎么用

Muse 每次要执行需要确认的操作时,会弹出一张审批卡片,选项有五个:Allow once(只允许这一次)、Allow for this task(这个任务里都允许)、Allow for this site(在这个网站上都允许)、Always allow(这类操作以后都允许)、Deny(拒绝)。每张卡片上还有一个 See task details,点开能看到它具体要做什么,我的建议是初期每次都点开看一眼再决定。

这几个选项里,Always allow 要格外小心。它是按「某个连接器的某一类操作」来放权的,一旦对发邮件、发帖或者付款这类操作点了 Always allow,之后它就不会再来问你了。发出去的邮件是撤不回来的,所以涉及发送和付款的操作,最好一直停留在 Allow once。

Muse 用浏览器干活的时候,你还可以随时介入:Open browser 可以实时看它在网页上的操作,Take control of the browser 会让它暂停,由你接手操作页面,Stop the task 则直接终止任务。遇到登录、验证码或者它明显走错路的时候,自己接手处理完再交还给它,往往比让它反复重试要快得多。

写好任务描述的几个技巧

和聊天机器人不同,给 Agent 布置任务更像是给一个新来的助理交代工作。说得越清楚,它来回确认的次数越少,消耗的 token 也越少。综合官方文档和用户的经验,有几个技巧比较管用。

交代清楚背景和标准。不要只说「帮我找个搬家公司」,而是说清楚从哪里搬到哪里、几居室、有没有电梯、希望什么时候搬,以及一个好结果应该长什么样,比如「给我三家报价,按价格排序」。

指定输出格式。你想要表格、列表、PDF 还是一段简短的文字,最好直接说出来。有人反馈说没指定格式时,它经常默认生成一个 Word 文件。

划定边界。比如「只搜索我的邮件,不要看短信」,或者「预算不超过 200 美元」。尤其是填表和预约类任务,在结尾加一句「提交之前停下来给我看」,这句话几乎是所有教程里都会出现的一句。

把持续性任务写成检查,而不是目标。与其说「帮我盯着这件事」,不如说「每天早上检查一次 Gmail,只有对方回复了才告诉我」。前者太模糊,后者它知道该做什么、什么时候该来找你。

直接贴步骤。Muse 目前不能让普通用户安装自己的 Skill 文件,但你可以把一套写好的操作步骤直接贴在任务里,效果差不多。另外,结果不满意就直接纠正,「太长了」「语气随意一点」,它会慢慢记住你的偏好。

实用案例

下面这些案例按风险从低到高排列,前面几类出错了也没什么损失,适合刚上手时练习,后面几类涉及外部沟通和花钱,建议等你熟悉审批机制之后再尝试。

定时提醒和每日简报

最简单的起点是定时提醒,比如「每周一早上 9 点提醒我提交工时表」,它会一直重复,直到你取消为止,还支持基于位置的提醒。在此基础上可以升级成定时简报:「每个工作日早上 7 点,给我发一份 5 条要点的行业新闻摘要,并附上来源链接」。Muse 还会主动提醒哪些文章需要付费订阅才能看。所有定时任务都可以在 Upcoming 里查看和管理。

需要注意的是,这些定时任务本质上是在聊天里推送给你的提醒,Muse 目前没有「定时发帖」这类功能,如果要定时发布内容,得接入第三方排程工具作为连接器。

整理文件和生成文档

Muse 能读 PDF、DOCX、纯文本、Markdown、XLSX、CSV 和常见图片格式,最常见的用法是丢一份文件过去,说「帮我总结一下,并列出我需要处理的事项」。合同、账单、学校通知这类文件特别适合这样处理。

反过来它也能生成东西,而且因为背后有一台完整的虚拟机,它能生成的东西比聊天机器人丰富得多。比如「做一份一页的 PDF,对比三款适合自由职业者的记账软件」,或者「做一个按类别追踪每月开销的仪表盘」,之后你说「加一行」,它会直接修改同一个文件,而不是重新生成一份。

邮件和日历

接入 [[Gmail]] 和日历之后,最直接的问法是「明天日程上有什么,哪些邮件还没回」。Muse 的邮件连接器是按需搜索,不会把你的整个收件箱下载下来,除非你明确要求。日历则是少数会主动推送的连接器,你的日程一有变化,它会自动收到通知。

我们可以让 Muse 从邮件里筛出学校和游泳课的通知,追踪各种截止日期,同步到日历上,家里人随时可以问它最近有什么安排。这类「从一堆邮件里提取结构化信息」的任务,正是 Agent 比人做得又快又不容易漏的地方。

省钱:订阅、退款和账单

这是目前用户晒单最多的一类,也是最能直观感受到 Agent 价值的地方。一个比较典型的起手式是:「翻一遍我过去 12 个月的 Gmail 收据,列出所有我可能已经不用的定期扣费」,或者「列出我正在付费的所有订阅,写上月费和最后一次使用的时间」。

退款和申诉也很适合交给它。有一些案例是让 Muse 处理 Google Cloud 上一个闲置数据库产生的费用,第一次申请被拒,Muse 起草了跟进邮件之后,39 分钟后 114.14 美元被全额免除。银行手续费减免、保险账单争议也是类似的套路:让它起草申诉,你确认后发送,然后「每周跟进一次,直到对方回复」。

X 上还有人晒出让 Muse 跟宽带公司谈判,把月费从 80 美元砍到 30 美元,或者锁定 5 年优惠价的案例。这些都是用户的自述,没有第三方核实,看看就好,但至少说明这个方向是可行的。

替你打电话

Muse 在 9 月 17 日开放了给美国商家打电话的 Beta 功能,可以帮你预约理发、问店里有没有货、找承包商要报价、订餐厅。打完之后会给你一份通话记录和摘要。Yahoo Finance 的评测者让它帮忙找搬家公司报价,Muse 问清楚了新旧地址、几居室、有没有楼梯或电梯,然后联系了本地四家公司,大约两分钟后就有两家打电话过来,其中一家当场报了价,另外几家发了邮件。

不过这个功能要多留个心眼。路透社报道,Meta 在内部测试时,有一部分电话其实是外包的人工客服打的,而且测试者事先并不知情,其中一次谈宽带账单的通话里,外包人员还说了带种族歧视的话。Meta 事后承认没有提前说明是个失误,已经暂时撤回了人工代打,并表示会在有明确告知的前提下再推出。另外也有用户反映电话打不通,或者商家一听是 AI 就挂断。所以电话里涉及的个人信息,尽量控制在完成任务所需的最少范围。

预约和购物

预约类任务是 Muse 宣传里的主打场景。Yahoo Finance 的评测者给了几个约会的大致想法,Muse 给出四个方案,他选了一个,通过 [[OpenTable]] 直接订好了位子。另一位用户让它在 [[Zocdoc]] 上找医保网络内的家庭医生,网上预约不可用时,它把事情转交给用户,第二天又主动提醒,直到预约完成。

购物的体验则更复杂一些。同一位评测者让 Muse 在任天堂官网买一款 Switch 2 游戏,它每一步都会告诉你在做什么,需要登录时把账号密码存进它自己读不到的安全存储,最后列出总价,把下单按钮留给你来按。整体很顺畅,但花的时间明显比自己去官网买要长。付款默认走 Link by [[Stripe]],每次生成一次性虚拟卡。现在 [[Shopify]] 已经开放了整个商品目录给 Muse,Walmart、Best Buy、Sephora 等也在陆续接入,但 Amazon 已经屏蔽了 Muse,Target 等网站在结账环节也会拦截自动点击。这位评测者的看法是,Muse 最适合一次性采购很多不同的东西,比如办派对或者搬家,单买一件东西自己动手反而更快。

长期目标和持续跟进

Muse 能在你关掉 App 之后继续工作,所以它很适合处理需要持续一段时间的事情。比如「我的目标是在 11 月前上线一个月更的邮件通讯」,它会拆出一份计划,每周来跟你确认一次进度。Yahoo Finance 的评测者则让它接入 Yahoo 梦幻橄榄球账号,找出预测得分最高的防守组,提交了堪萨斯城酋长队的 waiver 申请,第二天申请通过后,它自动把酋长队排进了首发阵容。

这类任务建议放在最后尝试,因为它意味着你要让 Muse 在很长一段时间里、在你不盯着的时候自主行动,前提是你对它的审批边界已经心里有数。

Mac 上的本地任务

9 月 18 日上线的 Mac 版能直接操作你电脑上的文件和应用,包括 iMessage、备忘录、提醒事项、邮件和日历。官方给的例子是「把上个月的三张发票整理到一个文件夹里」,也可以让它根据电脑里的文件填表,或者汇总当天的邮件、信息和笔记做一份日终总结。

Mac 上的应用不走连接器,而是在 Settings → File System Access 里逐个设置 Off、Read only 或 Read and interact 三档。上一篇提到过,Inc. 的记者就遇到了 Muse 在没有明确授权的情况下同步了他的 Messages 数据库,所以这里我的建议是,默认全关,只给当前任务需要的那一两个应用开只读。好消息是它删除的文件会进废纸篓,误删了还能找回来。

自定义连接器

如果你用的服务不在连接器列表里,可以直接让 Muse 自己写一个,前提是那个服务有公开的 API 或命令行工具,凭据会存进安全存储。这对开发者来说挺有吸引力,比如接入自己的记账系统或者 Home Assistant。但要注意,Meta 只对官方连接器做功能、安全和法务审查,你让 Muse 做的自定义连接器是没人审过的,接入前要先看清楚那个服务的条款和它能拿到的权限。

容易踩的坑

它会编造信息。Yahoo Finance 的评测者问一家餐厅有没有无麸质啤酒,Muse 先给了一个电话号码,接着又换成另一个,追问之下它承认第一个号码是自己编的,没有核实过。它推荐的餐厅里也有一家早就关门了,被指出后它解释说用了「过时的数据」。CNN 的测试也遇到了同样的问题。所以电话、地址、营业时间这类事实性信息,它给出来之后最好自己再确认一遍。

两步验证码要你自己来。Muse 的邮件连接器会过滤掉一次性验证码、重置密码链接和登录链接,这是出于安全考虑,但也意味着遇到需要验证码的网站,得你亲自把验证码输进去,这时候 Take control of the browser 就派上用场了。

断开连接不等于它忘了。断开一个连接器只是不让它获取新数据,它之前已经看到的内容可能还留在记忆和聊天记录里,要彻底清除得明确让它忘掉。如果是手机或 Mac 上的系统级权限,还要去系统设置里一并撤销。

长任务可能会卡住。浏览器任务跑得太长时经常会停住等你帮忙,加上网站的反爬拦截,有时候一件事来回折腾半天。遇到这种情况,与其反复让它重试消耗 token,不如自己接手把卡住的那一步做完。

提示词注入还没有解决。Meta 自己也承认 Muse 并非对攻击免疫,它在网页上读到的内容里可能藏着恶意指令。Sentinel 能拦下大部分越界操作,但这也是为什么发送和付款最好永远保留人工确认。

最后

Muse 目前最擅长的是那些流程清晰、跨好几个网站或服务、需要持续跟进,但单步又不太难的琐事:翻收据找订阅、追退款、比报价、盯截止日期。这些事情人不是做不了,而是懒得做、容易忘、容易半途而废,而 Agent 恰好不会累也不会忘。反过来,需要精确事实、需要快速完成、或者出错代价很高的事情,它现在还不太靠得住。

我的建议是把它当成一个刚入职的助理来带:先用 Always ask 看它怎么干活,从提醒和文件这类零风险任务开始,一个一个地接入应用、一点一点地放开权限。每次放权之前问自己一句,如果它这一步做错了,我能不能承受。等你摸清了它的能力边界,再把那些真正让你头疼的琐事交给它,这时候它才会真正替你省下时间。