GPT-6 Sol、Claude Opus 5.5 已上线GPT-6 Sol 价格仅为 5.6 Sol 的一半
博客
指南

Meta Muse 评测

了解 Muse 能做什么、邀请码怎么用,以及需要留意的隐私边界。

9 分钟阅读OmniaKey
Muse AgentMeta MuseMuse 邀请码个人智能体Connect 2026

如果你经常在邮箱、日历、网页和各种服务之间来回处理琐事,Muse Agent 值得关注。 它尝试把“找资料、联系对方、等待回复、继续推进”交给一个持续工作的个人智能体。现有媒体体验已经给出了有用的案例,也暴露了过期资料、虚构信息和简单任务耗时偏长的问题。

围绕 2026 年 9 月 23–24 日这波新消息,有两件事尤其容易看混:Muse 的首发日期与 Connect 大会更新,以及邀请码奖励与账户准入。看清这两点,比拿到一串代码就立刻判断它好不好用更有帮助。

评测方法与核验日期:2026 年 9 月 25 日。 本文是基于官方公告、产品说明、隐私政策和具名媒体体验的研究评测。本次没有登录 Muse、兑换邀请码或运行任务;下文会注明外部实测的作者,不把发布演示写成本站亲测。

Muse Agent 是什么?

Muse 是 Meta 推出的个人 AI 智能体,背后使用 Muse Spark 模型。你接触到的产品还包括云端电脑、浏览器、记忆、任务管理和应用连接器,实际体验取决于这些部分能否一起把任务推进下去。Meta 的首发公告(英文)描述了这套工作方式。

例如,你可以交代一项有后续的任务:比较几个餐厅的条件,找合适的时间,处理预约,并在需要确认时回来找你。根据官方产品设计说明(英文),Muse 能在 App 关闭后继续工作,按计划或相关事件推进任务;Goals 页面记录目标,活动记录展示它做过什么,记忆文件可以查看和修改。

这也是本文评估它的标准:它是否减少了你收集上下文、切换软件和反复跟进的工作,以及你为核对结果付出了多少时间。 单看聊天回复是否流畅,无法回答这个问题。

9 月 23–24 日究竟更新了什么?

Muse 的官方首发公告日期是 9 月 8 日。9 月 23 日的 Connect 活动展示了更多能力,Meta 在9 月 24 日的大会综述(英文)中整理了这些进展。

这轮更新的方向很清楚:让 Muse 出现在更多日常入口里,能联系更多服务,同时让人更容易和自己的智能体交流。但不同功能的开放进度并不相同。

关注点截至本次核验,来源支持的状态
手机、网页中的个人代办首发已介绍,并有媒体实际使用案例;能否开通仍要看账户
Mac 上处理本地事务Connect 前已有 Mac 版上线报道;9 月 23 日继续展示电脑工作场景
AI 眼镜上的 Muse官方写的是“未来数月”,还不能当作所有用户当前都有的能力
实时数字头像Connect 展示了由新模型支持的实时交流形态;媒体报道使用即将推出的表述
新增连接器与支付合作公布更多购物伙伴,以及 Notion、Granola、GitHub、Box 等工作服务;具体以账户内列表为准
Muse 自己的邮箱地址官方使用将来时;不能据此认定你的账户已有独立邮箱
Muse Charm 随身设备官方表示年内还会分享更多信息,尚不适合按已交付产品评测

其中 Mac 版容易被误写成大会当天才推出。Alexandr Wang 在 9 月 17 日的公告(英文)已宣布 Mac 版上线;TechCrunch 9 月 23 日报道(英文)则描述了大会展示的更多场景。客户端存在,也不代表每个账户已经拥有演示中的全部权限和功能。

因此,现阶段更有参考价值的是你账户里能完成的任务。眼镜、头像和 Charm 可以影响你对产品方向的判断,但不宜提前计入今天的使用收益。

Muse 邀请码怎么用?先分清准入和奖励

邀请码确实存在,不过目前能明确核实的官方活动,是推荐奖励。

Muse 官方账号在9 月 16 日的公告及回复(英文)中说明:朋友加入并兑换推荐码后,邀请人与被邀请人各获得 10 亿 Muse 词元(tokens)。官方回复还明确要求:加入后的 48 小时内,在 Settings(设置)中兑换。

“先加入,再兑换”很重要。它描述的是活动奖励,不能单凭这段公告就得出“所有人必须凭码进入”,也不能反过来保证所有地区都已经无需邀请。

你可以按账户实际显示的状态理解:

你看到的情况应该判断什么
官方入口提示候补、邀请资格或地区尚未开放这是当前账户的准入问题;推荐奖励公告不能保证解锁
已经进入 Muse,设置里可以兑换邀请码核对自己的加入时间、活动条件和账户显示的奖励
已有奖励,但某个连接器或新功能没出现奖励额度不等于额外功能或应用访问权限

官方入口是 muse.ai/join,本次读取显示 iOS、Android 和网页三个入口;Muse 网页首页显示登录/注册流程。我们未验证任何特定账户的开通资格。首发公告写的是先向美国推出;不能把这个历史范围当成 9 月 25 日的完整开放地区清单,也不能因为网页出现中文就认定中国大陆账户已可用。服务条款还要求用户达到 18 岁,或所在地规定的更高年龄。

10 亿词元是官方活动的奖励单位。活动原帖没有给出它能完成多少次购物、多少轮任务的可靠换算,也没有说明它可以转成 Muse Spark API 余额。评估是否值得用,应看任务结果和实际消耗。

费用方面,官方确认有免费使用与订阅方案,美国 App Store 也显示免费下载、包含 App 内购买(英文)。本次没有从可读取的当前官方价目页复核具体套餐金额,选择方案时应以自己账户展示的额度、价格和条款为准。

真实任务表现:多步代办有价值,错误也会进入行动链

目前能读到的具名体验,提供了比发布演示更具体的判断依据。

TechRadar 作者 Eric Hal Schwartz 的体验(英文)包括筛选商品,以及从邮箱中找到电力公司的待办事项、准备回复并等待作者批准。Yahoo Finance 作者 Daniel Howley 在 9 月 23 日的评测(英文)则记录了搬家询价、餐厅预约等任务,也保留了失败案例。

媒体任务作者报告的结果对试用的启示
TechRadar:处理电力公司邮件Muse 找出需要处理的邮件,询问时间,生成待批准的回复减少寻找上下文和起草的工作,最终安排仍由用户确定
Yahoo:联系搬家公司询价Muse 收集搬家条件,联系公司,推进到收到报价有多方联系和往返沟通的事务,比较接近它的价值所在
Yahoo:购买游戏购买流程可以推进,但作者认为比自己操作慢已经知道买什么、在哪里点的简单任务,未必值得委托
Yahoo:查找餐厅出现已停业地点;另一次询问中给出了未经核实、虚构的电话号码能操作网页不代表每条事实都准确,外部联系方式尤其需要核对

这些是外部作者的小样本体验,没有统一任务集、重复次数或成功率统计,不能变成“准确率达到多少”的评分。

它们仍支持一个实用判断:Muse 更值得尝试的场景,是你知道目标,却不想亲自处理每一步协调。 对于几下点击就能完成的事,把任务解释给智能体、等待执行、再检查结果,可能比自己做更慢。

另一个判断是,错误信息的成本会随着行动放大。聊天里一个错误号码可以被忽略;代办任务沿用这个号码,就可能直接打断后续工作。因此,评测 Muse 时,要看最后的预约、报价、文件和活动记录是否正确,不能只看它是否说“完成了”。

隐私取舍:需要知道的几条具体边界

Muse 的实用性与它掌握的上下文有关。让它处理邮件、日程和持续目标,就需要理解对应的信息。评价这件事,应该看它如何获得权限、如何用数据,以及你能怎样撤回。

按照官方安全设计说明(英文),Muse 在独立云端环境中工作,凭据与执行任务的智能体隔离;外部动作由单独的 Sentinel 层检查,需要用户批准时,通过产品界面中的明确批准控件处理。这些是厂商对系统机制的说明,本次没有对其进行独立安全审计。

更影响日常使用的是以下几点:

  • 模型训练有单独开关。 9 月 17 日生效的Muse 中文隐私政策说明,互动信息可能用于改进模型,首次使用时该设置默认开启,可在“数据控制”中关闭,设置变更也适用于过往互动。互动信息可能包含工具执行任务时使用的连接器数据;这段政策不等于承诺撤销已经完成的模型训练。
  • 断开连接器不等于清除旧数据。 同一政策明确说,断开后停止新的数据交换,但此前任务使用的信息可能仍保留在记忆和对话里。删除聊天后,Muse 也可能保留从中学到的内容;可以进一步检查记忆、使用忘记功能或重置功能。
  • 凭据隔离不等于服务商完全无法访问任务数据。 官方安全说明区分了当前的 Secure VM 与计划中的 Confidential VM。前者仍允许 Meta 因服务运营、安全或支持需要访问数据;后者才以密码学方式阻止这类访问为目标。本次未核实到 Confidential VM 已全面开放的公告。
  • 广告边界也有范围。 Meta 表示不会把对话或 VM 数据分享给其广告系统;同时说明,Muse 代你访问商家网站等行为,仍可能间接影响你看到的广告。

这意味着,第一次试用时,比较合理的起点是只给当前任务需要的信息和权限。等你确认它怎样理解目标、怎样展示结果,再决定是否让它承担长期任务。这是基于产品机制和已有错误案例的使用建议,不是对它“绝对安全”或“不值得信任”的笼统评价。

拿到资格后,先用什么任务判断它值不值得?

下面三项是建议的试用方法,本次未实际执行。无需一开始就把所有账户都连接进去。

第一项,做一次有明确约束的公开信息比较。 例如比较三家服务商的覆盖范围、价格来源和预约条件,要求给出原始链接与查询日期。验收时看它有没有把“不知道”写清楚、有没有使用过期信息;先获得比较结果,再决定是否联系对方。

第二项,把一件真实但范围有限的待办推进到草稿。 例如针对你指定的一封邮件,列出待确认事项并起草回复。检查它是否理解了时间、收件人和你的承诺,是否在约定的位置等待批准。省下的起草时间,要扣掉你修正错误的时间。

第三项,试一个有结束条件的持续任务。 例如跟踪某个公开商品在一段时间内的价格,只在低于指定价格时通知。看它能否记住阈值、减少重复通知,以及在你取消后停止跟进。

这三项分别检验信息可靠性、任务推进和持续性。你最终要衡量的是:解释任务、等待、审核和返工加在一起,是否比原来的做法更省心。

谁适合现在尝试 Muse?

如果你的日常负担主要是信息分散、协调频繁、需要等待后续,而且愿意为重要动作保留确认环节,Muse 已有足够具体的案例,值得放进试用名单。

如果你主要需要即时问答,或者工作依赖尚未开放的连接器、眼镜入口和新功能,当前收益就没有那么确定。对于无法接受云端处理的敏感材料,也应先核对现有产品机制,而不是把未来的 Confidential VM 计划当作当下条件。

我的判断是,Muse 值得评估的是“能替你持续推进多少真实工作”。 9 月 23–24 日的更新让这个方向更明确;真正决定它能不能留在你的日常里,仍是你账户可用的功能、实际交付结果和需要投入的监督时间。

能否加入和如何领取奖励,是试用的起点。拿到资格之后,用一件你原本就需要处理的事来检验它,比为了消耗奖励额度不断找任务更有意义。