
在洛杉矶举行的 Meta Connect 2026 上,Meta 揭开了 Muse 2.0 的面纱,这是一项大幅升级,将其原本仅限文字的 AI 伴侣转变为多模态个人助理。全新的 Muse 现在能够实时生成视频头像、管理用户的电子邮件收件箱,甚至可以控制 Mac 桌面——这些听起来像科幻,却将在数月内面向消费者发布。
这些抢眼的功能不仅是华丽的附加。由公司最新的生成式视频模型驱动的视频头像,使 Muse 能以逼真的主持人形象出现在屏幕上,面部表情与语音同步。这可能会重塑远程工作,将单调的聊天窗口变成会议或网络研讨会的虚拟共同主持人。然而,真正的考验在于延迟和隐私;实时流式传输高保真视频需要带宽,并引发 Meta 过去常回避的数据处理问题。
邮件集成是 Muse 开始像真正助理的地方。用户可以链接自己的收件箱,Muse 将起草回复、优先处理邮件,甚至根据之前的对话建议后续跟进。该功能利用了 Meta 大规模语言模型,并在邮件礼仪上进行微调,但风险在于过度自动化——用户会不会过度依赖 AI 生成的通信,削弱个人声音?
也许最具颠覆性的要素是 Mac 控制。Muse 现在可以通过自然语言在 macOS 设备上执行指令,从打开应用到编辑文档。这模糊了语音助理与完整桌面自动化之间的界限。对开发者而言,这一举措打开了新的集成前沿,但也可能冲击现有的自动化平台,如 Apple Shortcuts 以及第三方工具 Zapier。
从生态系统的角度看,Muse 2.0 迫使竞争对手加速多模态能力。OpenAI 的 GPT‑4o 和 Anthropic 的 Claude 已经在尝试视频功能,但 Meta 的硬件优先策略——将 Muse 与即将推出的 Muse Charm 手持设备捆绑——可能带来分发优势。Charm 内置的 5G 调制解调器确保代理始终在线,规避了许多 AI 设备受限于 Wi‑Fi 的困境。
底线是:Meta 正押注一个真正个人化、无处不在的 AI 助手能够将用户锁定在其生态系统中。技术令人印象深刻,但其推出将成为隐私保护、用户自主权以及市场是否准备好接受一个不仅能说话,还能观看、写作并控制电脑的全能助理的试金石。
图片:Vitaly Gariev / Unsplash (https://unsplash.com/@silverkblack)
Rabbit pivots from its R1 hardware to OS3, a cloud-based agentic OS that runs locally across Windows, Mac, and Linux without proprietary devices.

The UN’s AI science panel warns that as agents become more capable, there’s no assurance humans will retain control, urging urgent governance action.

Amazon blocks Meta’s Muse AI agent from shopping on its platform, citing privacy, security, and compliance concerns, sparking a wider debate on agent interoperability.

Runway’s new streaming engine lets users watch AI‑generated video unfold frame by frame, reshaping creative tools and hinting at broader autonomous applications.

评论