返回 Insights

编辑分析

当 AI 都开始“用电脑”:Hark、Muse、Dots 与 Grok Bot 的功能趋近

四款 AI agent 都把“给 AI 一台自己的电脑”作为交互形态。本文基于官方一手资料对比四台“电脑”的差别:分配方式、隔离对象与权限颗粒度,并给出选型建议。

SlateMoth编辑部;Muse负责研究、起草与翻译;原执行端负责事实及页面核验;观点为作者分析。

导语

四款产品的公开描述都指向同一个交互形态——给 AI 一台自己的电脑,让它在后台替人操作。这是对产品描述层面的观察,不等于底层架构相同、性能相当;无证据支持抄袭指控,也无从反向证明。(产品分析截止 2026-10-06)

Hark Handoff

Hark 研究预览(页面仅标 AUG05,年份未注明)介绍 Handoff 为 computer use agent:每次请求启动一台专用虚拟电脑,自带浏览器、文件系统与终端,像人一样操作网站;用户可接入已有账号行动。训练从 post-training 起步,当时已进入 mid-training,pre-training 计划稍后;输出为光标与键盘动作序列。 [1] [1]

Hark 服务条款(条款文本,非实测)写明:可执行定时与主动任务、存储登录凭据与支付信息;默认在花钱或对外发消息前先请求确认;用户对授权动作负责。 [2]

限制:hark.com 产品区需登录(hark pro),未登录未付费;研究预览不等于当前产品全貌。

Grok Bot

xAI 官方公告介绍 Grok Bot 为独立产品(非普通 Grok 聊天),beta 发布;官方文档称每个 Bot 运行在持久云电脑上(浏览器、文件系统、终端,托管于 Cursor 云基础设施);同一账号的 Bot 共用一台电脑,官方提示“请把放在上面的任何东西视为对所有 Bot 可见”;网站可屏蔽自动化或要求人工步骤时交回给人。 [3] [4]

OpenAI Dots

OpenAI Learn 官方文档:Dots 为 always-on agent,由 GPT-6 Astra 驱动,拥有自己的云电脑与浏览器,设备关机后可继续工作;动作影响账号或分享信息前经自动审批判定——可执行、需批准或交回用户;网站登录走私有表单,凭据不进对话;逐步开放中,连接需逐项授权。 [5] [7] [5] [6]

Muse

Meta 官方页面称 Muse 为 personal AI agent:官网写 “persistent, isolated Linux computer with full browser”;关闭应用后仍在后台工作;敏感动作事前请求许可,权限可设为 once / always / deny,并非每个动作每次重问。以上均为厂商描述,非独立安全验收。 [8]

四台“电脑”的差别

四家都说“给 AI 一台电脑”,但四台电脑并不是同一种电脑。这个差别直接决定三件事:上下文能记住多少、出问题时从哪里恢复、权限边界画在哪——比跑分更值得看。

按请求分配 vs 持久环境:Hark 官方描述是每次请求一台专用虚拟电脑;Grok Bot、Dots、Muse 描述为持久电脑(Grok Bot 同账号共用一台,Dots 保持使用间状态,Muse 强调 persistent)。各家电脑的寿命与清理策略未在公开资料中核验,不做推断。

隔离的所指对象待核对:Muse 官网用 isolated 描述其 Linux 电脑,Grok Bot 官方则说明同账号 Bot 共用一台电脑。这两者不在同一维度上——前者未说明隔离的是“哪两个主体之间”,后者说的是“同一账号内 Bot 之间”。比较时应核对各家的隔离对象,不宜直接互比或替各家下无证据的结论。

人的位置:四家都保留了“人必须在场”的环节,颗粒度不同——Dots 分三级(执行/批准/交回),Muse 允许预设 once/always/deny,Grok Bot 把反爬和人工验证整体交回,Hark 在条款里把“花钱”和“对外发消息”设为默认确认线。2026 年的 agent 竞争已经不只是“能不能自动”,更是“在哪些点上必须停下来问”。

锐评

一、趋近的是交互形态,不是已证明的架构同构。四家都让 agent 住进“一台电脑”,这是公开描述的收敛。底层如何实现、性能是否相当、安全模型有何差异——没有内部实现证据,不下结论;同样,无证据支持“抄袭”指控,也无从反向证明没有。对成因不做无证据的推断。

二、API 覆盖不到之处是 agent 的可用空间之一。大量网站没有公开 API 或 API 能力远少于页面可做的事(厂商自述口径),拟人操作是补上这一缺口的可用路径之一——连接器、专用集成与混合流程同样是路径。哪条路径胜出取决于具体任务,不宜预设唯一答案。对读者而言,判断一款 agent 是否值得托付,先看它如何处理 API 之外的那部分工作:是硬闯到底,还是老实交回。

三、权限颗粒度是可行动的差别。Dots 的审批分级、Muse 的 once/always/deny、Grok Bot 的“交回给人”、Hark 条款的默认确认线,是四种不同的“谁说了算”。这两套机制并不互斥,选型时不必二选一;可问三句:动我的账号前问不问、问一次还是次次问、事后能不能查到记录。跑分回答不了这三个问题。

四、厂商描述不等于验收结论。本文未取得任何一家的独立审计证据;四家的审批、隔离、日志均为自述。“经授权的后台运行”与“无人值守全自动”是两回事,前者是产品能力描述,后者仍需监督链条。采购前需要查证:审批记录能否导出、凭据存放在哪、是否有第三方评估——这些是采购方的功课,不是本文能代替的。

五、给选型者的建议。个人用户看“问几次”是否可配置;带团队注意“同一账号内是否共享环境”(如 Grok Bot 的共用电脑);企业采购把“审批可审计性、凭据存放、第三方评估”列入查证清单再谈价格。

尚不能断言

Handoff 在真实任务上的完成率与失败模式;

四家权限机制的独立审计结果;

各产品当前版本的具体功能与定价(Hark 需登录核验;其余以官方页面为准)。

来源

  1. Hark 官方研究预览《Introducing Hark Handoff》(页面仅标 AUG05,年份未注明)
  2. Hark 服务条款(条款文本,非实测)
  3. xAI 官方公告《Introducing Grok Bot》
  4. xAI 官方文档:Grok Bot 概览
  5. OpenAI 官方文档:Dots 介绍
  6. OpenAI 官方文档:Dots 的电脑与应用连接
  7. OpenAI 官方文档:Dots 的控制与权限
  8. Meta 官方页面:Muse