六款桌面 Agent,三条进化路线

选的是模型,
更是工作方式。

从全仓库工程代理到业务型办公工作台,再到可自建的开源 Harness。这份图鉴将 Codex、Claude Code、Kimi Code、WorkBuddy、DeepSeek Harness 与 MonkeyCode Work 放在同一张决策地图上。

工程工作台办公型 AgentIDE 助手开源 Harness
01 / Capability Matrix

能力的形状,决定协作方式

相对评分为编辑判断,用于快速筛选试用对象;实际效果应以同一仓库、同一任务集的实测结果为准。

产品工程广度办公广度可定制性上手门槛运行入口一句话定位
ChatGPT Desktop
9.6
CLI / IDE / 云环境多环境工程控制台
Claude Desktop
9.4
CLI / 桌面端 / 云端终端优先的深度协作
MonkeyCode Work
8.4
桌面端 / 本地 / 云端 / WSL本地与云端协同的开发客户端
Kimi Code
8.2
CLI / VS Code / API大上下文中文 Coding Agent
DS Harness
8.6
CLI / Web / Headless / Profile开源可改造的 Coding Harness
WorkBuddy
5.5
桌面工作台面向业务交付的 AI 工作台
02 / Product Profiles

六个产品,六种重心

01 — DEEPSEEK / CODING HARNESS

DS Harness

开源、可改造的 Coding Harness,深度适配 DeepSeek 模型。适合研究 Agent Loop、上下文管理、工具路由和多 Agent 编排。

开源可改造
02 — OPENAI / CODING HARNESS

ChatGPT Desktop

AI 开发团队控制台。用多 Agent、独立 Worktree、Desktop GUI、后台任务和统一 Diff 管理并行工程任务。

多 Agent 工作台
03 — ANTHROPIC / CODING HARNESS

Claude Desktop

可编程的 Coding Harness。通过 Skills、Subagent、Hooks、MCP、Plugins 和 Permissions 把开发流程编排成自动闭环。

深度定制
04 — MONKEYCODE / DESKTOP AGENT

MonkeyCode Work

连接桌面端、手机 APP、本地项目、WSL 与云端环境的多模型工作台,支持自定义 Skill、云端积分共享和个性化皮肤。

多端协同
05 — TENCENT / DESKTOP AGENT

WorkBuddy

多模型通用桌面 Agent。主推混元 3,结合 Skills、Office/文件处理和远程控制,完成跨应用的办公自动化任务。

办公自动化
06 — MOONSHOT / CODING HARNESS

Kimi Code

面向长任务的 Coding Agent。以 Subagent、后台任务、Skills、Plugins、MCP 和 ACP 支撑持续自主开发。

长任务 + 开放协议
03 / Tool Field Cards

六款工具,各自适合什么工作

优点与关注点综合产品形态和公开社区讨论。社区声音反映特定用户、任务和版本下的实践,用于辅助试用设计。

01 / DEEPSEEKOPEN CODING HARNESS

DS Harness

开源、可改造的 Coding Harness,深度适配 DeepSeek 模型。

DS Harness 运行轨迹界面
核心价值
  • 开源可修改,适合研究 Agent 基础设施
  • 可深入调整 Agent Loop、上下文与工具路由
  • 支持 Web、Headless、Profile 与多 Agent 运行
适合团队
  • 研究和定制 Coding Harness
  • 追求成本、自主可控与模型适配
  • 愿意承担配置、沙箱和工程投入
产品哲学:DS Harness 的价值在于让团队深入 Harness 本身,构建符合自身任务和治理要求的 Agent 基础设施。
02 / OPENAICODING HARNESS

ChatGPT Desktop

把 AI 当作一支可管理的开发团队,统一承接并行工程任务。

ChatGPT Desktop 发起 Claude Desktop 代码审阅的会话界面
核心价值
  • 多 Agent 并行处理优化、重构、测试与 CI
  • 独立 Worktree 隔离任务,再统一查看 Diff
  • Desktop GUI、后台任务和 Automations 形成闭环
适合团队
  • 同时推进多个开发任务
  • 需要集中管理 Agent 产出
  • 重视代码审阅与团队治理
产品哲学:ChatGPT Desktop 最像 AI 开发团队控制台,重点是分派任务、汇总结果和推动交付。
03 / ANTHROPICCODING HARNESS

Claude Desktop

把开发工具链编排成可编程的 Agent 工作流。

Claude Desktop 任务与 diff 界面
核心价值
  • Skills、Subagent、Hooks、MCP 与 Plugins 组合灵活
  • Permissions 和 LSP 支撑可控的仓库操作
  • 可在工具生命周期中插入格式化、Lint 和测试
适合团队
  • 重度开发和 DevOps 工作流
  • 希望自己设计 Agent 行为
  • 愿意沉淀团队指令与自动化规则
产品哲学:Claude Desktop 是高度可编程、对 Hacker 友好的 Coding Harness,优势来自工作流控制力。
05 / TENCENTDESKTOP AGENT

WorkBuddy

主推混元 3 的通用桌面 AI 员工,面向文件、Office 和跨应用任务交付结果。

WorkBuddy 任务管理界面
核心价值
  • 混元 3 作为主推模型,入口统一、上手直接
  • 处理文件、Office 产物和桌面操作
  • Skills 与国内办公生态适合业务自动化
适合团队
  • 批量处理 Excel、文档、网页和报告
  • 需要跨应用完成完整业务流程
  • 让业务人员直接获得可交付产物
产品哲学:WorkBuddy 解决的是“帮我操作电脑完成工作”,覆盖面集中在办公自动化和跨应用交付。
06 / MOONSHOTCODING HARNESS

Kimi Code

面向长时间自主开发的 Coding Agent,让 UI 与 Harness 通过开放协议协作。

Kimi Code VS Code 界面
核心价值
  • Subagent、Nested Agents 和后台任务支撑长任务
  • Plan、Skills、Plugins 与 MCP 适合持续迭代
  • ACP 解耦 IDE/GUI 与 Coding Harness
适合团队
  • 大型仓库和长时间自主开发
  • 希望任务持续运行并自行尝试
  • 重视开放生态和 Agent 组合
产品哲学:Kimi Code 的竞争力来自长任务、Subagent 和开放协议的组合。
04 / Which Team?

从团队问题倒推工具

工程团队 → Codex / Claude Code

复杂服务与长期维护

需要跨文件编辑、执行测试、审查变更、处理 CI 和多任务并发时,优先考察工程闭环与权限策略。

业务团队 → WorkBuddy

让成果直接落地

周报、调研、数据分析、演示稿和轻量应用需要业务人员自行完成时,选择面向交付的办公 Agent。

平台团队 → DeepSeek Harness

构建自己的 Agent 系统

模型路由、工具协议、运行记录、沙箱和流程编排需要自主掌控时,Harness 具备最大的改造空间。

05 / Community Field Notes

社区现场,比宣传页更接近工作流

社区开发者在不同项目、权限配置与上下文规模下形成的实践,帮助识别真实交互形态与使用摩擦。

DS Harness 运行轨迹界面
DS Harness 的运行轨迹与执行审阅界面。
Harness 的 Web UI 与多子代理

真实使用展示了 Web 对话、运行数据、自动生成 GOAL 与多 subagent 处理,说明它已具备可视化执行审阅的工作形态。

跨 Agent 审阅正在成为真实需求

开发者将同一项目与必要会话上下文交给另一款桌面 Agent 完成只读 review,再把结论送回原会话。核心挑战集中在上下文交接,以及目标会话的可见性和可追问性。

早期版本需要把性能纳入试点

高上下文的 UI 响应、任务规模、模型输出速度与人工干预量,值得放入统一试点任务集持续记录。

06 / Pilot Before Purchase

用同一组任务,
让答案自己出现。

订阅价格只解释成本上限;真实生产率由任务完成率、人工介入、结果可复核性和环境治理共同决定。

  1. 选取一个真实仓库和一个真实业务数据集
  2. 统一任务说明、权限边界与测试命令
  3. 记录完成时间、重试次数和人工修订量
  4. 评估源码、数据和连接器的治理要求
  5. 按角色保留一主一备的工具组合