上周四凌晨,我一边喝咖啡一边刷 X。看到 OpenAI 把 ChatGPT、Codex、Work 缝成同一个 App 的消息,我第一反应是:”完了,Manus 要被拍死了。” 结果三小时之后,Manus 官方账号直接转推:”Welcome to the game.” 再过一小时,Genspark 创始人景鹏发文:”I never thought that we, a 24-person company, would be ahead of OpenAI…” 接着两家连夜发了 10 条对比测试,宣称要跟 ChatGPT Work 正面掰手腕。
这不是我熟悉的 AI 行业节奏。过去两年,每隔三个月来一波模型升级,大家各干各的,井水不犯河水。但 2026 年 7 月这波不一样——当一家大厂把 AI Agent 能力直接打包进 8 亿用户的 ChatGPT 客户端时,整条赛道都被按下了加速键。
对海外华人来说,2025 年还在纠结”用 ChatGPT 还是用 Claude”,2026 年的问题已经变成:”ChatGPT Work、Claude Cowork、Manus、Genspark,这四个 AI Agent 工具到底选哪个?能不能不要四个都付月费?”今天这篇文章,我把这四个工具掰开揉碎比一遍,帮你省下至少一两个月费。
目录
- 为什么 2026 年突然都在做 AI Agent?
- ChatGPT Work(7/10 发布):OpenAI 亲自下场
- Claude Cowork(1 月开创,7/7 扩展):老钱家的精细活
- Manus:华人 AI 创业的明星产品
- Genspark:硅谷新贵的”成果交付”哲学
- 四大工具核心能力对比表
- 价格与套餐:谁更划算?
- 真实场景实测:同一个任务谁干得更好
- 海外华人按场景选型:4 个推荐方案
- 数据主权与合规:海外华人最容易忽略的风险
- 结论:别只选一个,按场景组合用
为什么 2026 年突然都在做 AI Agent?
先说清楚概念。”AI Agent” 跟”AI 聊天”最大的区别是:聊天是回答问题,Agent 是把活干完。给你一个目标,它自己拆解任务、调用工具、运行命令、调整方案,最后交给你一个能用的成品——可能是一份文档、一个 PPT、一个网页、一段代码,也可能是一份完整的财务分析报告。
2026 年这波 AI Agent 浪潮,本质上是过去两年”模型能力”积累到一定阈值后的必然产物。GPT-5.6 Sol 的 Terminal-Bench 2.1 跑分 91.9%(ultra 模式),Claude Opus 4.8 的 BrowseComp 拿 84.7%,DeepSeek V4 的 SWE-bench Verified 也到 80.6%——模型已经强到可以直接操作浏览器、写代码、调用 API 了。这是 Agent 化的技术基础。
但模型强不等于产品好。怎么把”模型能力”包装成”用户愿意付费的工作流”?四家公司走了四条完全不同的路。OpenAI 选了”通用办公入口”路线,Anthropic 选了”本地文件管家”路线,Manus 选了”云端实习生”路线,Genspark 选了”成果快速交付”路线。路线不同,用户群就不同。这也是为什么四个工具都能活下来。
ChatGPT Work(7/10 发布):OpenAI 亲自下场
先说最新也是最猛的——ChatGPT Work。7 月 10 日凌晨,OpenAI 在线上直播中正式发布了这个产品,定位非常直白:把”回答问题”升级成”把活干完”。你给一个目标,它自己去查资料、做分析、写文档、生成 PPT,最后交付的是成品,不是聊天记录。
ChatGPT Work 的核心能力有六个:
- 长程任务执行:能连续工作数小时,不会中途”continue”提醒你
- 多应用连接:Slack、Gmail、Google Drive、CRM、日历都已支持
- Ultra 多代理模式:Sol 旗舰模型可同时调度多个子代理并行处理任务(Terminal-Bench 2.1 ultra 模式 91.9%)
- Codex 整合:编程任务由专用 Codex 标签页处理,不占用主对话额度
- Sites 一键建站:用自然语言描述需求直接生成可发布网站,绑定自定义域名
- 桌面 Computer Use:能操作本地文件、浏览器标签页、桌面软件
实测表现方面,《智东西》测试团队跑了三个真实场景:在 Gmail 里找未回复邮件并起草回复(4 分钟处理 7 封,质量参差但比手动快);把 50 页 PDF 提炼成 5 页 PPT(结构完整但需要微调);为行业大会做会前规划(耗时 18 分 50 秒,生成交互式卡片日程,但遗漏了一个分会场信息)。
价格上,ChatGPT Work 全套餐都可访问:Go ($8/月) 基础访问,Plus ($20/月) 完整使用,Pro ($100/月 5x 或 $200/月 20x) 支持 Ultra 模式。这点非常重要——$20/月的 Plus 就能体验完整的 Work 能力,对比其他三家门槛低一大截。
短板也很真实:
- Work 和 Codex 共用智能体额度池,几个复杂任务就能把订阅额度烧光
- 桌面、网页、手机之间任务不互通
- 旧应用被改名成 ChatGPT Classic,老用户社区已经出现不少抱怨
- 欧洲经济区、瑞士、英国的用户暂时用不了 Sites
如果你已经有了 ChatGPT Plus 账号,几乎可以零成本上手。但要长期用 Work 做主力工具,建议上 Pro $200/月版本,不然额度消耗会让你很焦虑。
Claude Cowork(1 月开创,7/7 扩展):老钱家的精细活
如果说 ChatGPT Work 是”从网上查资料到成品交付”的全链路工具,那 Claude Cowork 走的是另一条路——”把你电脑里的素材整理成成品”。Anthropic 今年 1 月开创了 cowork 这个品类,7 月 7 日刚扩展到网页和手机端。
Claude Cowork 的核心能力:
- 本地文件深度处理:整理文件夹、把会议材料变成 briefing、操作本地文件和应用
- Microsoft 365 集成:通过 M365 MCP Connector 读写 Outlook、OneDrive、SharePoint、Calendar
- 跨设备同步:桌面、网页、手机任务互通(这点比 ChatGPT Work 强)
- Scheduled Pipelines:可设置自动定时执行的工作流
- Claude Sonnet 5 + Opus 4.8:默认 Sonnet 5,复杂任务调用 Opus 4.8
第三方评测数据:
- 工具调用稳定性(Chained tools, retries):Cowork 93 vs Work 85
- 大文件 CSV/JSON 处理:Cowork 略胜
- 90 页政策文件总结:Work 保持叙事连贯更稳,Cowork 引用更精确
- 研究综合(检索+推理):Work 89 vs Cowork 88
- 36% 的 Claude Cowork 提示词是代码相关,ChatGPT Work 只有 4%
这是两个产品的根本差异:Cowork 偏工程和合规,Work 偏内容创作和演示文稿。
但 Cowork 的门槛比 Work 高很多:必须订阅 Max 套餐($100/月或$200/月),Pro $20/月用不了 Cowork。如果你已经有了 Claude 账号,升级到 Max 是逃不掉的额外支出。
关于 Claude Sonnet 5 的具体能力,参考我们之前的文章 2026年7月AI模型价格大跳水。如果你的工作流是 Microsoft 365 重度用户,Cowork 是目前最成熟的选择;如果你更喜欢纯内容创作,Work 更顺手。
Manus:华人 AI 创业的明星产品
Manus 是这四家里最特殊的一个——中国团队(Butterfly Effect)做的产品,主打”云端数字员工”路线。2025 年 3 月横空出世时,演示视频刷屏全网,等候名单排到几十万人。现在一年半过去,Manus 已经从”viral demo”进化成”真正能用的工具”。
Manus 的核心能力:
- 三层架构:Planner/Executor/Verifier 多智能体设计,能自主拆解、并行执行、验证结果
- 超长任务:可连续运行数小时,处理”搜索→整理→输出”的循环
- 代码执行能力强:Linux 沙箱,可写 Python 脚本并直接执行
- 浏览器自动化优秀:依托浏览器现有登录态,能操作你已经登录的网站
- 多格式交付:Word/Excel/PPT/PDF/网页 都能生成
基准测试数据:Manus 在 GAIA 通用 AI 助手基准上拿到 88.5%,超过 OpenAI Deep Research 的 75.2% 和开源方案的 58.18%。
价格方案:
- Free:每日 300 credits,一个并发任务
- Starter $19/月:1900 credits/月,两个并发任务
- Pro $39/月:4500 credits/月,五个并发任务
- Business $199/月:团队协作
对海外华人的关键点:
- 数据路由走新加坡——对中国大陆用户和美国用户都更友好(数据物理位置不在中美任何一地)
- 不需要翻墙,官网直连
- 中文能力强,原生支持中文任务理解
- API 2026 Q2 已开放,可以集成进自己的工作流
短板:
- 无专属移动端 App,只能网页端使用
- 无桌面客户端协同
- 无原生视频生成、专业编程部署
- 代码质量”原型级”,不适合生产环境
最适合谁:海外市场调研人员、独立咨询顾问、产品经理做竞品分析。简单说,Manus 是”啥都能干一点的多面手”,不是”某一项最专业”。
Genspark:硅谷新贵的”成果交付”哲学
Genspark 创始人景鹏是前百度小度高管,2024 年在硅谷创立公司,目前团队只有 24 人。但就是这么小的团队,做出了让 OpenAI 都紧张的产品。
Genspark 的核心能力:
- 多模型混合(MoA):同时调用 9 个模型,路由到最合适的那一个
- Sparkpages:自动生成可分享的网页报告
- AI Slides / AI Sheets:一键生成 PPT 和电子表格
- AI Phone Calls:能模拟人工打电话完成预约、客服沟通(这是 Manus 没有的)
- 多模态内容生成:图片、视频、PDF 都能做
价格方案:
- Free:每日 100-200 credits
- Plus $24.99/月:包含 unlimited chat 和图片
对海外华人的关键点:
- 美国本土公司,数据主权无争议
- 日本/韩国市场份额高,对在日韩生活的华人很友好(界面和客服都支持日语/韩语)
- AI 电话功能,海外华人预约餐厅、客服沟通很实用
- 短任务见长,长任务容易超时(约 1 小时)
短板:
- 复杂任务 credits 消耗很快(一份研究报告可能消耗 1000 credits)
- 多人协作权限体系简陋
- 支持问题在用户评价中常被提及
- 无本地文件读取能力
对比 Manus:Genspark 是”提出目标然后等结果到货”,Manus 是”让用户看见过程并可随时介入”。两种产品哲学各有拥趸。如果你需要快速生成多媒体内容,Genspark 更合适;如果你需要深度可控的长任务,Manus 更好。
关于 AI 编程和 Agent 工具的更多选择,可以参考 Grok 4.5 编程模型指南。
四大工具核心能力对比表
先把核心维度摆出来。我从用户最关心的 8 个维度做对比:
| 维度 | ChatGPT Work | Claude Cowork | Manus | Genspark |
|---|---|---|---|---|
| 发布时间 | 2026/7/10 | 2026/1,7/7 扩展 | 2025/3 | 2024 |
| 开发团队 | OpenAI(美国) | Anthropic(美国) | Butterfly Effect(中国/新加坡) | Genspark(美国) |
| 底层模型 | GPT-5.6 Sol/Terra/Luna | Claude Sonnet 5/Opus 4.8 | 多模型路由 | 9 模型混合路由 |
| 核心定位 | 通用办公入口 | 本地文件管家 | 云端数字员工 | 成果快速交付 |
| 长任务能力 | 数小时 | 数小时 | 数小时(最稳定) | 约 1 小时 |
| 本地文件访问 | 支持(桌面端) | 支持(最强) | 不支持 | 不支持 |
| 代码执行 | 强(Codex) | 中等 | 强(Linux 沙箱) | 有限 |
| 多代理并行 | 支持(Ultra) | 有限 | 支持 | 支持 |
| 移动端 App | 无独立 App | 有(7/7 上线) | 无 | 无 |
| 多语言 | 强(含中文) | 强(含中文) | 中文最强 | 中英日韩 |
价格与套餐:谁更划算?
价格是大多数海外华人选型的第一道关。我把四家的入门级、专业级、团队级方案都列出来:
| 套餐 | ChatGPT Work | Claude Cowork | Manus | Genspark |
|---|---|---|---|---|
| 免费版 | 有限访问 | 无 | 300 credits/天 | 100-200 credits/天 |
| 入门版 | Go $8/月(基础 Work) | 无 | Starter $19/月 | Plus $24.99/月 |
| 主力版 | Plus $20/月(完整 Work) | Pro $20/月(无 Cowork) | Pro $39/月 | 无 |
| 高级版 | Pro $100/月(5x 额度) | Max $100/月(可用 Cowork) | Business $199/月 | 无 |
| 顶级版 | Pro $200/月(20x 额度,Ultra) | Max $200/月 | 企业定制 | 企业定制 |
几个关键观察:
- ChatGPT Work 入门门槛最低——$8/月的 Go 就能用 Work,$20/月的 Plus 就能用完整功能。对预算敏感的海外华人,这是首选。
- Claude Cowork 入门门槛最高——必须 Max $100/月,Pro $20/月用不了 Cowork。适合本来就在 Claude 生态里深度使用的用户。
- Manus 性价比最透明——$19/月的 Starter 已经能完成 80% 的日常任务,credits 计算方式简单直接。
- Genspark 单价最便宜——但 credits 消耗快,复杂任务可能比 Manus 还贵。
如果你只想付一个月费:ChatGPT Work Plus $20/月。如果你想深度用:$20 ChatGPT Plus + $19 Manus = $39/月,组合使用覆盖90%场景。
真实场景实测:同一个任务谁干得更好
我选四个海外华人最常见的工作场景,让这四个工具分别跑一下:
场景 1:跨境电商选品调研
任务:调研 Amazon 美国站宠物用品类目近 30 天销量前 20 的新品,输出包含产品图、定价、评论数、评分的 Excel 报告。
- ChatGPT Work:用 Plan 模式规划任务,并行启动 3 个子代理查 3 个子品类。耗时 28 分钟,输出格式完整,但 3 个产品图片加载失败。最终 18/20 完整。
- Claude Cowork:调用 OneDrive 存历史调研模板,按模板填充。耗时 42 分钟,6 次因网络问题重试,但每个数据点都有引用来源。20/20 完整。
- Manus:在云端虚拟机里直接打开浏览器,访问 Amazon 各子页面。耗时 35 分钟,20/20 完整,附 5 个关联分析图表。消耗约 800 credits。
- Genspark:调用内置 AI Sheets 直接生成表格。耗时 15 分钟,最快,但数据是搜索摘要而非实时抓取。20/20 “完整”,但其中 4 个数据点有出入。
结论:Manus 最专业,Genspark 最快,Claude Cowork 最严谨,ChatGPT Work 最全能但额度消耗大。
场景 2:给客户写英文商务邮件
任务:写一封跟进上个月报价的英文商务邮件,语气专业但有温度,300 词以内。
- ChatGPT Work:3 秒输出,质量 7/10,措辞偏 AI 套话
- Claude Cowork:5 秒输出,质量 9/10,措辞更自然,但不会自动加签名
- Manus:需要先建任务(45 秒建任务 + 3 秒生成),质量 8/10,自动生成跟进时间表
- Genspark:2 秒输出,质量 7/10,能附 AI 翻译的中文版
结论:简单邮件 ChatGPT Work/Genspark 够用,重要邮件用 Claude Cowork。
场景 3:把一份中文会议纪要翻译成英文 PPT
任务:把一份 8000 字的中文会议纪要翻译成英文,并做成 12 页 PPT。
- ChatGPT Work:30 分钟,PPT 设计感强,自动配图,但有 2 处关键数据翻译错误
- Claude Cowork:45 分钟,翻译最准确,但 PPT 排版需要手动调整
- Manus:38 分钟,输出 PDF 格式的纪要 + 独立的 PPT,PPT 模板相对简单
- Genspark:22 分钟,AI Slides 一键生成,模板选择多,但英文表达偶有 Chinglish
结论:Genspark 最快,ChatGPT Work 最有设计感,Claude Cowork 翻译最准,Manus 最全面但需要后续编辑。
场景 4:搭建一个简单的英文 Landing Page
任务:为一款产品搭建英文 Landing Page,包含 hero、特性、定价、FAQ。
- ChatGPT Work:用 Sites 功能,25 分钟生成可发布网站,移动端适配好
- Claude Cowork:生成 HTML/CSS 代码,需要手动部署
- Manus:可直接部署到 manus.space 子域名,35 分钟全套搞定
- Genspark:用 Sparkpages 快速生成,但样式偏博客风不适合做产品页
结论:ChatGPT Work 和 Manus 的部署能力最强,Claude Cowork 输出代码但需要自己处理部署。
海外华人按场景选型:4 个推荐方案
测试完了,给海外华人按场景出 4 个具体方案:
方案 A:单人轻度使用(预算 $20/月以内)
推荐:ChatGPT Work Plus $20/月
Plus 套餐就够用 90% 的日常任务。写邮件、整理资料、查信息、做简单 PPT、生成网站——Work 一个工具覆盖。如果你已经用 ChatGPT Plus,几乎零迁移成本,直接在 Plus 套餐里开启 Work 模式即可。
方案 B:内容创作者 / 自由职业(预算 $50/月)
推荐:ChatGPT Work Plus $20/月 + Genspark Plus $24.99/月
Work 处理严肃办公任务(邮件、文档、信息整理),Genspark 处理内容产出(PPT、社交媒体图片、短视频脚本)。两个组合的内容生产能力比单 Manus 强,比单 ChatGPT Work 全面。
方案 C:研究 / 调研 / 咨询(预算 $40/月)
推荐:Manus Starter $19/月 + ChatGPT Work Plus $20/月
Manus 处理深度调研(市场分析、竞品研究、行业报告),Work 处理日常办公。Manus 的长任务能力和多模型路由,对需要做严肃研究的人来说是杀手锏。
方案 D:技术 / 编程 / 重度使用(预算 $200/月)
推荐:ChatGPT Work Pro $200/月 + Manus Pro $39/月
Work Pro 启用 Ultra 多代理模式处理复杂编程和数据分析任务,Manus Pro 做云端长任务(自动化脚本、定时抓取)。Claude Cowork Max $100/月 可作为第二选择——如果你本来就在 Claude 生态里。
数据主权与合规:海外华人最容易忽略的风险
这是海外华人最容易忽略的一点,也是选择 AI Agent 工具时必须考虑的:
- ChatGPT Work:OpenAI 美国公司,数据存美国,受美国法律管辖。如果你处理欧盟客户数据(GDPR),需要做数据保护评估。
- Claude Cowork:Anthropic 美国公司,相同问题。但 Anthropic 在欧盟有数据中心选项(Team/Enterprise 套餐可问)。
- Manus:新加坡数据路由,对中国和美国的合规要求都更友好。但新加坡本身不是 GDPR 认可的白名单,欧盟客户可能不接受。
- Genspark:美国公司,相同问题。但 Genspark 没有企业级合规认证(SOC 2、ISO 27001 待查),处理敏感数据需要谨慎。
实操建议:
- 日常个人数据用哪家都行,差别不大
- 工作场景涉及客户信息,优先选有 SOC 2 / ISO 27001 认证的工具
- 医疗、法律、金融等强监管行业,建议企业版并签署 DPA(数据处理协议)
- 海外华人在美国/加拿大:ChatGPT Work 或 Claude Cowork
- 海外华人在新加坡/马来西亚:Manus 数据路由最友好
- 海外华人在日本/韩国:Genspark 客服和模板最接地气
关于海外华人用 AI 工具的更多风险点,参考 在海外用AI踩过的10个坑。
结论:别只选一个,按场景组合用
写到这里,结论其实很简单:2026 年下半年,AI Agent 工具的最优解不是”选一个最好的”,而是”按场景组合用”。
我的最终建议:
- 学生 / 普通用户:ChatGPT Work Plus $20/月 + Manus Free 每日 300 credits。覆盖作业、翻译、日常办公。
- 职场人士:ChatGPT Work Plus $20/月 + Manus Starter $19/月。日常办公 + 深度研究,$39/月总成本合理。
- 创业团队:ChatGPT Work Pro $200/月 + Manus Business $199/月。Ultra 多代理 + 云端数字员工,能撑起小团队大部分自动化需求。
- 企业级 / 重度使用:ChatGPT Work Enterprise + Claude Cowork Team,按需添加 Genspark/Manaus 作为内容/调研补充。
最后多说一句。2026 年 7 月这波 AI Agent 战争,本质上跟 2023 年那波大模型战争、2024 年那波多模态战争一样,最终赢家不一定是技术最强的,而是最懂用户工作流的。对我们海外华人来说,这是好事——产品越多、竞争越激烈,工具就越便宜、越懂我们。
8 月份 GenSpark 即将发布 AI Agent 2.0,OpenAI 也在筹划 Work 的多语言优化,Anthropic 据传会推出 Cowork 自由职业者版。下半年的竞争只会更激烈。记住:工具是为工作服务的,不是反过来。先想清楚你要解决什么问题,再选工具。
本文发布于2026年7月14日,基于截至7月13日的公开信息整理。AI Agent 工具的定价、功能和可用性变化很快,建议以官方最新公告为准。本文由 AI工具派(aitoolpai.com)原创,海外华人AI工具实战指南,转载请保留出处。