ChatGPT vs Claude vs Grok vs Gemini: The Best AI for 10 Use Cases (August 2026)
PeterYangYT · 2026-08-27

ChatGPT 在 10 个常见场景中赢了 6 个,成为全能冠军;Claude 在设计和规划上仍是最强,Grok 和 Gemini 则各有惊喜。
几个月前,作者还只用 Claude 处理一切,但现在,AI 工具的选择已经变成一道“看场景下菜”的复杂题。这期视频把 ChatGPT、Claude、Grok、Gemini 拉到同一张工作台上,用 10 个真实场景逐一实测,从设计、写作到浏览器自动化,直接告诉你每个场景下谁才是真正能帮你干活的那个。
设计:Claude 依然是王者,但 Grok 的进步让人意外
同一个“设计菜谱 App”的指令,四款模型交出的答卷天差地别。ChatGPT 最基础,Gemini 有边框问题,而 Grok 成了黑马。
- Claude Design 是加分项:它会在动手前先问澄清问题(比如“谁是用户?”“‘发现’是什么意思?”),让设计更贴合需求,这是其他三家都没有的步骤。
- 做幻灯片和视频,Claude 是首选:用 HTML 加技能(Skill)生成幻灯片,Claude 的图表更精致、还带动画;Claude Fable 甚至能根据文字指令生成完整的动画产品发布视频,作者认为 AI 视频编辑大概 3 个月后就能完成专业剪辑师 90% 的工作。
日常问答与写作:ChatGPT 靠“性格”翻盘
Claude 的“人味”在 Opus 4.6 之后就开始走下坡路,Opus 5 变得爱说教,还满嘴“Claude 腔”。相比之下,ChatGPT 改掉了以前每句话结尾都要问“要不要我帮你做 X”的假客气,现在聊起来更像一个正常人。
- 用自定义指令调教 AI:作者在 ChatGPT 里加了三条指令——“有话直说,别拍马屁”“用主动语态,别啰嗦”“禁用‘delve’‘foster’这类 AI 黑话”,效果立竿见影。
- 写作技能(Skill)是核心:作者用自己训练的“Newsletter 技能”来编辑初稿,它会严格遵循作者的文风,并在最后给自己的“声音、钩子、内容、回报”打分,虽然分数总是 36-38 分,但确实能保证输出不走样。
规划与编码:Claude 负责想,ChatGPT 负责干
在制定战略决策时,作者依然首选 Claude Fable,因为它更“聪明”。但在编码上,情况完全反转。
- ChatGPT 的“浏览器使用”能力是杀手锏:它能自己打开浏览器测试产品、修复 bug,直到功能跑通为止,而且能处理超长对话不混乱。作者的朋友、一位前 L8 工程师则认为 GPT-4o 和 Opus 都容易过度设计,他反而推荐用 Grok 做更快速、更精准的代码修改。
- 浏览器自动化是隐藏的王者:一位 OpenAI 员工用 ChatGPT 的浏览器功能,几分钟就整理好了一份需要数天才能完成的移民申请材料包。作者自己也用它来管理社交媒体,能自动理解“在 X 上要 @GrokBot,但在 LinkedIn 上不用”这种细节。
带走一句话
“谁赢了个人 Agent 这场竞赛,谁就赢得了 AI 消费者注意力的最大份额。”
- 别迷信单一模型:把任务分类,用 Claude 做规划和设计,用 ChatGPT 做编码和日常问答,用 Gemini 做视频生成,效率远高于只用一家。
- 用“技能”和“自定义指令”驯服 AI:像作者一样,把个人风格和偏好写成指令或技能文件,能有效避免 AI 的“机器味”,让输出更贴近你的需求。
