← Blog

ChatGPT、Claude 与 Gemini:应该如何选择?

按实际任务比较 ChatGPT、Claude 和 Gemini,并通过可重复测试选择适合自己的 AI 助手。

ChatGPT、Claude 和 Gemini 都是持续快速更新的通用 AI 助手。固定排名很快就会过时,而且最佳选择往往取决于具体任务,而不是某个单一基准分数。更可靠的方式,是了解产品层面的差异,再使用自己的提示词进行测试。

不要只比较回答文字

回答质量固然重要,但上下文长度、文件支持、产品集成、响应速度和套餐中可用的模型版本也会影响使用体验。比较时应记录每个回答所使用的模型和账户套餐,否则可能会把免费层模型与高级模型进行不公平比较。

写作与编辑

可以给三个助手同一份真实草稿和明确的风格要求,观察它们是否保留原意、删除重复内容并遵循语气限制。不要只看语言是否流畅,还要检查改写过程中有没有加入原文不存在的事实。

Claude 经常被用于长文写作,ChatGPT 适合灵活迭代,Gemini 则可能适合与 Google 产品相关的工作流。但这些只能作为测试起点,并不是适用于所有人的结论。

研究与摘要

向每个模型提供同样的材料,并要求生成带有明确原文依据的结构化摘要。评价它是否覆盖重点、保持事实一致,以及是否说明不确定之处。如果服务使用联网搜索,应区分在线找到的信息和基于上传材料得出的结论。

编程与技术任务

使用带测试、限制和既有代码风格的小任务进行比较。不要只判断代码看起来是否合理,还要实际运行测试、检查边界情况,并查看模型能否解释方案取舍。最擅长生成新函数的模型,不一定最擅长调试大型代码库。

公平比较的步骤

  1. 编写一个具有明确输出格式的提示词。
  2. 不做修改地发送给三个服务。
  3. 使用准确性和指令遵循评分表。
  4. 使用至少五个日常工作中的真实任务重复测试。
  5. 模型更新后重新进行评估。

AI ChatHub 可以帮助你在 ChatGPT、Claude 和 Gemini 官方网站中准备相同提示词。更完整的方法请阅读如何并排比较多个 AI 模型