AI工具AI评分 一般 (51)AI 中文改写

Claude与ChatGPT:AI助手差异对比

4 小时前 2 阅读来源:engadget.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

ChatGPT和Claude,这两大AI助手的对决一直是科技圈的热门话题。对很多用户来说,日常用哪个似乎差别不大——都能写代码、答问题、总结文档、整理文件,甚至模仿麦尔维尔风格写点“深度思考”文章。但一旦涉及更专业的需求,两者之间的差异就开始显现了。最近,Engadget发布了一篇详细的对比评测,从准确性、功能特性到适用场景,帮用户理清思路。 先说准确性。评测引用了AA-Omniscience Accuracy基准测试,在旗舰模型层面,Claude Fable 5(Max版)以61%的准确率略胜ChatGPT 5.6 Sol(Max版)的59%。这个差距在日常使用中几乎感知不到。但如果你用的是中端模型——大多数人的实际选择——情况就反转了:ChatGPT 5.6 Terra(Max)得分46%,而Claude Sonnet 5(Max)只有38%。更关键的是“幻觉率”指标(即模型不懂装懂、胡编乱造的概率),Claude优势明显:旗舰模型Fable 5的幻觉率仅55%,远低于ChatGPT 5.6 Sol的89%;中端模型差距更大,Sonnet 5为37%,而Terra高达85%。这意味着在需要高可信度的场景下,Claude更“老实”,不懂就说不懂,而不是瞎编。 功能上的差异则更体现定位不同。根据Anthropic 2026年3月的经济指数报告,Claude对话中45%用于工作、42%用于个人事务;而OpenAI的数据显示,ChatGPT有70%的使用场景与工作无关。这背后是产品设计的侧重:Claude的Cowork功能(2026年1月上线)能代理执行知识型任务,比如整理文件;还支持通过“/”命令在对话中调用技能包(Skills),并且这些技能能在聊天、Cowork和Claude Code中通用。Claude的Artifacts功能可以实时渲染代码片段、单页HTML网站、交互式React组件和图表,还能通过连接应用和MCP协议拉取实时数据并发布到网页上。相比之下,ChatGPT的Skills仅限Codex和API的单个用户使用,不支持常规聊天;其对应Artifacts的Sites功能则主要面向企业内部使用,仅限Codex环境,且无法获取实时数据。 对中国跨境电商卖家和AI从业者来说,这个对比的实际意义在于:如果你的业务高度依赖AI处理文档、生成代码、分析数据,且对“胡说八道”零容忍,Claude在准确性和可靠性上更稳妥;如果你需要的是一个全能型助手,日常问答、头脑风暴、内容创作占比更高,ChatGPT的灵活性和生态成熟度可能更顺手。当然,两者都在快速迭代,最终选择还是要结合具体工作流来测试——毕竟,工具是死的,用法是活的。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · engadget.com

内容版权归原作者及 engadget.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容