市场格局与发展背景。自2022年底ChatGPT上线并迅速火爆以来,它一度在大型语言模型(LLM)市场占据主导地位。直到2023年3月Anthropic发布Claude,ChatGPT才迎来了真正的竞争对手。此后,两家公司不断升级模型并添加新功能。由于双方在代码生成和专属工作区模式上存在功能重叠,用户在选择时往往难以抉择。
模型准确率与幻觉表现。根据2026年8月8日由Manuviraj Godara发布的报道,在衡量AI准确率时,旗舰模型Claude Fable 5 (Max)以61%的得分略微领先于得分为59%的GPT 5.6 Sol (Max)。然而在处理日常任务的中端模型对比中,ChatGPT 5.6 Terra (46%)的表现优于Claude Sonnet 5 (38%)。在“模型幻觉”方面,Claude具有明显优势,其旗舰模型和中端模型的幻觉率均远低于同级别的ChatGPT模型。
独家功能与使用体验差异。Claude于2026年1月推出了Cowork功能,能够代为执行知识型任务,并支持通过“/”指令调用技能。其Artifacts功能可即时渲染代码片段、网页和交互组件。ChatGPT同样支持技能和类似功能,但多限于特定模式或企业内部使用,且无法像Claude那样通过连接器获取实时数据。不过,ChatGPT在语音自然度、实时视频辅助以及生成逼真图像方面的体验更胜一筹。
商业策略与用户选择倾向。2026年,ChatGPT的最新模型在部分基准测试中有所提升,但其幻觉率相比早期的GPT-4o不降反升,且OpenAI开始在免费版中引入广告。同年2月,Anthropic因拒绝其模型被用于大规模国内监控和全自主武器,未能与美国国防部达成合作;而OpenAI随后签署了相关替代协议。这一事件促使大量注重AI伦理的用户转向使用Claude。在定价方面,两者的付费套餐均涵盖了20美元至200美元不等的月度计划。
参考链接:
https://www.engadget.com/2229993/claude-vs-chatgpt-how-ai-assistants-differ/
热门跟贴