跳到正文
原文
AGI Hunt· Kuprel·· 4 小时前AI 评分34

开发者实测:Claude 跑分更优,Codex 却更懂我要什么

开发者实测:Claude 跑分更优,Codex 却更懂我要什么

AI 导读

开发者 Kuprel 表示,Claude 在基准测试中表现更好,但实际使用中 OpenAI 的 Codex 更擅长完成他真正想做的事情。这条体感反馈呼应了社区常见观点:基准成绩与真实工程任务中的实际可用性并不总是一致。

来源:AGI Hunt · agihunt.info