AGI Hunt· Kuprel·2026-10-07 11:53· 4 小时前AI 评分34开发者实测:Claude 跑分更优,Codex 却更懂我要什么开发者实测:Claude 跑分更优,Codex 却更懂我要什么AI 导读开发者 Kuprel 表示,Claude 在基准测试中表现更好,但实际使用中 OpenAI 的 Codex 更擅长完成他真正想做的事情。这条体感反馈呼应了社区常见观点:基准成绩与真实工程任务中的实际可用性并不总是一致。来源:AGI Hunt · agihunt.info#大佬观点#编码#OpenAI#Anthropic查看事件全部后续