跳到正文
原文
AGI Hunt· GuillaumeLample·· 3 小时前AI 评分50

Mistral ML4 人评多项超越 GLM 5.3

Mistral 大模型人评多项超越 GLM 5.3

AI 导读

Mistral ML4 在人类评估中于 STEM、CAD 和金融任务上超越 GLM 5.3,智能体编码与其持平。ML4 在 DeepSWE、AutomationBench、AA-Briefcase 等基准上追平最强开源模型。其在金融与法律工作流及复杂多模态任务上取得 SOTA,可跨表格与幻灯片工作。

来源:AGI Hunt · agihunt.info