Mistral AI 发布 Devstral Medium 并升级 Devstral Small 1.1
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并将 Devstral Small 升级到 1.1,两款模型都强调对不同提示词和智能体框架的泛化能力。
推荐理由:官方给出两款编码智能体模型的 SWE-Bench 分数与 API 定价,便于比较开源与商业方案的成本性能。
让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并将 Devstral Small 升级到 1.1,两款模型都强调对不同提示词和智能体框架的泛化能力。
推荐理由:官方给出两款编码智能体模型的 SWE-Bench 分数与 API 定价,便于比较开源与商业方案的成本性能。
Mistral 发布 Agents API,把自家语言模型与代码执行、网页搜索、图像生成、MCP 工具等内置连接器以及跨对话持久记忆、多智能体编排结合起来。官方称启用网页搜索后,Mistral Large 与 Mistral Medium 在 SimpleQA 基准上的得分分别为 75% 和 82.32%,未启用时为 23% 和 22.08%。
推荐理由:原文列出内置连接器、持久记忆与多智能体编排的具体能力和示例,可据此判断它适合哪类智能体工作流。
Mistral AI 与 All Hands AI 合作发布面向软件工程任务的智能体模型 Devstral,以 Apache 2.0 许可开源,在 SWE-Bench Verified 上得分 46.8%,超过此前开源 SoTA 6 个百分点以上。
推荐理由:给出同框架模型对比数据、单卡部署门槛与 API 价格,可帮助判断开源编码智能体当前的能力水位与落地条件。