Google DeepMind 与 Accenture、Bain、BCG、Deloitte、McKinsey 合作加速企业 AI 转型
Google DeepMind 与 Accenture、Bain & Company、BCG、Deloitte、McKinsey 合作,帮助各行业规模化采用前沿 AI,覆盖金融、制造、零售、媒体娱乐等领域。
Google DeepMind 与 Accenture、Bain & Company、BCG、Deloitte、McKinsey 合作,帮助各行业规模化采用前沿 AI,覆盖金融、制造、零售、媒体娱乐等领域。
Google 在 Google Labs 上线研究实验 Vantage,用生成式 AI 搭建多角色模拟对话,评估高中生与大学生面向未来的技能(批判性思维、协作、创造性思维)。
Google Research 提出 ConvApparel 数据集,用 4000+ 段、近 15000 轮服装购物人机对话量化并弥合 LLM 用户模拟器的真实感差距。
Mistral AI 发布 Spaces CLI,用 spaces init、cd、spaces dev 三条命令即可从零得到带热重载、数据库和自动生成 Dockerfile 的多服务项目。
推荐理由:Mistral 把 CLI 同时服务人类与编码智能体的设计原则整理成检查清单,可对照改造自家开发者工具。
Google Research 在 The Check Up 公布医疗 AI 多项进展,其中与 Fitbit 合作的 Personal Health Agent(PHA)研究发现,模拟协作医疗团队的 PHA 比单任务健康应用更能支持长期健康。
Mistral AI 推出 Forge,一套让企业用自有专有知识训练前沿级模型的系统,覆盖预训练、后训练与强化学习,支持稠密与 MoE 架构。Forge 按 agent 优先设计,Mistral Vibe 等智能体可用自然语言完成微调、超参数搜索与数据合成。合作方包括 ASML、Ericsson、欧洲空间局、新加坡 HTX 与 Reply。
Mistral 基于其开源编码助手 Vibe 构建了一个自动为 Rails 代码库生成和改进 RSpec 测试的智能体,可在 CI/CD 中无人干预运行。该智能体依靠仓库级 AGENTS.md 执行计划、按文件类型拆分的 Skills 文件,以及 RuboCop 与 SimpleCov 自定义工具完成生成、校验和自校正。
Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动。2.0 新增自定义子智能体、多选澄清、斜杠命令技能、统一智能体模式与自动更新,已在 Le Chat Pro 和 Team 套餐上线,超出额度可按量付费或自带 API key。
推荐理由:原文列出 Vibe 2.0 新增的子智能体、斜杠命令技能等控制项与定价变化,可供判断终端编码智能体的使用成本。
Mistral AI 发布新一代编码模型系列 Devstral 2,包含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,两者均开源,分别采用修改版 MIT 和 Apache 2.0 许可。
推荐理由:材料给出 Devstral 2 在 SWE-bench Verified 上 72.2% 的成绩,并附上与 DeepSeek V3.2、Claude Sonnet 4.5 的人工评测胜负对比。
Mistral AI 发布 Mistral AI Studio,一个由 Observability、Agent Runtime 和 AI Registry 三大支柱组成的生产级 AI 平台。
Mistral 发布 Codestral 25.08 及配套企业编码栈,涵盖补全、语义检索、智能体工作流和 Mistral Code IDE 插件,今日起可用于企业部署。
Mistral 为 Le Chat 推出一批新功能,包括 Deep Research(预览)、语音模式、原生多语言推理、Projects 和图像编辑。Deep Research 由工具增强的研究 agent 驱动,可产出带引用的结构化报告;语音模式基于新语音模型 Voxtral,推理能力来自 Magistral 模型。
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并将 Devstral Small 升级到 1.1,两款模型都强调对不同提示词和智能体框架的泛化能力。
推荐理由:官方给出两款编码智能体模型的 SWE-Bench 分数与 API 定价,便于比较开源与商业方案的成本性能。
Mistral 发布 Agents API,把自家语言模型与代码执行、网页搜索、图像生成、MCP 工具等内置连接器以及跨对话持久记忆、多智能体编排结合起来。官方称启用网页搜索后,Mistral Large 与 Mistral Medium 在 SimpleQA 基准上的得分分别为 75% 和 82.32%,未启用时为 23% 和 22.08%。
推荐理由:原文列出内置连接器、持久记忆与多智能体编排的具体能力和示例,可据此判断它适合哪类智能体工作流。
Mistral AI 与 All Hands AI 合作发布面向软件工程任务的智能体模型 Devstral,以 Apache 2.0 许可开源,在 SWE-Bench Verified 上得分 46.8%,超过此前开源 SoTA 6 个百分点以上。
推荐理由:给出同框架模型对比数据、单卡部署门槛与 API 价格,可帮助判断开源编码智能体当前的能力水位与落地条件。
Mistral AI 推出企业级 AI 助手 Le Chat Enterprise,由全新的 Mistral Medium 3 模型驱动。新方案提供企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署,功能将在未来两周内陆续上线。
Mistral AI 的 TranscriptToPRDTicket 智能体工作流由 Mistral Large 2 驱动,可把会议转录自动生成 PRD 和开发工单,并写入 Linear、Jira 等项目管理工具。
Spotify 基于 TF-Agents Environment 原语构建离线模拟器,用 Keras 训练的用户模型预测用户对推荐曲目的反应。团队训练并评估了顺序推荐模型、PPG、DQN 和改进的 Action-Head DQN(AH-DQN),以应对大状态与动作空间。线上实验显示离线性能估计与线上结果强相关。