Mistral 发布 Mistral Medium 3.5 及云端异步智能体
Mistral Medium 3.5
Mistral 发布 128B 稠密模型 Mistral Medium 3.5,采用修改版 MIT 许可开放权重,SWE-Bench Verified 得分 77.6%,成为 Mistral Vibe 与 Le Chat 的默认模型。
原文给出具体跑分、定价和开放权重细节,能帮助读者评估这款 128B 模型在自托管与智能体场景的可用性。
思考
摘要
Mistral 已将编码智能体迁移至云端,通过 Mistral Medium 3.5 实现并行、异步的任务执行——这是一个全新的 128B 开放权重模型,专为长周期编码和生产力工作优化。此次更新在 Mistral Vibe 和 Le Chat 中引入了远程智能体,并新增 Work 模式,用于研究和跨工具工作流等多步骤任务,同时对敏感操作保留人工监督。Mistral Medium 3.5 即日起在 Pro、Team 和 Enterprise 套餐中提供,定价为每百万输入 token 1.5 美元、每百万输出 token 7.5 美元。
编码智能体大多一直运行在你的笔记本电脑上。今天,我们将它们迁移到云端,让它们自主运行、并行执行,并在完成后通知你。你可以从 Mistral Vibe CLI 或直接在 Le Chat 中启动它们,无需离开对话即可外包一项编码任务。
驱动这一切的是处于公开预览阶段的 Mistral Medium 3.5,它是我们在 Mistral Vibe 和 Le Chat 中新的默认模型,专为长时间运行编码和生产力工作而打造。Le Chat 中新的 Work 模式(预览版)通过一个强大的智能体对此进行了扩展,可处理研究、分析和跨工具操作等复杂的多步骤任务。
亮点。
Mistral Medium 3.5,一个新的旗舰模型,将指令遵循、推理和编码融合到一个 128B 稠密模型中。以开放权重形式发布,采用修改版 MIT 许可证。
在如此规模下具备强大的真实世界性能,可在少至四块 GPU 上自托管运行。
Mistral Vibe 远程智能体用于异步编码:会话在云端运行,可从 CLI 或 Le Chat 启动,本地 CLI 会话可传送至云端。
在 Le Chat 中启动 Mistral Vibe 编码任务。会话在相同的远程运行时上运行,并在你离开时继续进行。
Le Chat 中的 Work 模式运行在一个由 Mistral Medium 3.5 驱动的新智能体上,它可处理多步骤任务,并行调用工具直到任务完成。
Mistral Medium 3.5。
Mistral Medium 3.5 是我们的首个旗舰融合模型,现已公开预览。它是一个 128B 稠密模型,拥有 256k 上下文窗口,用单一权重集处理指令遵循、推理和编码。它在真实使用中表现强劲,少至四块 GPU 即可自托管。推理强度现在可按请求配置,因此同一模型既能回答快速聊天回复,也能完成复杂的智能体运行。我们从零训练了视觉编码器,以处理可变图像尺寸和宽高比。
Mistral Medium 3.5 在 SWE-Bench Verified 上得分 77.6%,领先于 Devstral 2 以及 Qwen3.5 397B A17B 等模型。它还具备强大的智能体能力,在 τ³-Telecom 上得分 91.4。




该模型专为长周期任务打造,能够可靠地调用多个工具,并生成可供下游代码消费的结构化输出。正是这个模型让 Vibe 中的异步云智能体得以实际落地。
Mistral Medium 3.5 成为 Le Chat 中的默认模型。它还取代了 Devstral 2,成为我们编码智能体 Vibe CLI 中的模型。
Vibe 远程智能体。
从今天起,编码会话可以在你离开时处理长任务。多个会话可以并行运行,你不再是智能体每一步的瓶颈。
你可以从 Mistral Vibe CLI 或 Le Chat 启动云端代理。在它们运行期间,你可以查看代理正在做什么,包括文件差异、工具调用、进度状态,以及过程中浮现的问题。正在进行的本地 CLI 会话可以在你想让它们继续运行时传送到云端,会话历史、任务状态和审批都会一并保留。

Vibe 位于系统工程团队已经在使用的系统之间,在需要的地方保留人工参与。它接入 GitHub 用于代码和拉取请求,接入 Linear 和 Jira 用于问题跟踪,接入 Sentry 用于事件,以及接入 Slack 或 Teams 等应用用于报告。
每个编码会话都在隔离的沙箱中运行,包括大范围的编辑和安装。工作完成后,代理可以在 GitHub 上打开拉取请求并通知你,这样你审查的是结果,而不是产生结果的每一次按键。
它适合那些量大、定义明确、占用开发者时间但不占用其判断力的工作:模块重构、测试生成、依赖升级、CI 调查,以及缺陷修复。
我们使用在 Mistral Studio 中编排的 Workflows 将 Mistral Vibe 引入 Le Chat。我们最初是为自己的内部编码环境构建它,然后为我们的企业客户构建。如今这项能力向所有人开放,任何人都可以从网页启动编码任务。而且由于不再受限于本地终端,开发者可以并行运行多个任务。
你可以直接在 Le Chat 中启动编码会话,这样在聊天中描述的任务会在与 CLI 和网页相同的远程运行时上运行,并在之后以完成的分支或草稿 PR 的形式返回。
Le Chat 中的新 Work 模式(预览版)。
Work 模式是 Le Chat 中用于复杂任务的强大新代理模式,由新的 harness 和 Mistral Medium 3.5 驱动。代理成为助手本身的执行后端,因此 Le Chat 可以读写、同时使用多个工具,并推进多步骤项目,直到完成你的要求。
以下是 Work 模式目前能让你做的事情。
跨工具工作流:在一次运行中处理电子邮件、消息和日历;利用参会者背景、最新新闻以及从你的来源中提取的谈话要点来准备会议。
研究与综合:深入探索网络、内部文档和已连接工具中的某个主题,然后生成一份结构化的简报或报告,你可以在导出或发送前进行编辑。
分拣收件箱并起草回复;根据团队和客户讨论在 Jira 中创建问题;在 Slack 上向团队发送摘要。
会话的持续时间比典型的聊天回复更长,因此代理可以跨多轮持续进行,通过反复试验,直到完成。在 Work 模式中,连接器默认开启,而不是手动选择,这让代理可以访问文档、邮箱、日历和其他系统,以获取采取正确行动所需的丰富上下文。
代理采取的每一个操作都是可见的:你可以看到每次工具调用和思考依据。Le Chat 会在执行发送消息、写入文档或修改数据等敏感任务之前,根据你的权限请求明确批准。
开始使用。
Mistral Medium 3.5 今日已在 Mistral Vibe 和 Le Chat 中上线,并为 Pro、Team 和 Enterprise 套餐中的 Le Chat 远程编码代理和 Work 模式提供支持。
通过 API,其定价为每百万输入 token 1.5 美元,每百万输出 token 7.5 美元。开放权重已在 Hugging Face 上以修改版 MIT 许可证发布。
它还可在 build.nvidia.com 上用于原型设计,托管于 NVIDIA GPU 加速端点,并作为可扩展的容器化推理微服务 NVIDIA NIM 提供。
与我们一起构建代理系统的未来。
我们正在研究、工程和产品部门招聘,以进一步推动代理系统的发展。查看我们的开放职位。
来源:Mistral AI:News(网页) · mistral.ai