定位:为编程 Agent 而生
官方对这条线的定义很聚焦:它不是一个通用的对话模型,而是「用工具探索代码库、编辑多个文件、驱动软件工程 Agent」的模型。文档反复强调的关键词是工具使用与跨文件编辑——这两件事恰恰是编程 Agent 与普通代码补全的分界线:补全只需要看当前文件,Agent 需要在仓库里四处查证,再把改动落到多个文件上。官方模型卡的用途一栏也写明是代码助手、代理式编程与软件工程任务。
编程 Agent 模型 · 开源权重免费下载自部署;托管接口版本已弃用,官方建议改用其通用模型档位。
DevstralDevstral 是 Mistral 的编程 Agent 模型线,为软件工程任务设计:擅长用工具探索代码库、跨多个文件编辑,并驱动编程 Agent。当前两档为 123B 的 Devstral 2 与 24B 的 Devstral Small 2,均支持 256K 上下文。

深度介绍
官方对这条线的定义很聚焦:它不是一个通用的对话模型,而是「用工具探索代码库、编辑多个文件、驱动软件工程 Agent」的模型。文档反复强调的关键词是工具使用与跨文件编辑——这两件事恰恰是编程 Agent 与普通代码补全的分界线:补全只需要看当前文件,Agent 需要在仓库里四处查证,再把改动落到多个文件上。官方模型卡的用途一栏也写明是代码助手、代理式编程与软件工程任务。
文档里当前的主力是两个版本。Devstral 2 是 123B 参数的前沿档,官方称它在软件工程任务上表现突出,模型标识为 devstral-2512,许可标注为修改版宽松许可。Devstral Small 2 是 24B 参数的开源档,模型标识为 labs-devstral-small-2512,许可为宽松开源许可,官方允许商用与修改。两档都提供 256K 上下文窗口,且都以 FP8 精度发布指令微调版本,官方说明这适合对话、代理与指令类场景。
模型卡里列了三项基准:Devstral 2 在 SWE-bench 验证集上为 72.2%、多语言版本为 61.3%、终端任务基准 2 为 32.6%;24B 的 Small 2 分别是 68.0%、55.7% 与 22.5%。官方在同一张表里列出了若干体量大得多的开源模型与闭源模型作对照,并注明对比数据来自各家的公开值。这里只保留它自己的三项数字——对要评估是否够用的团队,先看自己的任务更接近哪一项基准,比看总体排名有用。
24B 这一档的卖点是「轻」:官方说明它小到可以跑在单张消费级显卡或 32 GB 内存的电脑上,适合本地部署与端侧使用。作为对照,同一份模型卡给出的另一条信息是它基于一个 24B 的基础模型继续微调而来。对需要在内网、离线或隐私敏感环境里跑编程 Agent 的团队,这一档是整条线里最现实的选择;123B 档则更适合有集群或愿意走托管接口的场景。
官方把 Small 2 相对上一代的变化逐条列出,其中最容易忽略但很实用的一条是新增了视觉能力:模型可以分析图片并基于画面内容给出判断,而不只是处理文本。对编程 Agent 来说这意味着它能看截图与设计稿——比如照着界面截图上改样式,或从报错截图里读出信息。另外两条变化是整体性能提升,以及注意力机制上改用带缩放的位置编码与可扩展软最大化温度。
为了让它真正能干活,官方随新版一起放出了一个命令行工具,可以直接在终端里调用这条线的模型能力,安装方式是常见的脚本或包管理命令。除此之外,模型卡列出了多种可用的编码客户端脚手架,说明它并不是只能配自家工具使用。官方在首发时也把「加进你的模型选择器」写成了推荐用法——如果你已经在用某个编码客户端,通常只需要把服务地址与密钥指向它即可。
这是选型前必须知道的一条。官方文档把这条线上的多个托管版本都标记为已弃用,并给出了各自的弃用日期与替代型号——替代的是该公司的通用模型档位,而不是这条线的新版本。这意味着通过官方接口调用它的路径已经不再被推荐。相对地,开放权重版本仍可下载、可自部署,前面提到的宽松许可也没有变化。换句话说:想继续用它,就走自部署这条路。
这条线没有官方付费版:权重免费下载,成本只剩自有算力。首发版本当时给出的接口价格是每百万输入 token 0.1 美元、每百万输出 token 0.3 美元,与同期的通用小模型档位持平——这个数字现在只作为历史参考,因为对应接口版本已弃用。许可方面,开源档为宽松开源许可,允许商用与修改;大档标注为修改版宽松许可,模型卡里注明需要遵守随附条款,商用前建议直接读一遍原始许可文件。
产品特点
这条线的设计目标不是补全单行代码,而是让模型在仓库里用工具查证、然后同时改动多个文件。对要做议题自动修复或大规模重构的团队,这个取向比通用模型的代码能力更贴近实际需求。
24B 那一档官方明确说可以跑在单张消费级显卡或 32 GB 内存的设备上,同时保留 256K 上下文与视觉输入。这意味着隐私敏感的团队不必把代码送出去,也能用上代理式编程。
官方已经把多个托管版本标记弃用并指向通用模型替代,但开放权重版本的下载与许可没有收回。选型时这是一条清晰的分岔:要省事就换官方推荐的新档位,要保留这条线就走自部署。
开源档是标准的宽松开源许可,允许商用与修改;大档标注的是修改版宽松许可,附带条款需要自行核对。同一产品线两种许可并存,直接下载前先确认自己用的是哪一档,能避免后续的合规麻烦。
最近动态
核验时官方文档已把这条线上的托管版本全部标记为弃用,并给出各自的弃用日期与统一的替代型号。同时权重页面仍可正常访问,开源档的许可未变。因此本页按「权重仍可用、托管接口不再推荐」的口径撰写,并在按钮与参考里以模型文档与权重页为主,避免引导读者去调用已弃用的接口。
官方在十二月上旬发布了新一代的两个版本:123B 的前沿档与 24B 的开源档,均支持 256K 上下文并以 FP8 精度提供指令微调版本;小档相对上一代新增视觉能力、整体性能提升,并改用带缩放的位置编码与可扩展软最大化温度。同一次发布还配套放出了命令行工具,并列出多种可用的编码客户端脚手架。
这条线的首发是以研究预览的形式出现的:官方称它在同类开源模型里表现突出,并强调轻量到可以跑在单张消费级显卡或 32 GB 内存的设备上,适合本地部署与端侧使用,也适合在隐私敏感的企业代码库上做代理式编程。当时的接口价格与同期通用小模型持平,权重按宽松开源许可发布,并同步上架了多个本地模型分发渠道。
Devstral 是 Mistral 的编程 Agent 模型线。官方对它的定义很聚焦:用工具探索代码库、编辑多个文件、驱动软件工程 Agent——关键词是工具使用与跨文件编辑,这也是它区别于普通代码补全模型的分界线,补全只需看当前文件,Agent 要在仓库里查证再把改动落到多处。 当前主力是两个版本。Devstral 2 为 123B 参数的前沿档,模型标识 devstral-2512,许可标注为修改版宽松许可;Devstral Small 2 为 24B 参数的开源档,标识 labs-devstral-small-2512,宽松开源许可并允许商用与修改。两档都提供 256K 上下文,且以 FP8 精度发布指令微调版本。官方模型卡给出的基准成绩是:大档在 SWE-bench 验证集 72.2%、多语言版本 61.3%、终端任务基准 2 为 32.6%;小档分别为 68.0%、55.7% 与 22.5%。小档的另一组特点是轻与全:官方称它可以跑在单张消费级显卡或 32 GB 内存的设备上,相对上一代新增视觉能力、整体性能提升,并改用带缩放的位置编码与可扩展软最大化温度,其底座是一个 24B 的基础模型。 配套方面,官方随新版放出了一个可直接在终端调用该模型线的命令行工具,模型卡也列出多种可用的编码客户端脚手架,说明它不限于自家工具。首发时官方给出的接口价格为每百万输入 token 0.1 美元、每百万输出 token 0.3 美元,与同期通用小模型档位持平。 必须提醒的是当前状态:官方文档已把这条线上的多个托管版本标记为弃用,给出各自弃用日期,并把替代指向该公司的通用模型档位,而不是这条线的新版本——也就是说通过官方接口调用它已不再被推荐。但开放权重版本仍可下载自部署,许可也没有收回,其中的开源档允许商用与修改,大档则附带需要自行核对的修改版许可条款。想继续使用这条线,自部署是目前可行的路径。
核验信息
本页事实来自官方渠道:官网与产品页、Devstral 两档的模型文档(定位描述、版本与发布日期、模型标识、许可标注、256K 上下文、弃用状态与弃用日期与替代型号、功能清单),两个版本的权重页与模型卡(参数规模与 FP8 指令微调说明、三项基准的自家成绩与对照表口径、小档可单卡或 32GB 内存运行、新增视觉能力与注意力机制变化、底座模型、配套命令行工具与可用编码客户端脚手架、许可类型),以及首发公告(研究预览定位、轻量与本地部署口径、当时的接口价格、宽松许可与本地分发渠道)。页内只保留该模型自己的基准数字,未列出对照表中出现的第三方模型名称。价格与状态核验于 2026 年 9 月 22 日。
Devstral介绍页面对您是否有帮助?