MODEL ANALYSIS

Mistral Small 3

Mistral Small 3(Mistral)公开数据详情:智能指数 6.7(v4.3 · 历史参考)、生成速度 145.5 Token/s、上下文 32,000 Token。评测来源 Artificial Analysis;规格来源 Artificial Analysis,快照 2026-09-20;各字段保留原始来源与观测时间。

数据快照:2026-09-20查看原始来源 ↗
智能指数 · v4.3 · 历史参考6.7*暂无排名
生成速度145.5Token/s
API 价格当前 API 未核实 · Artificial Analysis model aggregate 历史输入 $0.1 / 输出 $0.3(2026-07-21)
单任务成本 · 历史参考来源未提供可比较价格
单任务输出 · 历史参考Token

评测按字段保留来源版本与观测时间。Intelligence Index v4.3 观测于 2026-09-09T14:00:04.717Z。 单任务成本、Token 与完整评测成本仍为此前快照参考,不代表新版评测或当前 API 报价。详情可在指标历史核对。

模型概览

Mistral Small 3 的 Intelligence Index v4.3 · 历史参考 为 6.7(估算值),生成速度为 145.5 Token/s,历史完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性;旧成本未与新版指数绑定,不能合并成单一“最好”结论。

技术规格

机构
Mistral
发布日期
2025-01-30
推理类型
非推理模型
模型权重
开放权重
参数规模
24B
权重许可
Apache 2.0
上下文窗口
32,000 Token
输入模态
文本
输出模态
文本
性能来源
Mistral

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据;历史参考配置可在“历史”或“全部”中查看。

0 / 654 个模型 · 正在载入全量数据

仅比较 v4.3 · 历史参考 的精确同版本观测;不跨方法版本排序。估算指数保留来源的暂定性质。

智能指数模型比较;当前显示 0 个模型。

    没有符合当前筛选条件且包含该指标的模型

    INTELLIGENCE

    Artificial Analysis 智能指数 · v4.3 · 历史参考

    v4.3 是历史完整方法,按 Agent、编码、通用与科学推理四类能力组合。仅在同版本内比较;数值越高越好。本页配置原观测于 2026-09-09T14:00:04.717Z。蓝色代表当前模型。 查看方法与可比边界 →

    模型智能指数对比 · v4.3 · 历史参考
    模型智能指数对比 · v4.3 · 历史参考;公开数据07.3Kimi Linear 48B A3B Instruct(估算): 7.3;KimiKimi Linear 48B A3B Instruct(…7.3R1 1776(估算): 6.4;PerplexityR1 1776(估算)6.4Llama 3.2 90B (Vision)(估算): 6.4;MetaLlama 3.2 90B (Vision)(估算)6.4DeepHermes 3 - Mistral 24B(估算): 6.1;Nous ResearchDeepHermes 3 - Mistral 24B(估算)6.1Phi-4 Multimodal(估算): 5.8;MicrosoftPhi-4 Multimodal(估算)5.8Molmo 7B-D(估算): 5.6;Allen Institute for AIMolmo 7B-D(估算)5.6DeepHermes 3 - Llama-3.1 8B(估算): 5.1;Nous ResearchDeepHermes 3 - Llama-3.1 8B(估…5.1
    查看图表数据
    项目数值
    Kimi Linear 48B A3B Instruct(估算)7.3
    R1 1776(估算)6.4
    Llama 3.2 90B (Vision)(估算)6.4
    DeepHermes 3 - Mistral 24B(估算)6.1
    Phi-4 Multimodal(估算)5.8
    Molmo 7B-D(估算)5.6
    DeepHermes 3 - Llama-3.1 8B(估算)5.1

    INTELLIGENCE BREAKDOWN

    组成评测 · v4.3 · 历史参考

    仅展示该版本逐项核实的原始指标;缺少同版本观测的字段不从历史回填。 Elo、指数与通过率不能当作同一量纲排序;幻觉率越低越好。

    Mistral Small 3 的分项原始指标
    指标原始成绩
    AA-LCR v1.10.0%
    Humanity's Last Exam3.8%

    CONTEXT WINDOW

    上下文窗口

    上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

    上下文窗口对比
    上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.2 (xhigh): 1,048,576 Token;MetaMuse Spark 1.2 (xhigh)1,048,576 TokenKimi K3 (low): 1,048,576 Token;KimiKimi K3 (low)1,048,576 TokenSolar Open2 250B: 1,048,576 Token;UpstageSolar Open2 250B1,048,576 TokenKimi K3 (max): 1,048,576 Token;KimiKimi K3 (max)1,048,576 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Opus 5 (xhigh): 1,000,000 Token;AnthropicClaude Opus 5 (xhigh)1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenGLM-5.3-Flash: 1,000,000 Token;Z AIGLM-5.3-Flash1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenClaude Opus 5 (low): 1,000,000 Token;AnthropicClaude Opus 5 (low)1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNemotron 3 Nano: 1,000,000 Token;NVIDIANemotron 3 Nano1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (max)1,000,000 Token
    查看图表数据
    项目数值
    Llama 4 Scout10,000,000 Token
    Muse Spark 1.2 (xhigh)1,048,576 Token
    Kimi K3 (low)1,048,576 Token
    Solar Open2 250B1,048,576 Token
    Kimi K3 (max)1,048,576 Token
    MiMo-V2.5-Pro1,000,000 Token
    Nova 2.0 Omni (medium)1,000,000 Token
    Gemini 3.5 Flash (minimal)1,000,000 Token
    GPT-5.6 Luna (low)1,000,000 Token
    GPT-5.6 Sol (low)1,000,000 Token
    Gemini 3.5 Flash-Lite1,000,000 Token
    Inkling1,000,000 Token
    Claude Opus 5 (xhigh)1,000,000 Token
    Claude Sonnet 5 (low)1,000,000 Token
    GLM-5.3-Flash1,000,000 Token
    Nova 2.0 Omni1,000,000 Token
    Claude Opus 5 (low)1,000,000 Token
    MiMo-V2.51,000,000 Token
    Nemotron 3 Nano1,000,000 Token
    Claude Sonnet 5 (max)1,000,000 Token

    OUTPUT SPEED

    回答生成速度

    模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

    输出速度对比
    输出速度对比;公开数据01,574.3 Token/sCeleris-1: 1,574.3 Token/s;CelerisCeleris-11,574.3 Token/sMercury 2: 1,004.5 Token/s;InceptionMercury 21,004.5 Token/sLing 3.0 Flash: 385.3 Token/s;InclusionAILing 3.0 Flash385.3 Token/sHyperNova 60B 2605: 365.7 Token/s;Multiverse ComputingHyperNova 60B 2605365.7 Token/sLFM2.5-VL-1.6B: 359 Token/s;Liquid AILFM2.5-VL-1.6B359 Token/sGemini 3.5 Flash-Lite: 352.7 Token/s;GoogleGemini 3.5 Flash-Lite352.7 Token/sLFM2.5-8B-A1B: 338.6 Token/s;Liquid AILFM2.5-8B-A1B338.6 Token/sNemotron 3 Nano Omni 30B A3B: 327.6 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B327.6 Token/sGemini 3.7 Flash (high): 321.9 Token/s;GoogleGemini 3.7 Flash (high)321.9 Token/sGemini 3.7 Flash (low): 319.6 Token/s;GoogleGemini 3.7 Flash (low)319.6 Token/sGemini 3.7 Flash (medium): 318.2 Token/s;GoogleGemini 3.7 Flash (medium)318.2 Token/sNova Micro: 306.7 Token/s;AmazonNova Micro306.7 Token/sNemotron 3.5 Lightning: 293.2 Token/s;NVIDIANemotron 3.5 Lightning293.2 Token/sCommand A+: 268.8 Token/s;CohereCommand A+268.8 Token/sQwen3.5 Omni Flash: 249.9 Token/s;AlibabaQwen3.5 Omni Flash249.9 Token/sDeepSeek V4 Flash: 232.3 Token/s;DeepSeekDeepSeek V4 Flash232.3 Token/sNemotron 3 Nano: 221.7 Token/s;NVIDIANemotron 3 Nano221.7 Token/sGranite 4.2 3B: 219.8 Token/s;IBMGranite 4.2 3B219.8 Token/sNemotron 3 Nano: 218.7 Token/s;NVIDIANemotron 3 Nano218.7 Token/sNVIDIA Nemotron Nano 9B V2: 203.9 Token/s;NVIDIANVIDIA Nemotron Nano 9B V2203.9 Token/s
    查看图表数据
    项目数值
    Celeris-11,574.3 Token/s
    Mercury 21,004.5 Token/s
    Ling 3.0 Flash385.3 Token/s
    HyperNova 60B 2605365.7 Token/s
    LFM2.5-VL-1.6B359 Token/s
    Gemini 3.5 Flash-Lite352.7 Token/s
    LFM2.5-8B-A1B338.6 Token/s
    Nemotron 3 Nano Omni 30B A3B327.6 Token/s
    Gemini 3.7 Flash (high)321.9 Token/s
    Gemini 3.7 Flash (low)319.6 Token/s
    Gemini 3.7 Flash (medium)318.2 Token/s
    Nova Micro306.7 Token/s
    Nemotron 3.5 Lightning293.2 Token/s
    Command A+268.8 Token/s
    Qwen3.5 Omni Flash249.9 Token/s
    DeepSeek V4 Flash232.3 Token/s
    Nemotron 3 Nano221.7 Token/s
    Granite 4.2 3B219.8 Token/s
    Nemotron 3 Nano218.7 Token/s
    NVIDIA Nemotron Nano 9B V2203.9 Token/s
    单次 Intelligence 任务耗时
    单次 Intelligence 任务耗时;公开数据060.9 秒Celeris-1: 9 秒;CelerisCeleris-19 秒Llama 4 Scout: 10 秒;MetaLlama 4 Scout10 秒GPT-5.5 Instant (June 2026): 17.4 秒;OpenAIGPT-5.5 Instant (June 2026)17.4 秒gpt-oss-120b (low): 19 秒;OpenAIgpt-oss-120b (low)19 秒GPT-5.6 Luna (Non-reasoning): 20.8 秒;OpenAIGPT-5.6 Luna (Non-reasoning)20.8 秒GPT-5.6 Luna (low): 22.4 秒;OpenAIGPT-5.6 Luna (low)22.4 秒Llama 4 Maverick: 23 秒;MetaLlama 4 Maverick23 秒GPT-5.6 Terra (low): 24 秒;OpenAIGPT-5.6 Terra (low)24 秒GPT-5.6 Terra (Non-reasoning): 24.3 秒;OpenAIGPT-5.6 Terra (Non-reasoning)24.3 秒Mercury 2: 28.1 秒;InceptionMercury 228.1 秒GPT-5.6 Sol (Non-reasoning): 33.7 秒;OpenAIGPT-5.6 Sol (Non-reasoning)33.7 秒GPT-5.6 Luna (medium): 35.1 秒;OpenAIGPT-5.6 Luna (medium)35.1 秒GPT-5.6 Sol (low): 37.9 秒;OpenAIGPT-5.6 Sol (low)37.9 秒Gemini 3.5 Flash-Lite: 38.4 秒;GoogleGemini 3.5 Flash-Lite38.4 秒Gemini 3.7 Flash (low): 42.5 秒;GoogleGemini 3.7 Flash (low)42.5 秒GPT-5.6 Terra (medium): 44.3 秒;OpenAIGPT-5.6 Terra (medium)44.3 秒Devstral Small 2: 47.6 秒;MistralDevstral Small 247.6 秒Granite 4.2 3B: 52.7 秒;IBMGranite 4.2 3B52.7 秒Gemma 4 31B: 57.2 秒;GoogleGemma 4 31B57.2 秒Qwen3.5 122B A10B: 60.9 秒;AlibabaQwen3.5 122B A10B60.9 秒
    查看图表数据
    项目数值
    Celeris-19 秒
    Llama 4 Scout10 秒
    GPT-5.5 Instant (June 2026)17.4 秒
    gpt-oss-120b (low)19 秒
    GPT-5.6 Luna (Non-reasoning)20.8 秒
    GPT-5.6 Luna (low)22.4 秒
    Llama 4 Maverick23 秒
    GPT-5.6 Terra (low)24 秒
    GPT-5.6 Terra (Non-reasoning)24.3 秒
    Mercury 228.1 秒
    GPT-5.6 Sol (Non-reasoning)33.7 秒
    GPT-5.6 Luna (medium)35.1 秒
    GPT-5.6 Sol (low)37.9 秒
    Gemini 3.5 Flash-Lite38.4 秒
    Gemini 3.7 Flash (low)42.5 秒
    GPT-5.6 Terra (medium)44.3 秒
    Devstral Small 247.6 秒
    Granite 4.2 3B52.7 秒
    Gemma 4 31B57.2 秒
    Qwen3.5 122B A10B60.9 秒

    LATENCY

    首个回答 Token 等待

    推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

    首个回答 Token:输入处理与推理等待
    输入处理推理等待
    首个回答 Token:输入处理与推理等待Celeris-1: 0.6 秒Celeris-10.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒DeepSeek V4 Flash: 0.7 秒DeepSeek V4 Flash0.7 秒Qwen3.5 4B: 0.7 秒Qwen3.5 4B0.7 秒Gemma 4 E4B: 0.7 秒Gemma 4 E4B0.7 秒Grok 4.3 (Non-reasoning): 0.7 秒Grok 4.3 (Non-reasoning)0.7 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Ministral 3 8B: 0.8 秒Ministral 3 8B0.8 秒Mistral Small 3: 0.8 秒Mistral Small 30.8 秒
    查看图表数据
    项目合计输入处理推理等待
    Celeris-10.6 秒0.6 秒0 秒
    Ministral 3 3B0.6 秒0.6 秒0 秒
    DeepSeek V4 Flash0.7 秒0.7 秒0 秒
    Qwen3.5 4B0.7 秒0.7 秒0 秒
    Gemma 4 E4B0.7 秒0.7 秒0 秒
    Grok 4.3 (Non-reasoning)0.7 秒0.7 秒0 秒
    Granite 4.1 8B0.8 秒0.8 秒0 秒
    Llama 4 Scout0.8 秒0.8 秒0 秒
    Ministral 3 8B0.8 秒0.8 秒0 秒
    Mistral Small 30.8 秒0.8 秒0 秒

    END-TO-END RESPONSE TIME

    端到端响应时间

    按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

    输出 500 Token 的完整响应时间
    输入处理推理生成 500 Token
    输出 500 Token 的完整响应时间Celeris-1: 0.9 秒Celeris-10.9 秒Nova Micro: 2.5 秒Nova Micro2.5 秒Gemini 3.7 Flash (low): 2.5 秒Gemini 3.7 Flash (low)2.5 秒LFM2.5-VL-1.6B: 2.7 秒LFM2.5-VL-1.6B2.7 秒DeepSeek V4 Flash: 2.8 秒DeepSeek V4 Flash2.8 秒Nemotron 3 Nano: 3.2 秒Nemotron 3 Nano3.2 秒Ministral 3 3B: 3.5 秒Ministral 3 3B3.5 秒Gemini 3.5 Flash (minimal): 3.5 秒Gemini 3.5 Flash (minimal)3.5 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒Mistral Small 3: 4.2 秒Mistral Small 34.2 秒
    查看图表数据
    项目合计输入处理推理生成 500 Token
    Celeris-10.9 秒0.6 秒0 秒0.3 秒
    Nova Micro2.5 秒0.8 秒0 秒1.6 秒
    Gemini 3.7 Flash (low)2.5 秒1 秒0 秒1.6 秒
    LFM2.5-VL-1.6B2.7 秒1.3 秒0 秒1.4 秒
    DeepSeek V4 Flash2.8 秒2.8 秒0 秒0 秒
    Nemotron 3 Nano3.2 秒0.9 秒0 秒2.3 秒
    Ministral 3 3B3.5 秒0.6 秒0 秒2.9 秒
    Gemini 3.5 Flash (minimal)3.5 秒0.9 秒0 秒2.6 秒
    Qwen3.5 Omni Flash3.8 秒1.8 秒0 秒2 秒
    Mistral Small 34.2 秒0.8 秒0 秒3.4 秒

    FAQ

    Mistral Small 3 常见问题

    问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。

    Mistral Small 3 什么时候发布?

    Artificial Analysis 当前记录的发布日期为 2025-01-30;本站按来源快照展示,不把发布前预测当作事实。

    Mistral Small 3 API 价格是多少?

    当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$0.1、输出 US$0.3(2026-07-21),仅作历史参考。

    Mistral Small 3 的评测表现怎么样?

    公开 Intelligence Index v4.3 · 历史参考 为 6.7,该数值为估算值。观测于 2026-09-09T14:00:04.717Z。不同方法版本不直接比较,不等于所有任务中的统一胜率。

    Mistral Small 3 的上下文窗口有多大?

    上下文窗口为 32,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。

    Mistral Small 3 的生成速度是多少?

    公开性能数据为 145.5 Token/s,来源为 Mistral。

    Mistral Small 3 是开源模型吗?

    更准确地说,这是开放权重模型,不等同于采用开源软件许可。来源记录的许可为 Apache 2.0,商业使用需按许可原文核对条件。

    怎样通过 API 使用 Mistral Small 3?

    原始来源记录了 2 家 Provider。 Provider 横向明细尚未同步。