MODEL ANALYSIS

Claude 4.1 Opus (Reasoning)

Claude 4.1 Opus (Reasoning)(Anthropic)公开数据详情:智能指数 22.8(v4.3 · 历史参考)、上下文 200,000 Token。评测来源 Artificial Analysis;规格来源 Artificial Analysis,快照 2026-09-20;各字段保留原始来源与观测时间。

数据快照:2026-09-20查看原始来源 ↗
智能指数 · v4.3 · 历史参考22.8*暂无排名
生成速度Token/s
API 价格当前 API 未核实 · Artificial Analysis model aggregate 历史输入 $15 / 输出 $75(2026-07-21)
单任务成本 · 历史参考来源未提供可比较价格
单任务输出 · 历史参考Token

评测按字段保留来源版本与观测时间。Intelligence Index v4.3 观测于 2026-09-09T14:00:04.717Z。 单任务成本、Token 与完整评测成本仍为此前快照参考,不代表新版评测或当前 API 报价。详情可在指标历史核对。

模型概览

Claude 4.1 Opus (Reasoning) 的 Intelligence Index v4.3 · 历史参考 为 22.8(估算值),生成速度为 暂无数据 Token/s,历史完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性;旧成本未与新版指数绑定,不能合并成单一“最好”结论。

技术规格

机构
Anthropic
发布日期
2025-08-05
推理类型
推理模型
模型权重
未开放权重
上下文窗口
200,000 Token
输入模态
文本、图像
输出模态
文本
性能来源
Anthropic

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据;历史参考配置可在“历史”或“全部”中查看。

0 / 654 个模型 · 正在载入全量数据

仅比较 v4.3 · 历史参考 的精确同版本观测;不跨方法版本排序。估算指数保留来源的暂定性质。

智能指数模型比较;当前显示 0 个模型。

    没有符合当前筛选条件且包含该指标的模型

    INTELLIGENCE

    Artificial Analysis 智能指数 · v4.3 · 历史参考

    v4.3 是历史完整方法,按 Agent、编码、通用与科学推理四类能力组合。仅在同版本内比较;数值越高越好。本页配置原观测于 2026-09-09T14:00:04.717Z。蓝色代表当前模型。 查看方法与可比边界 →

    模型智能指数对比 · v4.3 · 历史参考
    模型智能指数对比 · v4.3 · 历史参考;公开数据07.3Kimi Linear 48B A3B Instruct(估算): 7.3;KimiKimi Linear 48B A3B Instruct(…7.3R1 1776(估算): 6.4;PerplexityR1 1776(估算)6.4Llama 3.2 90B (Vision)(估算): 6.4;MetaLlama 3.2 90B (Vision)(估算)6.4DeepHermes 3 - Mistral 24B(估算): 6.1;Nous ResearchDeepHermes 3 - Mistral 24B(估算)6.1Phi-4 Multimodal(估算): 5.8;MicrosoftPhi-4 Multimodal(估算)5.8Molmo 7B-D(估算): 5.6;Allen Institute for AIMolmo 7B-D(估算)5.6DeepHermes 3 - Llama-3.1 8B(估算): 5.1;Nous ResearchDeepHermes 3 - Llama-3.1 8B(估…5.1
    查看图表数据
    项目数值
    Kimi Linear 48B A3B Instruct(估算)7.3
    R1 1776(估算)6.4
    Llama 3.2 90B (Vision)(估算)6.4
    DeepHermes 3 - Mistral 24B(估算)6.1
    Phi-4 Multimodal(估算)5.8
    Molmo 7B-D(估算)5.6
    DeepHermes 3 - Llama-3.1 8B(估算)5.1

    INTELLIGENCE BREAKDOWN

    组成评测 · v4.3 · 历史参考

    仅展示该版本逐项核实的原始指标;缺少同版本观测的字段不从历史回填。 Elo、指数与通过率不能当作同一量纲排序;幻觉率越低越好。

    Claude 4.1 Opus (Reasoning) 的分项原始指标
    指标原始成绩
    AA-LCR v1.176.0%
    Humanity's Last Exam12.5%
    CritPt0.0%

    CONTEXT WINDOW

    上下文窗口

    上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

    上下文窗口对比
    上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.2 (xhigh): 1,048,576 Token;MetaMuse Spark 1.2 (xhigh)1,048,576 TokenKimi K3 (low): 1,048,576 Token;KimiKimi K3 (low)1,048,576 TokenSolar Open2 250B: 1,048,576 Token;UpstageSolar Open2 250B1,048,576 TokenKimi K3 (max): 1,048,576 Token;KimiKimi K3 (max)1,048,576 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Opus 5 (xhigh): 1,000,000 Token;AnthropicClaude Opus 5 (xhigh)1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenGLM-5.3-Flash: 1,000,000 Token;Z AIGLM-5.3-Flash1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenClaude Opus 5 (low): 1,000,000 Token;AnthropicClaude Opus 5 (low)1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNemotron 3 Nano: 1,000,000 Token;NVIDIANemotron 3 Nano1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (max)1,000,000 Token
    查看图表数据
    项目数值
    Llama 4 Scout10,000,000 Token
    Muse Spark 1.2 (xhigh)1,048,576 Token
    Kimi K3 (low)1,048,576 Token
    Solar Open2 250B1,048,576 Token
    Kimi K3 (max)1,048,576 Token
    MiMo-V2.5-Pro1,000,000 Token
    Nova 2.0 Omni (medium)1,000,000 Token
    Gemini 3.5 Flash (minimal)1,000,000 Token
    GPT-5.6 Luna (low)1,000,000 Token
    GPT-5.6 Sol (low)1,000,000 Token
    Gemini 3.5 Flash-Lite1,000,000 Token
    Inkling1,000,000 Token
    Claude Opus 5 (xhigh)1,000,000 Token
    Claude Sonnet 5 (low)1,000,000 Token
    GLM-5.3-Flash1,000,000 Token
    Nova 2.0 Omni1,000,000 Token
    Claude Opus 5 (low)1,000,000 Token
    MiMo-V2.51,000,000 Token
    Nemotron 3 Nano1,000,000 Token
    Claude Sonnet 5 (max)1,000,000 Token

    FAQ

    Claude 4.1 Opus 常见问题

    问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。

    Claude 4.1 Opus 什么时候发布?

    Artificial Analysis 当前记录的发布日期为 2025-08-05;本站按来源快照展示,不把发布前预测当作事实。

    Claude 4.1 Opus API 价格是多少?

    当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$15、输出 US$75(2026-07-21),仅作历史参考。

    Claude 4.1 Opus 的评测表现怎么样?

    公开 Intelligence Index v4.3 · 历史参考 为 22.8,该数值为估算值。观测于 2026-09-09T14:00:04.717Z。不同方法版本不直接比较,不等于所有任务中的统一胜率。

    Claude 4.1 Opus 的上下文窗口有多大?

    上下文窗口为 200,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。

    Claude 4.1 Opus 的生成速度是多少?

    当前来源未提供生成速度。

    Claude 4.1 Opus 是开源模型吗?

    当前Artificial Analysis未提供可核验的开放权重,本站暂按非开放权重处理。

    怎样通过 API 使用 Claude 4.1 Opus?

    原始来源记录了 4 家 Provider。 Provider 横向明细尚未同步。