MODEL ANALYSIS

Llama 3.2 Instruct 3B

Llama 3.2 Instruct 3B(Meta)公开评测详情:智能指数 4.2、上下文 128,000 Token。来源 Artificial Analysis,快照 2026-07-22;本站不重新评测或修改分数。

数据快照:2026-07-22查看原始来源 ↗
智能指数4.2*暂无排名
生成速度Token/s
API 价格来源未提供可验证价格
单任务成本来源未提供可比较价格
单任务输出Token

模型概览

Llama 3.2 Instruct 3B 的 Intelligence Index 为 4.2,生成速度为 暂无数据 Token/s,完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性,不能合并成单一“最好”结论。

技术规格

机构
Meta
发布日期
2024-09-25
推理类型
非推理模型
模型权重
开放权重
上下文窗口
128,000 Token
输入模态
暂无数据
输出模态
暂无数据
性能来源
Provider 中位数

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据,并始终保留当前模型。

23 / 579 个模型 · 正在载入全量数据
智能指数模型比较;当前显示 23 个模型。Claude Fable 559.9GPT-5.6 Sol (max)58.9GPT-5.6 Sol (xhigh)57.7Kimi K357.1GPT-5.6 Sol (high)55.9Claude Opus 4.8 (max)55.7GPT-5.6 Terra (max)55Grok 4.5 (high)53.8GPT-5.6 Sol (medium)53.6Claude Sonnet 5 (max)53.4GPT-5.6 Terra (xhigh)51.6GPT-5.6 Luna (max)51.2GLM-5.2 (max)51.1Muse Spark 1.1 (xhigh)50.6Gemini 3.5 Flash50.2Gemini 3.6 Flash50.1GPT-5.6 Sol (low)49.4GPT-5.6 Luna (xhigh)49.1GPT-5.6 Terra (high)49Gemini 3.1 Pro Preview46.5GPT-5.6 Luna (high)46.1Qwen3.7 Max46GPT-5.6 Terra (medium)45.6

INTELLIGENCE

Artificial Analysis 智能指数

v4.1 由 9 项独立评测组成;数值越高越好。蓝色代表当前模型。

当前模型智能指数对比
当前模型智能指数对比;公开数据059.9Claude Fable 5: 59.9;AnthropicClaude Fable 559.9GPT-5.6 Sol (max): 58.9;OpenAIGPT-5.6 Sol (max)58.9GPT-5.6 Sol (xhigh): 57.7;OpenAIGPT-5.6 Sol (xhigh)57.7Kimi K3: 57.1;KimiKimi K357.1GPT-5.6 Sol (high): 55.9;OpenAIGPT-5.6 Sol (high)55.9Claude Opus 4.8 (max): 55.7;AnthropicClaude Opus 4.8 (max)55.7GPT-5.6 Terra (max): 55;OpenAIGPT-5.6 Terra (max)55Grok 4.5 (high): 53.8;SpaceXAIGrok 4.5 (high)53.8GPT-5.6 Sol (medium): 53.6;OpenAIGPT-5.6 Sol (medium)53.6Claude Sonnet 5 (max): 53.4;AnthropicClaude Sonnet 5 (max)53.4GPT-5.6 Terra (xhigh): 51.6;OpenAIGPT-5.6 Terra (xhigh)51.6GPT-5.6 Luna (max): 51.2;OpenAIGPT-5.6 Luna (max)51.2GLM-5.2 (max): 51.1;Z AIGLM-5.2 (max)51.1Muse Spark 1.1 (xhigh): 50.6;MetaMuse Spark 1.1 (xhigh)50.6Gemini 3.5 Flash: 50.2;GoogleGemini 3.5 Flash50.2Gemini 3.6 Flash: 50.1;GoogleGemini 3.6 Flash50.1GPT-5.6 Sol (low): 49.4;OpenAIGPT-5.6 Sol (low)49.4GPT-5.6 Luna (xhigh): 49.1;OpenAIGPT-5.6 Luna (xhigh)49.1GPT-5.6 Terra (high): 49;OpenAIGPT-5.6 Terra (high)49Gemini 3.1 Pro Preview: 46.5;GoogleGemini 3.1 Pro Preview46.5
查看图表数据
项目数值
Claude Fable 559.9
GPT-5.6 Sol (max)58.9
GPT-5.6 Sol (xhigh)57.7
Kimi K357.1
GPT-5.6 Sol (high)55.9
Claude Opus 4.8 (max)55.7
GPT-5.6 Terra (max)55
Grok 4.5 (high)53.8
GPT-5.6 Sol (medium)53.6
Claude Sonnet 5 (max)53.4
GPT-5.6 Terra (xhigh)51.6
GPT-5.6 Luna (max)51.2
GLM-5.2 (max)51.1
Muse Spark 1.1 (xhigh)50.6
Gemini 3.5 Flash50.2
Gemini 3.6 Flash50.1
GPT-5.6 Sol (low)49.4
GPT-5.6 Luna (xhigh)49.1
GPT-5.6 Terra (high)49
Gemini 3.1 Pro Preview46.5

INTELLIGENCE BREAKDOWN

9 项组成评测

各列保留来源站点的展示口径;GDPval 使用归一化值,AA-Omniscience 使用知识可靠指数,其余为通过率。

Llama 3.2 Instruct 3B 分项成绩同图用于观察强弱轮廓,不应直接把不同评测的数值当作同一量纲。
Llama 3.2 Instruct 3B 分项成绩;公开数据023.6SciCode: 5.2%SciCode5.2%AA-LCR: 2.0%AA-LCR2.0%Humanity's Last Exam: 5.2%Humanity's Last Exam5.2%GPQA Diamond: 23.6%GPQA Diamond23.6%
查看图表数据
项目数值
SciCode5.2%
AA-LCR2.0%
Humanity's Last Exam5.2%
GPQA Diamond23.6%

AA-BRIEFCASE

真实知识工作成果质量

Elo 来自对可交付成果的成对比较;同时观察分析质量、呈现质量和任务要求通过率。

AA-Briefcase Elo 对比
AA-Briefcase Elo 对比;公开数据01,574Claude Fable 5: 1,574;AnthropicClaude Fable 51,574Kimi K3: 1,543;KimiKimi K31,543GPT-5.6 Sol (max): 1,501;OpenAIGPT-5.6 Sol (max)1,501Claude Sonnet 5 (max): 1,388;AnthropicClaude Sonnet 5 (max)1,388Claude Opus 4.8 (max): 1,347;AnthropicClaude Opus 4.8 (max)1,347Grok 4.5 (high): 1,323;SpaceXAIGrok 4.5 (high)1,323Claude Sonnet 5 (xhigh): 1,298;AnthropicClaude Sonnet 5 (xhigh)1,298GLM-5.2 (max): 1,260;Z AIGLM-5.2 (max)1,260Claude Sonnet 5 (high): 1,199;AnthropicClaude Sonnet 5 (high)1,199MiniMax-M3: 1,110;MiniMaxMiniMax-M31,110Claude Opus 4.7 (Non-reasoning, high): 1,089;AnthropicClaude Opus 4.7 (Non-reasonin…1,089Claude Sonnet 5 (medium): 1,059;AnthropicClaude Sonnet 5 (medium)1,059Gemini 3.6 Flash: 961;GoogleGemini 3.6 Flash961DeepSeek V4 Pro (max): 932;DeepSeekDeepSeek V4 Pro (max)932Claude Sonnet 5 (low): 926;AnthropicClaude Sonnet 5 (low)926Qwen3.7 Max: 908;AlibabaQwen3.7 Max908MiMo-V2.5-Pro: 873;XiaomiMiMo-V2.5-Pro873Nemotron 3 Ultra: 870;NVIDIANemotron 3 Ultra870
查看图表数据
项目数值
Claude Fable 51,574
Kimi K31,543
GPT-5.6 Sol (max)1,501
Claude Sonnet 5 (max)1,388
Claude Opus 4.8 (max)1,347
Grok 4.5 (high)1,323
Claude Sonnet 5 (xhigh)1,298
GLM-5.2 (max)1,260
Claude Sonnet 5 (high)1,199
MiniMax-M31,110
Claude Opus 4.7 (Non-reasoning, high)1,089
Claude Sonnet 5 (medium)1,059
Gemini 3.6 Flash961
DeepSeek V4 Pro (max)932
Claude Sonnet 5 (low)926
Qwen3.7 Max908
MiMo-V2.5-Pro873
Nemotron 3 Ultra870

AA-OMNISCIENCE

知识与幻觉

指数同时考虑正确回答和避免幻觉。当前模型准确率 暂无,幻觉率 暂无。

AA-Omniscience 指数对比
AA-Omniscience 指数对比;公开数据040.2Claude Fable 5: 40.2;AnthropicClaude Fable 540.2Gemini 3.1 Pro Preview: 32.9;GoogleGemini 3.1 Pro Preview32.9Claude Opus 4.8 (max): 27.4;AnthropicClaude Opus 4.8 (max)27.4Grok 4.5 (high): 26.4;SpaceXAIGrok 4.5 (high)26.4Gemini 3.6 Flash: 23.5;GoogleGemini 3.6 Flash23.5Gemini 3.5 Flash: 22.7;GoogleGemini 3.5 Flash22.7GPT-5.6 Sol (max): 21.7;OpenAIGPT-5.6 Sol (max)21.7Gemini 3.5 Flash (medium): 21.7;GoogleGemini 3.5 Flash (medium)21.7GPT-5.6 Sol (xhigh): 20.6;OpenAIGPT-5.6 Sol (xhigh)20.6GPT-5.6 Sol (high): 19.8;OpenAIGPT-5.6 Sol (high)19.8GPT-5.6 Sol (medium): 19;OpenAIGPT-5.6 Sol (medium)19Kimi K3: 18.4;KimiKimi K318.4GPT-5.6 Sol (low): 18.4;OpenAIGPT-5.6 Sol (low)18.4Muse Spark 1.1 (xhigh): 18;MetaMuse Spark 1.1 (xhigh)18Grok 4.3 (medium): 17;SpaceXAIGrok 4.3 (medium)17Claude Sonnet 5 (max): 15.3;AnthropicClaude Sonnet 5 (max)15.3Claude Opus 4.7 (Non-reasoning, high): 14.2;AnthropicClaude Opus 4.7 (Non-reasonin…14.2Qwen3.7 Max: 14.1;AlibabaQwen3.7 Max14.1Grok 4.3 (low): 13.7;SpaceXAIGrok 4.3 (low)13.7GPT-5.3 Codex (xhigh): 9.9;OpenAIGPT-5.3 Codex (xhigh)9.9
查看图表数据
项目数值
Claude Fable 540.2
Gemini 3.1 Pro Preview32.9
Claude Opus 4.8 (max)27.4
Grok 4.5 (high)26.4
Gemini 3.6 Flash23.5
Gemini 3.5 Flash22.7
GPT-5.6 Sol (max)21.7
Gemini 3.5 Flash (medium)21.7
GPT-5.6 Sol (xhigh)20.6
GPT-5.6 Sol (high)19.8
GPT-5.6 Sol (medium)19
Kimi K318.4
GPT-5.6 Sol (low)18.4
Muse Spark 1.1 (xhigh)18
Grok 4.3 (medium)17
Claude Sonnet 5 (max)15.3
Claude Opus 4.7 (Non-reasoning, high)14.2
Qwen3.7 Max14.1
Grok 4.3 (low)13.7
GPT-5.3 Codex (xhigh)9.9

INTELLIGENCE VS COST

能力与单任务成本

右上代表能力更高但成本也更高;理想区域通常靠近左上。横轴使用对数刻度,避免高价模型压扁主体分布。

智能指数与单任务成本
智能指数与单任务成本单任务成本(对数刻度)智能指数0 美元2.75 美元59.96Gemini 3.5 Flash: 单任务成本 0.586 美元;智能指数 50.203MiMo-V2.5-Pro: 单任务成本 0.031 美元;智能指数 42.239Mercury 2: 单任务成本 0.075 美元;智能指数 21.432Qwen3.5 122B A10B: 单任务成本 0.177 美元;智能指数 27.595GPT-5.6 Luna (low): 单任务成本 0.04 美元;智能指数 33.264GPT-5.6 Sol (low): 单任务成本 0.197 美元;智能指数 49.444Gemini 3.5 Flash-Lite: 单任务成本 0.086 美元;智能指数 36.478Devstral 2: 单任务成本 0 美元;智能指数 19.157Nova 2.0 Pro Preview (medium): 单任务成本 0.173 美元;智能指数 21.765Qwen3.5 397B A17B: 单任务成本 0.333 美元;智能指数 33.682North Mini Code: 单任务成本 0 美元;智能指数 19.795Qwen3.5 122B A10B: 单任务成本 0.241 美元;智能指数 32.279MiMo-V2.5: 单任务成本 0.01 美元;智能指数 37.203Claude Sonnet 5 (max): 单任务成本 1.525 美元;智能指数 53.35GPT-5.6 Terra (medium): 单任务成本 0.175 美元;智能指数 45.574Gemini 2.5 Pro: 单任务成本 0.198 美元;智能指数 25.818MiniMax-M3: 单任务成本 0.125 美元;智能指数 44.437Qwen3.5 9B: 单任务成本 0.164 美元;智能指数 21.438Command A+: 单任务成本 0 美元;智能指数 22.51HyperNova 60B 2605: 单任务成本 0.018 美元;智能指数 17.804gpt-oss-20b (high): 单任务成本 0.021 美元;智能指数 14.885Qwen3.6 27B: 单任务成本 0.359 美元;智能指数 30.461Mistral Small 4: 单任务成本 0.098 美元;智能指数 19.556GPT-5.6 Luna (max): 单任务成本 0.209 美元;智能指数 51.236Mistral Large 3: 单任务成本 0.06 美元;智能指数 15.93GPT-5.6 Luna (medium): 单任务成本 0.05 美元;智能指数 38.051Gemini 3.1 Flash-Lite: 单任务成本 0.042 美元;智能指数 25.038Nemotron 3 Ultra: 单任务成本 0.244 美元;智能指数 37.762DeepSeek V4 Pro (high): 单任务成本 0.04 美元;智能指数 43.112Nova 2.0 Lite (high): 单任务成本 0.245 美元;智能指数 18.168NVIDIA Nemotron 3 Super: 单任务成本 0.206 美元;智能指数 25.406Qwen3.6 35B A3B: 单任务成本 0.598 美元;智能指数 24.163Ministral 3 3B: 单任务成本 0.126 美元;智能指数 6.801Qwen3.7 Max: 单任务成本 1.032 美元;智能指数 45.994Gemma 4 26B A4B: 单任务成本 0.029 美元;智能指数 25.695GPT-5.6 Sol (medium): 单任务成本 0.314 美元;智能指数 53.589Magistral Small 1.2: 单任务成本 0.254 美元;智能指数 11.292Ministral 3 14B: 单任务成本 0.149 美元;智能指数 11.053NVIDIA Nemotron 3 Nano: 单任务成本 0.018 美元;智能指数 14.177Gemini 3.6 Flash: 单任务成本 0.501 美元;智能指数 50.068Grok 4.5 (high): 单任务成本 0.312 美元;智能指数 53.827GPT-5.6 Sol (Non-reasoning): 单任务成本 0.2 美元;智能指数 41.203GPT-5.6 Terra (high): 单任务成本 0.336 美元;智能指数 48.955Magistral Medium 1.2: 单任务成本 0.747 美元;智能指数 17.874Qwen3.6 35B A3B: 单任务成本 0.179 美元;智能指数 31.65GPT-5.6 Luna (xhigh): 单任务成本 0.139 美元;智能指数 49.068DeepSeek V4 Flash (high): 单任务成本 0.041 美元;智能指数 37.464GPT-5.6 Sol (high): 单任务成本 0.453 美元;智能指数 55.867Qwen3.6 27B: 单任务成本 0.265 美元;智能指数 37.052Grok 4.3 (Non-reasoning): 单任务成本 0.293 美元;智能指数 24.752Llama 4 Maverick: 单任务成本 0.03 美元;智能指数 14.266Ministral 3 8B: 单任务成本 0.185 美元;智能指数 8.957Llama 3.3 70B: 单任务成本 0.081 美元;智能指数 9.403Claude Opus 4.8 (max): 单任务成本 1.797 美元;智能指数 55.692GPT-5.6 Terra (Non-reasoning): 单任务成本 0.179 美元;智能指数 33.967GPT-5.6 Terra (xhigh): 单任务成本 0.477 美元;智能指数 51.605Phi-4 Mini: 单任务成本 0 美元;智能指数 6.014Nova 2.0 Pro Preview: 单任务成本 0.246 美元;智能指数 14.356Claude 4.5 Haiku: 单任务成本 0.237 美元;智能指数 29.576Qwen3.7 Plus: 单任务成本 0.207 美元;智能指数 38.977GPT-5.6 Luna (high): 单任务成本 0.095 美元;智能指数 46.059Llama 4 Scout: 单任务成本 0.009 美元;智能指数 10.042Hy3: 单任务成本 0.034 美元;智能指数 41.231Trinity Large Thinking: 单任务成本 0.126 美元;智能指数 18.16Gemini 3.1 Pro Preview: 单任务成本 0.291 美元;智能指数 46.459GPT-5.6 Terra (max): 单任务成本 0.825 美元;智能指数 54.953DeepSeek V4 Pro (max): 单任务成本 0.045 美元;智能指数 44.274GPT-5.5 Instant (June 2026): 单任务成本 0.539 美元;智能指数 28.86Qwen3 Next 80B A3B: 单任务成本 0.169 美元;智能指数 16.72gpt-oss-120b (low): 单任务成本 0.017 美元;智能指数 14.911GPT-5.6 Terra (low): 单任务成本 0.154 美元;智能指数 40.466Claude Fable 5: 单任务成本 2.75 美元;智能指数 59.861Devstral Small 2: 单任务成本 0 美元;智能指数 17.437Gemma 4 31B: 单任务成本 0.034 美元;智能指数 21.769Claude Sonnet 5 (Non-reasoning): 单任务成本 0.375 美元;智能指数 41.731Muse Spark 1.1 (xhigh): 单任务成本 0.261 美元;智能指数 50.623DeepSeek V4 Flash (max): 单任务成本 0.022 美元;智能指数 40.283GPT-5.6 Sol (max): 单任务成本 1.037 美元;智能指数 58.89GPT-5.6 Sol (xhigh): 单任务成本 0.682 美元;智能指数 57.654GPT-5.6 Luna (Non-reasoning): 单任务成本 0.055 美元;智能指数 26.56Mistral Medium 3.5: 单任务成本 0.563 美元;智能指数 29.947Ring-2.6-1T: 单任务成本 0.345 美元;智能指数 30.573Qwen3.5 35B A3B: 单任务成本 0.231 美元;智能指数 23.993gpt-oss-120b (high): 单任务成本 0.061 美元;智能指数 23.831Qwen3.6 Plus: 单任务成本 0.314 美元;智能指数 39.561Nova 2.0 Pro Preview (low): 单任务成本 0.213 美元;智能指数 19.606GLM-5.2 (max): 单任务成本 0.468 美元;智能指数 51.086Kimi K3: 单任务成本 0.954 美元;智能指数 57.112Qwen3 Coder Next: 单任务成本 0.329 美元;智能指数 21.109
查看图表数据
项目单任务成本智能指数
Gemini 3.5 Flash0.586 美元50.203
MiMo-V2.5-Pro0.031 美元42.239
Mercury 20.075 美元21.432
Qwen3.5 122B A10B0.177 美元27.595
GPT-5.6 Luna (low)0.04 美元33.264
GPT-5.6 Sol (low)0.197 美元49.444
Gemini 3.5 Flash-Lite0.086 美元36.478
Devstral 20 美元19.157
Nova 2.0 Pro Preview (medium)0.173 美元21.765
Qwen3.5 397B A17B0.333 美元33.682
North Mini Code0 美元19.795
Qwen3.5 122B A10B0.241 美元32.279
MiMo-V2.50.01 美元37.203
Claude Sonnet 5 (max)1.525 美元53.35
GPT-5.6 Terra (medium)0.175 美元45.574
Gemini 2.5 Pro0.198 美元25.818
MiniMax-M30.125 美元44.437
Qwen3.5 9B0.164 美元21.438
Command A+0 美元22.51
HyperNova 60B 26050.018 美元17.804
gpt-oss-20b (high)0.021 美元14.885
Qwen3.6 27B0.359 美元30.461
Mistral Small 40.098 美元19.556
GPT-5.6 Luna (max)0.209 美元51.236
Mistral Large 30.06 美元15.93
GPT-5.6 Luna (medium)0.05 美元38.051
Gemini 3.1 Flash-Lite0.042 美元25.038
Nemotron 3 Ultra0.244 美元37.762
DeepSeek V4 Pro (high)0.04 美元43.112
Nova 2.0 Lite (high)0.245 美元18.168
NVIDIA Nemotron 3 Super0.206 美元25.406
Qwen3.6 35B A3B0.598 美元24.163
Ministral 3 3B0.126 美元6.801
Qwen3.7 Max1.032 美元45.994
Gemma 4 26B A4B0.029 美元25.695
GPT-5.6 Sol (medium)0.314 美元53.589
Magistral Small 1.20.254 美元11.292
Ministral 3 14B0.149 美元11.053
NVIDIA Nemotron 3 Nano0.018 美元14.177
Gemini 3.6 Flash0.501 美元50.068
Grok 4.5 (high)0.312 美元53.827
GPT-5.6 Sol (Non-reasoning)0.2 美元41.203
GPT-5.6 Terra (high)0.336 美元48.955
Magistral Medium 1.20.747 美元17.874
Qwen3.6 35B A3B0.179 美元31.65
GPT-5.6 Luna (xhigh)0.139 美元49.068
DeepSeek V4 Flash (high)0.041 美元37.464
GPT-5.6 Sol (high)0.453 美元55.867
Qwen3.6 27B0.265 美元37.052
Grok 4.3 (Non-reasoning)0.293 美元24.752
Llama 4 Maverick0.03 美元14.266
Ministral 3 8B0.185 美元8.957
Llama 3.3 70B0.081 美元9.403
Claude Opus 4.8 (max)1.797 美元55.692
GPT-5.6 Terra (Non-reasoning)0.179 美元33.967
GPT-5.6 Terra (xhigh)0.477 美元51.605
Phi-4 Mini0 美元6.014
Nova 2.0 Pro Preview0.246 美元14.356
Claude 4.5 Haiku0.237 美元29.576
Qwen3.7 Plus0.207 美元38.977
GPT-5.6 Luna (high)0.095 美元46.059
Llama 4 Scout0.009 美元10.042
Hy30.034 美元41.231
Trinity Large Thinking0.126 美元18.16
Gemini 3.1 Pro Preview0.291 美元46.459
GPT-5.6 Terra (max)0.825 美元54.953
DeepSeek V4 Pro (max)0.045 美元44.274
GPT-5.5 Instant (June 2026)0.539 美元28.86
Qwen3 Next 80B A3B0.169 美元16.72
gpt-oss-120b (low)0.017 美元14.911
GPT-5.6 Terra (low)0.154 美元40.466
Claude Fable 52.75 美元59.861
Devstral Small 20 美元17.437
Gemma 4 31B0.034 美元21.769
Claude Sonnet 5 (Non-reasoning)0.375 美元41.731
Muse Spark 1.1 (xhigh)0.261 美元50.623
DeepSeek V4 Flash (max)0.022 美元40.283
GPT-5.6 Sol (max)1.037 美元58.89
GPT-5.6 Sol (xhigh)0.682 美元57.654
GPT-5.6 Luna (Non-reasoning)0.055 美元26.56
Mistral Medium 3.50.563 美元29.947
Ring-2.6-1T0.345 美元30.573
Qwen3.5 35B A3B0.231 美元23.993
gpt-oss-120b (high)0.061 美元23.831
Qwen3.6 Plus0.314 美元39.561
Nova 2.0 Pro Preview (low)0.213 美元19.606
GLM-5.2 (max)0.468 美元51.086
Kimi K30.954 美元57.112
Qwen3 Coder Next0.329 美元21.109

TOKEN USE

输出 Token 使用

Token 更多不等于回答更好;它同时影响成本和等待时间。先看同任务下的回答与推理构成。

单次 Intelligence 任务输出 Token
单次 Intelligence 任务输出 Token;公开数据05,070 TokenLlama 4 Scout: 1,249 Token;MetaLlama 4 Scout1,249 TokenLlama 3.3 70B: 1,686 Token;MetaLlama 3.3 70B1,686 TokenGPT-5.6 Sol (Non-reasoning): 2,074 Token;OpenAIGPT-5.6 Sol (Non-reasoning)2,074 TokenLlama 4 Maverick: 2,089 Token;MetaLlama 4 Maverick2,089 TokenGPT-5.6 Luna (Non-reasoning): 2,110 Token;OpenAIGPT-5.6 Luna (Non-reasoning)2,110 TokenGPT-5.6 Terra (Non-reasoning): 2,154 Token;OpenAIGPT-5.6 Terra (Non-reasoning)2,154 TokenGPT-5.6 Terra (low): 2,258 Token;OpenAIGPT-5.6 Terra (low)2,258 TokenGPT-5.6 Luna (low): 2,298 Token;OpenAIGPT-5.6 Luna (low)2,298 Tokengpt-oss-120b (low): 2,475 Token;OpenAIgpt-oss-120b (low)2,475 TokenGPT-5.5 Instant (June 2026): 2,493 Token;OpenAIGPT-5.5 Instant (June 2026)2,493 TokenGPT-5.6 Sol (low): 2,508 Token;OpenAIGPT-5.6 Sol (low)2,508 TokenMistral Large 3: 3,031 Token;MistralMistral Large 33,031 TokenNova 2.0 Pro Preview: 3,631 Token;AmazonNova 2.0 Pro Preview3,631 TokenGPT-5.6 Luna (medium): 3,663 Token;OpenAIGPT-5.6 Luna (medium)3,663 TokenGranite 4.1 30B: 3,709 Token;IBMGranite 4.1 30B3,709 TokenGPT-5.6 Terra (medium): 3,769 Token;OpenAIGPT-5.6 Terra (medium)3,769 TokenGPT-5.6 Sol (medium): 4,203 Token;OpenAIGPT-5.6 Sol (medium)4,203 TokenGemma 4 31B: 4,537 Token;GoogleGemma 4 31B4,537 TokenNova 2.0 Pro Preview (low): 4,915 Token;AmazonNova 2.0 Pro Preview (low)4,915 TokenGranite 4.1 3B: 5,070 Token;IBMGranite 4.1 3B5,070 Token
查看图表数据
项目数值
Llama 4 Scout1,249 Token
Llama 3.3 70B1,686 Token
GPT-5.6 Sol (Non-reasoning)2,074 Token
Llama 4 Maverick2,089 Token
GPT-5.6 Luna (Non-reasoning)2,110 Token
GPT-5.6 Terra (Non-reasoning)2,154 Token
GPT-5.6 Terra (low)2,258 Token
GPT-5.6 Luna (low)2,298 Token
gpt-oss-120b (low)2,475 Token
GPT-5.5 Instant (June 2026)2,493 Token
GPT-5.6 Sol (low)2,508 Token
Mistral Large 33,031 Token
Nova 2.0 Pro Preview3,631 Token
GPT-5.6 Luna (medium)3,663 Token
Granite 4.1 30B3,709 Token
GPT-5.6 Terra (medium)3,769 Token
GPT-5.6 Sol (medium)4,203 Token
Gemma 4 31B4,537 Token
Nova 2.0 Pro Preview (low)4,915 Token
Granite 4.1 3B5,070 Token

PRICE AND COST

价格与评测成本

API 标价、单任务成本和跑完整套评测的成本是三个不同口径,这里分开呈现。

单次 Intelligence 任务成本
单次 Intelligence 任务成本;公开数据01 美元Llama 4 Scout: 0.01 美元;MetaLlama 4 Scout0.01 美元MiMo-V2.5: 0.01 美元;XiaomiMiMo-V2.50.01 美元gpt-oss-120b (low): 0.02 美元;OpenAIgpt-oss-120b (low)0.02 美元HyperNova 60B 2605: 0.02 美元;Multiverse ComputingHyperNova 60B 26050.02 美元NVIDIA Nemotron 3 Nano: 0.02 美元;NVIDIANVIDIA Nemotron 3 Nano0.02 美元gpt-oss-20b (high): 0.02 美元;OpenAIgpt-oss-20b (high)0.02 美元DeepSeek V4 Flash (max): 0.02 美元;DeepSeekDeepSeek V4 Flash (max)0.02 美元Gemma 4 26B A4B: 0.03 美元;GoogleGemma 4 26B A4B0.03 美元Llama 4 Maverick: 0.03 美元;MetaLlama 4 Maverick0.03 美元MiMo-V2.5-Pro: 0.03 美元;XiaomiMiMo-V2.5-Pro0.03 美元Hy3: 0.03 美元;TencentHy30.03 美元Gemma 4 31B: 0.03 美元;GoogleGemma 4 31B0.03 美元GPT-5.6 Luna (low): 0.04 美元;OpenAIGPT-5.6 Luna (low)0.04 美元DeepSeek V4 Pro (high): 0.04 美元;DeepSeekDeepSeek V4 Pro (high)0.04 美元DeepSeek V4 Flash (high): 0.04 美元;DeepSeekDeepSeek V4 Flash (high)0.04 美元Gemini 3.1 Flash-Lite: 0.04 美元;GoogleGemini 3.1 Flash-Lite0.04 美元DeepSeek V4 Pro (max): 0.04 美元;DeepSeekDeepSeek V4 Pro (max)0.04 美元GPT-5.6 Luna (medium): 0.05 美元;OpenAIGPT-5.6 Luna (medium)0.05 美元GPT-5.6 Luna (Non-reasoning): 0.05 美元;OpenAIGPT-5.6 Luna (Non-reasoning)0.05 美元Mistral Large 3: 0.06 美元;MistralMistral Large 30.06 美元
查看图表数据
项目数值
Llama 4 Scout0.01 美元
MiMo-V2.50.01 美元
gpt-oss-120b (low)0.02 美元
HyperNova 60B 26050.02 美元
NVIDIA Nemotron 3 Nano0.02 美元
gpt-oss-20b (high)0.02 美元
DeepSeek V4 Flash (max)0.02 美元
Gemma 4 26B A4B0.03 美元
Llama 4 Maverick0.03 美元
MiMo-V2.5-Pro0.03 美元
Hy30.03 美元
Gemma 4 31B0.03 美元
GPT-5.6 Luna (low)0.04 美元
DeepSeek V4 Pro (high)0.04 美元
DeepSeek V4 Flash (high)0.04 美元
Gemini 3.1 Flash-Lite0.04 美元
DeepSeek V4 Pro (max)0.04 美元
GPT-5.6 Luna (medium)0.05 美元
GPT-5.6 Luna (Non-reasoning)0.05 美元
Mistral Large 30.06 美元

CONTEXT WINDOW

上下文窗口

上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

上下文窗口对比
上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.1 (xhigh): 1,048,576 Token;MetaMuse Spark 1.1 (xhigh)1,048,576 TokenKimi K3: 1,048,576 Token;KimiKimi K31,048,576 TokenGemini 3.5 Flash: 1,000,000 Token;GoogleGemini 3.5 Flash1,000,000 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNVIDIA Nemotron 3 Nano: 1,000,000 Token;NVIDIANVIDIA Nemotron 3 Nano1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (max)1,000,000 TokenGPT-5.6 Terra (medium): 1,000,000 Token;OpenAIGPT-5.6 Terra (medium)1,000,000 TokenGemini 2.5 Pro: 1,000,000 Token;GoogleGemini 2.5 Pro1,000,000 TokenMiniMax-M3: 1,000,000 Token;MiniMaxMiniMax-M31,000,000 TokenClaude Opus 4.7 (Non-reasoning, high): 1,000,000 Token;AnthropicClaude Opus 4.7 (Non-reasonin…1,000,000 Token
查看图表数据
项目数值
Llama 4 Scout10,000,000 Token
Muse Spark 1.1 (xhigh)1,048,576 Token
Kimi K31,048,576 Token
Gemini 3.5 Flash1,000,000 Token
MiMo-V2.5-Pro1,000,000 Token
Nova 2.0 Omni (medium)1,000,000 Token
Gemini 3.5 Flash (minimal)1,000,000 Token
GPT-5.6 Luna (low)1,000,000 Token
GPT-5.6 Sol (low)1,000,000 Token
Gemini 3.5 Flash-Lite1,000,000 Token
Inkling1,000,000 Token
Claude Sonnet 5 (low)1,000,000 Token
Nova 2.0 Omni1,000,000 Token
MiMo-V2.51,000,000 Token
NVIDIA Nemotron 3 Nano1,000,000 Token
Claude Sonnet 5 (max)1,000,000 Token
GPT-5.6 Terra (medium)1,000,000 Token
Gemini 2.5 Pro1,000,000 Token
MiniMax-M31,000,000 Token
Claude Opus 4.7 (Non-reasoning, high)1,000,000 Token

OUTPUT SPEED

回答生成速度

模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

输出速度对比
输出速度对比;公开数据01,106.3 Token/sMercury 2: 1,106.3 Token/s;InceptionMercury 21,106.3 Token/sGemini 3.5 Flash-Lite: 439.3 Token/s;GoogleGemini 3.5 Flash-Lite439.3 Token/sLFM2.5-VL-1.6B: 408.5 Token/s;Liquid AILFM2.5-VL-1.6B408.5 Token/sGranite 4.0 H Small: 402.9 Token/s;IBMGranite 4.0 H Small402.9 Token/sStep 3.7 Flash: 401.8 Token/s;StepFunStep 3.7 Flash401.8 Token/sHyperNova 60B 2605: 369.4 Token/s;Multiverse ComputingHyperNova 60B 2605369.4 Token/sLFM2.5-8B-A1B: 335.1 Token/s;Liquid AILFM2.5-8B-A1B335.1 Token/sGemini 3.1 Flash-Lite: 331.2 Token/s;GoogleGemini 3.1 Flash-Lite331.2 Token/sgpt-oss-120b (low): 326.5 Token/s;OpenAIgpt-oss-120b (low)326.5 Token/sNemotron 3 Nano Omni 30B A3B Reasoning: 315.5 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B …315.5 Token/sStep 3.5 Flash 2603: 297.5 Token/s;StepFunStep 3.5 Flash 2603297.5 Token/sgpt-oss-120b (high): 287 Token/s;OpenAIgpt-oss-120b (high)287 Token/sNova Micro: 285.5 Token/s;AmazonNova Micro285.5 Token/sGemini 3.6 Flash: 275.5 Token/s;GoogleGemini 3.6 Flash275.5 Token/sQwen3.5 Omni Flash: 247.5 Token/s;AlibabaQwen3.5 Omni Flash247.5 Token/sgpt-oss-20b (low): 237.3 Token/s;OpenAIgpt-oss-20b (low)237.3 Token/sgpt-oss-20b (high): 217.8 Token/s;OpenAIgpt-oss-20b (high)217.8 Token/sNVIDIA Nemotron 3 Super: 209.3 Token/s;NVIDIANVIDIA Nemotron 3 Super209.3 Token/sQwen3.7 Max: 204.7 Token/s;AlibabaQwen3.7 Max204.7 Token/sNVIDIA Nemotron Nano 12B v2 VL: 200.3 Token/s;NVIDIANVIDIA Nemotron Nano 12B v2 VL200.3 Token/s
查看图表数据
项目数值
Mercury 21,106.3 Token/s
Gemini 3.5 Flash-Lite439.3 Token/s
LFM2.5-VL-1.6B408.5 Token/s
Granite 4.0 H Small402.9 Token/s
Step 3.7 Flash401.8 Token/s
HyperNova 60B 2605369.4 Token/s
LFM2.5-8B-A1B335.1 Token/s
Gemini 3.1 Flash-Lite331.2 Token/s
gpt-oss-120b (low)326.5 Token/s
Nemotron 3 Nano Omni 30B A3B Reasoning315.5 Token/s
Step 3.5 Flash 2603297.5 Token/s
gpt-oss-120b (high)287 Token/s
Nova Micro285.5 Token/s
Gemini 3.6 Flash275.5 Token/s
Qwen3.5 Omni Flash247.5 Token/s
gpt-oss-20b (low)237.3 Token/s
gpt-oss-20b (high)217.8 Token/s
NVIDIA Nemotron 3 Super209.3 Token/s
Qwen3.7 Max204.7 Token/s
NVIDIA Nemotron Nano 12B v2 VL200.3 Token/s
单次 Intelligence 任务耗时
单次 Intelligence 任务耗时;公开数据058.1 秒gpt-oss-120b (low): 7.4 秒;OpenAIgpt-oss-120b (low)7.4 秒GPT-5.6 Luna (Non-reasoning): 10.9 秒;OpenAIGPT-5.6 Luna (Non-reasoning)10.9 秒GPT-5.6 Luna (low): 12.4 秒;OpenAIGPT-5.6 Luna (low)12.4 秒Llama 4 Scout: 15.9 秒;MetaLlama 4 Scout15.9 秒GPT-5.6 Terra (Non-reasoning): 16.7 秒;OpenAIGPT-5.6 Terra (Non-reasoning)16.7 秒GPT-5.6 Terra (low): 17.3 秒;OpenAIGPT-5.6 Terra (low)17.3 秒Llama 4 Maverick: 19.3 秒;MetaLlama 4 Maverick19.3 秒GPT-5.6 Luna (medium): 19.4 秒;OpenAIGPT-5.6 Luna (medium)19.4 秒Llama 3.3 70B: 20.5 秒;MetaLlama 3.3 70B20.5 秒Mercury 2: 25.7 秒;InceptionMercury 225.7 秒Gemini 3.5 Flash-Lite: 27.8 秒;GoogleGemini 3.5 Flash-Lite27.8 秒GPT-5.6 Terra (medium): 28.6 秒;OpenAIGPT-5.6 Terra (medium)28.6 秒GPT-5.6 Sol (Non-reasoning): 32.9 秒;OpenAIGPT-5.6 Sol (Non-reasoning)32.9 秒Nova 2.0 Pro Preview: 33.3 秒;AmazonNova 2.0 Pro Preview33.3 秒Nova 2.0 Pro Preview (low): 38.9 秒;AmazonNova 2.0 Pro Preview (low)38.9 秒GPT-5.6 Sol (low): 41 秒;OpenAIGPT-5.6 Sol (low)41 秒GPT-5.6 Luna (high): 42 秒;OpenAIGPT-5.6 Luna (high)42 秒GPT-5.6 Terra (high): 57.4 秒;OpenAIGPT-5.6 Terra (high)57.4 秒Qwen3.5 122B A10B: 57.6 秒;AlibabaQwen3.5 122B A10B57.6 秒Mistral Large 3: 58.1 秒;MistralMistral Large 358.1 秒
查看图表数据
项目数值
gpt-oss-120b (low)7.4 秒
GPT-5.6 Luna (Non-reasoning)10.9 秒
GPT-5.6 Luna (low)12.4 秒
Llama 4 Scout15.9 秒
GPT-5.6 Terra (Non-reasoning)16.7 秒
GPT-5.6 Terra (low)17.3 秒
Llama 4 Maverick19.3 秒
GPT-5.6 Luna (medium)19.4 秒
Llama 3.3 70B20.5 秒
Mercury 225.7 秒
Gemini 3.5 Flash-Lite27.8 秒
GPT-5.6 Terra (medium)28.6 秒
GPT-5.6 Sol (Non-reasoning)32.9 秒
Nova 2.0 Pro Preview33.3 秒
Nova 2.0 Pro Preview (low)38.9 秒
GPT-5.6 Sol (low)41 秒
GPT-5.6 Luna (high)42 秒
GPT-5.6 Terra (high)57.4 秒
Qwen3.5 122B A10B57.6 秒
Mistral Large 358.1 秒

LATENCY

首个回答 Token 等待

推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

首个回答 Token:输入处理与推理等待
输入处理推理等待
首个回答 Token:输入处理与推理等待Phi-4 Multimodal: 0.6 秒Phi-4 Multimodal0.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒GPT-5.6 Luna (Non-reasoning): 0.6 秒GPT-5.6 Luna (Non-reasoning)0.6 秒GPT-5.6 Terra (Non-reasoning): 0.7 秒GPT-5.6 Terra (Non-reasoning)0.7 秒Ministral 3 8B: 0.8 秒Ministral 3 8B0.8 秒Mistral Small 4: 0.8 秒Mistral Small 40.8 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Phi-4 Mini: 0.8 秒Phi-4 Mini0.8 秒
查看图表数据
项目合计输入处理推理等待
Phi-4 Multimodal0.6 秒0.6 秒0 秒
Ministral 3 3B0.6 秒0.6 秒0 秒
GPT-5.6 Luna (Non-reasoning)0.6 秒0.6 秒0 秒
GPT-5.6 Terra (Non-reasoning)0.7 秒0.7 秒0 秒
Ministral 3 8B0.8 秒0.8 秒0 秒
Mistral Small 40.8 秒0.8 秒0 秒
Granite 4.1 8B0.8 秒0.8 秒0 秒
Llama 4 Scout0.8 秒0.8 秒0 秒
Phi-4 Mini0.8 秒0.8 秒0 秒

END-TO-END RESPONSE TIME

端到端响应时间

按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

输出 500 Token 的完整响应时间
输入处理推理生成 500 Token
输出 500 Token 的完整响应时间Nova Micro: 2.6 秒Nova Micro2.6 秒GPT-5.6 Luna (Non-reasoning): 3.2 秒GPT-5.6 Luna (Non-reasoning)3.2 秒LFM2.5-VL-1.6B: 3.6 秒LFM2.5-VL-1.6B3.6 秒Ministral 3 3B: 3.6 秒Ministral 3 3B3.6 秒NVIDIA Nemotron Nano 12B v2 VL: 3.7 秒NVIDIA Nemotron Nano 12B v2 VL3.7 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒Gemini 3.5 Flash (minimal): 3.9 秒Gemini 3.5 Flash (minimal)3.9 秒GPT-5.6 Luna (low): 4 秒GPT-5.6 Luna (low)4 秒Mistral Small 4: 4 秒Mistral Small 44 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Nova Micro2.6 秒0.9 秒0 秒1.8 秒
GPT-5.6 Luna (Non-reasoning)3.2 秒0.6 秒0 秒2.6 秒
LFM2.5-VL-1.6B3.6 秒2.4 秒0 秒1.2 秒
Ministral 3 3B3.6 秒0.6 秒0 秒3 秒
NVIDIA Nemotron Nano 12B v2 VL3.7 秒1.3 秒0 秒2.5 秒
Qwen3.5 Omni Flash3.8 秒1.8 秒0 秒2 秒
Gemini 3.5 Flash (minimal)3.9 秒1 秒0 秒2.9 秒
GPT-5.6 Luna (low)4 秒1.3 秒0 秒2.7 秒
Mistral Small 44 秒0.8 秒0 秒3.3 秒

FAQ

常见问题

以下回答直接整理本页公开结构化数据,便于快速核对来源事实。

Llama 3.2 Instruct 3B 由谁开发?

Llama 3.2 Instruct 3B 由 Meta 开发,发布日期为 2024-09-25。

Llama 3.2 Instruct 3B 的智能指数是多少?

当前公开 Intelligence Index 为 4.2,该数值为估算值。

Llama 3.2 Instruct 3B 的生成速度是多少?

当前来源未提供生成速度。

Llama 3.2 Instruct 3B 的 API 价格是多少?

当前来源未提供可验证价格。

Llama 3.2 Instruct 3B 的上下文窗口是多少?

上下文窗口为 128,000 Token。

Llama 3.2 Instruct 3B 是开放权重模型吗?

是;许可为 LLAMA 3.2 COMMUNITY LICENSE AGREEMENT。

Llama 3.2 Instruct 3B 可以通过哪些 Provider 使用?

原站记录了 0 家 Provider。Provider 明细尚未同步。