AI 模型任务成本榜
按 Artificial Analysis 公开的 Intelligence Index 单任务成本排序。
| 排名 | 模型 | 厂商 | 单任务成本(美元) | 适合场景 |
|---|---|---|---|---|
| 01 | Gemma 4 31B | $0.00 | 开放权重实验、部署与模型对比 | |
| 02 | Ling 3.0 Tiny | InclusionAI | $0.00 | 开放权重实验、部署与模型对比 |
| 03 | Command A+ | Cohere | $0.00 | 高吞吐文本生成与批量任务 |
| 04 | North Mini Code | Cohere | $0.00 | 通用文本生成与公开指标对比 |
| 05 | Devstral 2 | Mistral | $0.00 | 通用文本生成与公开指标对比 |
| 06 | Devstral Small 2 | Mistral | $0.00 | 通用文本生成与公开指标对比 |
| 07 | GPT-5.6 Luna (medium) | OpenAI | $0.01 | 长上下文任务与公开指标对比 |
| 08 | MiMo-V2.5 | Xiaomi | $0.01 | 长上下文任务与公开指标对比 |
| 09 | GPT-5.6 Luna (low) | OpenAI | $0.01 | 长上下文任务与公开指标对比 |
| 10 | GPT-5.6 Luna (Non-reasoning) | OpenAI | $0.01 | 长上下文任务与公开指标对比 |
| 11 | Llama 4 Scout | Meta | $0.01 | 长上下文任务与公开指标对比 |
| 12 | GPT-5.6 Luna (high) | OpenAI | $0.02 | 长上下文任务与公开指标对比 |
| 13 | gpt-oss-20b (high) | OpenAI | $0.02 | 通用文本生成与公开指标对比 |
| 14 | gpt-oss-120b (low) | OpenAI | $0.02 | 通用文本生成与公开指标对比 |
| 15 | Nemotron 3 Nano | NVIDIA | $0.02 | 高吞吐文本生成与批量任务 |
| 16 | GPT-5.6 Luna (xhigh) | OpenAI | $0.03 | 公开指数中的高能力推理配置 |
| 17 | MiMo-V2.5-Pro | Xiaomi | $0.03 | 长上下文任务与公开指标对比 |
| 18 | DeepSeek V4 Pro (high) | DeepSeek | $0.04 | 长上下文任务与公开指标对比 |
| 19 | Hy3 | Tencent | $0.04 | 通用文本生成与公开指标对比 |
| 20 | Ling 3.0 Flash | InclusionAI | $0.04 | 开放权重实验、部署与模型对比 |
| 21 | Gemma 4 26B A4B | $0.04 | 开放权重实验、部署与模型对比 | |
| 22 | Gemma 4 31B | $0.04 | 开放权重实验、部署与模型对比 | |
| 23 | Llama 4 Maverick | Meta | $0.04 | 长上下文任务与公开指标对比 |
| 24 | GPT-5.6 Luna (max) | OpenAI | $0.05 | 公开指数中的高能力推理配置 |
| 25 | DeepSeek V4 Pro (max) | DeepSeek | $0.05 | 长上下文任务与公开指标对比 |
| 26 | Inkling Small | Thinking Machines | $0.07 | 长上下文任务与公开指标对比 |
| 27 | Muse Glimmer (high) | Meta | $0.07 | 通用文本生成与公开指标对比 |
| 28 | gpt-oss-120b (high) | OpenAI | $0.07 | 通用文本生成与公开指标对比 |
| 29 | Nemotron 3.5 Lightning | NVIDIA | $0.07 | 高吞吐文本生成与批量任务 |
| 30 | Mercury 2 | Inception | $0.08 | 高吞吐文本生成与批量任务 |
| 31 | Mistral Large 3 | Mistral | $0.08 | 开放权重实验、部署与模型对比 |
| 32 | GPT-5.6 Terra (low) | OpenAI | $0.09 | 长上下文任务与公开指标对比 |
| 33 | Step 3.7 Flash | StepFun | $0.09 | 通用文本生成与公开指标对比 |
| 34 | Gemini 3.5 Flash-Lite | $0.10 | 高吞吐文本生成与批量任务 | |
| 35 | GPT-5.6 Terra (Non-reasoning) | OpenAI | $0.10 | 长上下文任务与公开指标对比 |
| 36 | Mistral Small 4 | Mistral | $0.10 | 开放权重实验、部署与模型对比 |
| 37 | DeepSeek V4 Flash 0731 (max) | DeepSeek | $0.11 | 公开指数中的高能力推理配置 |
| 38 | GPT-5.6 Terra (medium) | OpenAI | $0.12 | 长上下文任务与公开指标对比 |
| 39 | LongCat 2.0 | LongCat | $0.12 | 长上下文任务与公开指标对比 |
| 40 | Ministral 3 3B | Mistral | $0.13 | 高吞吐文本生成与批量任务 |
| 41 | MiniMax-M3 | MiniMax | $0.14 | 长上下文任务与公开指标对比 |
| 42 | Solar Pro 3 | Upstage | $0.15 | 通用文本生成与公开指标对比 |
| 43 | Gemini 3.7 Flash (low) | $0.16 | 公开指数中的高能力推理配置 | |
| 44 | Trinity Large Thinking | Arcee AI | $0.16 | 通用文本生成与公开指标对比 |
| 45 | Ministral 3 14B | Mistral | $0.16 | 开放权重实验、部署与模型对比 |
| 46 | Ministral 3 8B | Mistral | $0.18 | 开放权重实验、部署与模型对比 |
| 47 | Qwen3 Next 80B A3B | Alibaba | $0.19 | 开放权重实验、部署与模型对比 |
| 48 | Qwen3.5 122B A10B | Alibaba | $0.20 | 开放权重实验、部署与模型对比 |
| 49 | GPT-5.6 Terra (high) | OpenAI | $0.22 | 公开指数中的高能力推理配置 |
| 50 | Kimi K2.7 Code | Kimi | $0.22 | 通用文本生成与公开指标对比 |
| 51 | Solar Pro 4 | Upstage | $0.22 | 通用文本生成与公开指标对比 |
| 52 | Claude 4.5 Haiku | Anthropic | $0.22 | 通用文本生成与公开指标对比 |
| 53 | GPT-5.6 Sol (low) | OpenAI | $0.23 | 公开指数中的高能力推理配置 |
| 54 | Nemotron 3 Super | NVIDIA | $0.23 | 长上下文任务与公开指标对比 |
| 55 | Kimi K3 (low) | Kimi | $0.24 | 长上下文任务与公开指标对比 |
| 56 | GPT-5.6 Sol (Non-reasoning) | OpenAI | $0.24 | 长上下文任务与公开指标对比 |
| 57 | Qwen3.7 Plus | Alibaba | $0.24 | 长上下文任务与公开指标对比 |
| 58 | Qwen3.5 35B A3B | Alibaba | $0.24 | 开放权重实验、部署与模型对比 |
| 59 | Qwen3.5 9B | Alibaba | $0.24 | 开放权重实验、部署与模型对比 |
| 60 | DeepSeek V4 Pro 0813 (max) | DeepSeek | $0.25 | 公开指数中的高能力推理配置 |
| 61 | Qwen3.5 122B A10B | Alibaba | $0.25 | 开放权重实验、部署与模型对比 |
| 62 | Gemini 3.7 Flash (medium) | $0.26 | 公开指数中的高能力推理配置 | |
| 63 | Celeris-1 | Celeris | $0.26 | 高吞吐文本生成与批量任务 |
| 64 | Qwen3.6 27B | Alibaba | $0.29 | 开放权重实验、部署与模型对比 |
| 65 | Qwen3.6 35B A3B | Alibaba | $0.29 | 开放权重实验、部署与模型对比 |
| 66 | Grok 4.3 (Non-reasoning) | xAI | $0.29 | 长上下文任务与公开指标对比 |
| 67 | Magistral Small 1.2 | Mistral | $0.30 | 通用文本生成与公开指标对比 |
| 68 | GPT-5.6 Terra (xhigh) | OpenAI | $0.31 | 公开指数中的高能力推理配置 |
| 69 | GLM-5.2 (max) | Z.ai | $0.33 | 公开指数中的高能力推理配置 |
| 70 | Gemini 3.1 Pro Preview | $0.33 | 长上下文任务与公开指标对比 | |
| 71 | Inkling | Thinking Machines | $0.34 | 长上下文任务与公开指标对比 |
| 72 | Qwen3 Coder Next | Alibaba | $0.34 | 开放权重实验、部署与模型对比 |
| 73 | Grok 4.5 (high) | xAI | $0.36 | 公开指数中的高能力推理配置 |
| 74 | Qwen3.5 397B A17B | Alibaba | $0.36 | 开放权重实验、部署与模型对比 |
| 75 | Ring-2.6-1T | InclusionAI | $0.36 | 通用文本生成与公开指标对比 |
| 76 | GPT-5.6 Sol (medium) | OpenAI | $0.37 | 公开指数中的高能力推理配置 |
| 77 | Nemotron 3 Ultra | NVIDIA | $0.38 | 开放权重实验、部署与模型对比 |
| 78 | Muse Spark 1.2 (xhigh) | Meta | $0.40 | 公开指数中的高能力推理配置 |
| 79 | Gemini 3.7 Flash (high) | $0.40 | 公开指数中的高能力推理配置 | |
| 80 | Qwen3.6 27B | Alibaba | $0.40 | 开放权重实验、部署与模型对比 |
| 81 | Claude Sonnet 5 (Non-reasoning) | Anthropic | $0.42 | 长上下文任务与公开指标对比 |
| 82 | Claude Opus 5 (low) | Anthropic | $0.43 | 公开指数中的高能力推理配置 |
| 83 | Mistral Medium 3.5 | Mistral | $0.46 | 开放权重实验、部署与模型对比 |
| 84 | GPT-5.6 Terra (max) | OpenAI | $0.51 | 公开指数中的高能力推理配置 |
| 85 | GPT-5.5 Instant (June 2026) | OpenAI | $0.54 | 通用文本生成与公开指标对比 |
| 86 | GPT-5.6 Sol (high) | OpenAI | $0.55 | 公开指数中的高能力推理配置 |
| 87 | Gemini 3.6 Flash | $0.56 | 公开指数中的高能力推理配置 | |
| 88 | Qwen3.6 35B A3B | Alibaba | $0.63 | 开放权重实验、部署与模型对比 |
| 89 | Claude Opus 5 (medium) | Anthropic | $0.72 | 公开指数中的高能力推理配置 |
| 90 | GPT-5.6 Sol (xhigh) | OpenAI | $0.81 | 公开指数中的高能力推理配置 |
| 91 | Grok 4.6 (high) | xAI | $0.84 | 公开指数中的高能力推理配置 |
| 92 | Kimi K3 (max) | Kimi | $0.84 | 公开指数中的高能力推理配置 |
| 93 | Magistral Medium 1.2 | Mistral | $0.89 | 通用文本生成与公开指标对比 |
| 94 | Qwen3.8 2.4T A95B | Alibaba | $1.09 | 公开指数中的高能力推理配置 |
| 95 | Qwen3.8 Max | Alibaba | $1.13 | 公开指数中的高能力推理配置 |
| 96 | Claude Opus 5 (high) | Anthropic | $1.23 | 公开指数中的高能力推理配置 |
| 97 | GPT-5.6 Sol (max) | OpenAI | $1.23 | 公开指数中的高能力推理配置 |
| 98 | Claude Sonnet 5 (max) | Anthropic | $1.72 | 公开指数中的高能力推理配置 |
| 99 | Claude Opus 5 (xhigh) | Anthropic | $1.80 | 公开指数中的高能力推理配置 |
| 100 | Claude Opus 5 (max) | Anthropic | $2.34 | 公开指数中的高能力推理配置 |
| 101 | Claude Fable 5 (with fallback) | Anthropic | $3.14 | 公开指数中的高能力推理配置 |
数据来源:Artificial Analysis LLM Leaderboard / 最后核验:2026-08-18最后更新:2026-08-09