AI 模型输出速度排行
比较来源公布的持续输出速度中位数。
| 排名 | 模型 / 开发机构 | Token / 秒 | 智能指数 | 上下文 | 每任务成本 | 详情 | |
|---|---|---|---|---|---|---|---|
| 01 | Celeris-1Celeris · 原榜 #218 | 1657.0Token / 秒 | 智能指数6 | 上下文131k | 每任务成本$0.05 | 智能指数6上下文131k每任务成本$0.05 | 详情 |
| 02 | Mercury 2.5Inception AI · 原榜 #136 | 661.0Token / 秒 | 智能指数12 | 上下文260k | 每任务成本$0.12 | 智能指数12上下文260k每任务成本$0.12 | 详情 |
| 03 | Trinity Large ThinkingArcee AI · 原榜 #154 | 352.0Token / 秒 | 智能指数11 | 上下文512k | 每任务成本$0.12 | 智能指数11上下文512k每任务成本$0.12 | 详情 |
| 04 | Ling-3.0-flash-FinInclusionAI · 原榜 #85 | 342.0Token / 秒 | 智能指数23 | 上下文262k | 每任务成本— | 智能指数23上下文262k每任务成本— | 详情 |
| 05 | Gemini 3.5 Flash-LiteGoogle · 原榜 #86 | 336.0Token / 秒 | 智能指数22 | 上下文1M | 每任务成本$0.12 | 智能指数22上下文1M每任务成本$0.12 | 详情 |
| 06 | Ling 3.0 FlashInclusionAI · 原榜 #98 | 334.0Token / 秒 | 智能指数20 | 上下文262k | 每任务成本— | 智能指数20上下文262k每任务成本— | 详情 |
| 07 | Nemotron 3.5 LightningNVIDIA · 原榜 #130 | 300.0Token / 秒 | 智能指数13 | 上下文1M | 每任务成本$0.09 | 智能指数13上下文1M每任务成本$0.09 | 详情 |
| 08 | Nova MicroAmazon · 原榜 #230 | 292.0Token / 秒 | 智能指数6* | 上下文130k | 每任务成本— | 智能指数6*上下文130k每任务成本— | 详情 |
| 09 | Nemotron 3 Nano Omni 30B A3BNVIDIA · 原榜 #158 | 269.0Token / 秒 | 智能指数10* | 上下文256k | 每任务成本— | 智能指数10*上下文256k每任务成本— | 详情 |
| 10 | gpt-oss-20b (low)OpenAI · 原榜 #162 | 268.0Token / 秒 | 智能指数10* | 上下文131k | 每任务成本— | 智能指数10*上下文131k每任务成本— | 详情 |
| 11 | Gemini 3.8 Flash (high)Google · 原榜 #38 | 241.0Token / 秒 | 智能指数41 | 上下文1M | 每任务成本$1.24 | 智能指数41上下文1M每任务成本$1.24 | 详情 |
| 12 | Ministral 3 3BMistral AI · 原榜 #253 | 234.0Token / 秒 | 智能指数5 | 上下文256k | 每任务成本$0.01 | 智能指数5上下文256k每任务成本$0.01 | 详情 |
| 13 | Qwen3.5 Omni FlashAlibaba · 原榜 #134 | 224.0Token / 秒 | 智能指数12* | 上下文256k | 每任务成本— | 智能指数12*上下文256k每任务成本— | 详情 |
| 14 | Nemotron 3 Nano (non-reasoning)NVIDIA · 原榜 #210 | 224.0Token / 秒 | 智能指数7* | 上下文1M | 每任务成本— | 智能指数7*上下文1M每任务成本— | 来源 |
| 15 | DeepSeek V4 Flash Vision (max)DeepSeek · 原榜 #49 | 222.0Token / 秒 | 智能指数35 | 上下文1M | 每任务成本$0.31 | 智能指数35上下文1M每任务成本$0.31 | 详情 |
| 16 | DeepSeek V4 Pro 0813 (non-reasoning)DeepSeek · 原榜 #95 | 219.0Token / 秒 | 智能指数20 | 上下文1M | 每任务成本$0.33 | 智能指数20上下文1M每任务成本$0.33 | 来源 |
| 17 | Granite 4.2 3BIBM · 原榜 #172 | 219.0Token / 秒 | 智能指数9 | 上下文131k | 每任务成本$0.01 | 智能指数9上下文131k每任务成本$0.01 | 详情 |
| 18 | gpt-oss-120b (low)OpenAI · 原榜 #159 | 218.0Token / 秒 | 智能指数10* | 上下文131k | 每任务成本— | 智能指数10*上下文131k每任务成本— | 详情 |
| 19 | DeepSeek V4.1 Flash (max)DeepSeek · 原榜 #43 | 214.0Token / 秒 | 智能指数39 | 上下文1M | 每任务成本$0.27 | 智能指数39上下文1M每任务成本$0.27 | 详情 |
| 20 | DeepSeek V4.1 Flash (non-reasoning)DeepSeek · 原榜 #81 | 212.0Token / 秒 | 智能指数25 | 上下文1M | 每任务成本$0.15 | 智能指数25上下文1M每任务成本$0.15 | 来源 |
| 21 | Ling 3.1 FlashInclusionAI · 原榜 #37 | 210.0Token / 秒 | 智能指数41 | 上下文1M | 每任务成本$0.99 | 智能指数41上下文1M每任务成本$0.99 | 来源 |
| 22 | gpt-oss-20b (high)OpenAI · 原榜 #176 | 202.0Token / 秒 | 智能指数9 | 上下文131k | 每任务成本$0.01 | 智能指数9上下文131k每任务成本$0.01 | 详情 |
| 23 | NVIDIA Nemotron Nano 12B v2 VL (non-reasoning)NVIDIA · 原榜 #231 | 199.0Token / 秒 | 智能指数6* | 上下文128k | 每任务成本— | 智能指数6*上下文128k每任务成本— | 来源 |
| 24 | gpt-oss-120b (high)OpenAI · 原榜 #142 | 196.0Token / 秒 | 智能指数12 | 上下文131k | 每任务成本$0.11 | 智能指数12上下文131k每任务成本$0.11 | 详情 |
| 25 | Qwen3 Next 80B A3BAlibaba · 原榜 #147 | 194.0Token / 秒 | 智能指数11* | 上下文262k | 每任务成本— | 智能指数11*上下文262k每任务成本— | 详情 |
| 26 | Inkling SmallThinking Machines · 原榜 #75 | 192.0Token / 秒 | 智能指数26 | 上下文1M | 每任务成本$0.09 | 智能指数26上下文1M每任务成本$0.09 | 详情 |
| 27 | Muse Spark 1.3 (xhigh)Meta · 原榜 #28 | 191.0Token / 秒 | 智能指数45 | 上下文1M | 每任务成本$1.37 | 智能指数45上下文1M每任务成本$1.37 | 详情 |
| 28 | Inkling (xhigh)Thinking Machines · 原榜 #79 | 189.0Token / 秒 | 智能指数25 | 上下文1M | 每任务成本— | 智能指数25上下文1M每任务成本— | 来源 |
| 29 | Nova 2.0 Lite (high)Amazon · 原榜 #124 | 187.0Token / 秒 | 智能指数13* | 上下文1M | 每任务成本— | 智能指数13*上下文1M每任务成本— | 详情 |
| 30 | Muse Spark 1.3 (max)Meta · 原榜 #19 | 185.0Token / 秒 | 智能指数48 | 上下文1M | 每任务成本$1.6 | 智能指数48上下文1M每任务成本$1.6 | 详情 |
| 31 | Nova 2.0 Lite (medium)Amazon · 原榜 #133 | 182.0Token / 秒 | 智能指数12* | 上下文1M | 每任务成本— | 智能指数12*上下文1M每任务成本— | 详情 |
| 32 | Qwen3 Next 80B A3BAlibaba · 原榜 #165 | 179.0Token / 秒 | 智能指数10* | 上下文262k | 每任务成本— | 智能指数10*上下文262k每任务成本— | 详情 |
| 33 | Nemotron 3 NanoNVIDIA · 原榜 #178 | 179.0Token / 秒 | 智能指数9 | 上下文1M | 每任务成本$0.02 | 智能指数9上下文1M每任务成本$0.02 | 详情 |
| 34 | Mistral Small 4Mistral AI · 原榜 #146 | 174.0Token / 秒 | 智能指数11 | 上下文256k | 每任务成本$0.02 | 智能指数11上下文256k每任务成本$0.02 | 详情 |
| 35 | Nemotron 3 UltraNVIDIA · 原榜 #84 | 172.0Token / 秒 | 智能指数23 | 上下文262k | 每任务成本$0.6 | 智能指数23上下文262k每任务成本$0.6 | 详情 |
| 36 | Nova 2.0 Lite (non-reasoning)Amazon · 原榜 #181 | 171.0Token / 秒 | 智能指数9* | 上下文1M | 每任务成本— | 智能指数9*上下文1M每任务成本— | 来源 |
| 37 | Mistral Medium 3.5Mistral AI · 原榜 #118 | 168.0Token / 秒 | 智能指数14 | 上下文256k | 每任务成本$0.5 | 智能指数14上下文256k每任务成本$0.5 | 详情 |
| 38 | Mistral Small 4 (non-reasoning)Mistral AI · 原榜 #174 | 163.0Token / 秒 | 智能指数9* | 上下文256k | 每任务成本— | 智能指数9*上下文256k每任务成本— | 来源 |
| 39 | Quasar 438B (max)Multiverse Computing · 原榜 #70 | 161.0Token / 秒 | 智能指数27 | 上下文1M | 每任务成本$2.02 | 智能指数27上下文1M每任务成本$2.02 | 详情 |
| 40 | Nemotron 3 SuperNVIDIA · 原榜 #131 | 156.0Token / 秒 | 智能指数13 | 上下文1M | 每任务成本$1.64 | 智能指数13上下文1M每任务成本$1.64 | 详情 |
| 41 | Command A+Cohere · 原榜 #127 | 148.0Token / 秒 | 智能指数13 | 上下文192k | 每任务成本$0 | 智能指数13上下文192k每任务成本$0 | 详情 |
| 42 | Nova 2.0 Lite (low)Amazon · 原榜 #139 | 147.0Token / 秒 | 智能指数12* | 上下文1M | 每任务成本— | 智能指数12*上下文1M每任务成本— | 详情 |
| 43 | NVIDIA Nemotron Nano 9B V2 (non-reasoning)NVIDIA · 原榜 #211 | 147.0Token / 秒 | 智能指数7* | 上下文131k | 每任务成本— | 智能指数7*上下文131k每任务成本— | 来源 |
| 44 | Ling-3.0-flash-VLInclusionAI · 原榜 #82 | 145.0Token / 秒 | 智能指数25 | 上下文262k | 每任务成本— | 智能指数25上下文262k每任务成本— | 详情 |
| 45 | Qwen3.5 122B A10B (non-reasoning)Alibaba · 原榜 #105 | 142.0Token / 秒 | 智能指数18* | 上下文262k | 每任务成本— | 智能指数18*上下文262k每任务成本— | 来源 |
| 46 | GPT-6 Luna (max)OpenAI · 原榜 #44 | 141.0Token / 秒 | 智能指数38 | 上下文1M | 每任务成本$0.07 | 智能指数38上下文1M每任务成本$0.07 | 详情 |
| 47 | GPT-6 Luna (xhigh)OpenAI · 原榜 #50 | 138.0Token / 秒 | 智能指数35 | 上下文1M | 每任务成本$0.04 | 智能指数35上下文1M每任务成本$0.04 | 详情 |
| 48 | o3OpenAI · 原榜 #96 | 138.0Token / 秒 | 智能指数20* | 上下文200k | 每任务成本— | 智能指数20*上下文200k每任务成本— | 详情 |
| 49 | Qwen3.6 35B A3B (non-reasoning)Alibaba · 原榜 #114 | 137.0Token / 秒 | 智能指数15* | 上下文262k | 每任务成本— | 智能指数15*上下文262k每任务成本— | 来源 |
| 50 | GPT-6 Luna (high)OpenAI · 原榜 #57 | 134.0Token / 秒 | 智能指数33 | 上下文1M | 每任务成本$0.03 | 智能指数33上下文1M每任务成本$0.03 | 详情 |