排行榜 / 场景榜单 / 生成速度(吞吐)最快的 AI 模型排行

生成速度(吞吐)最快的 AI 模型排行

按生成速度(每秒输出 token 数)排序,数值越大越快,适合大批量生成、长文本输出的场景。

排名模型厂商生成速度官方价本站中转榜首
排名1 Celeris-1 厂商Celeris 生成速度1892.8 tok/s tok/s 官方价$0.2 / $0.7 中转榜首 中转站数据不足
排名2 Mercury 2 厂商Inception 生成速度746.5 tok/s tok/s 官方价$0.25 / $0.75 中转榜首 中转站数据不足
排名3 Ling 3.0 Flash 厂商InclusionAI 生成速度371.6 tok/s tok/s 官方价$0.075 / $0.22 中转榜首 中转站数据不足
排名4 Gemini 3.5 Flash-Lite 厂商Google 生成速度350.4 tok/s tok/s 官方价$0.3 / $2.5 中转榜首 Sandbox API · 1折 · 100%
排名5 Trinity Large Thinking 厂商Arcee AI 生成速度335.2 tok/s tok/s 官方价$0.25 / $0.9 中转榜首 中转站数据不足
排名6 Gemini 3.8 Flash 厂商Google 生成速度315.7 tok/s tok/s 官方价$0.75 / $3.75 中转榜首 Sandbox API · 1折 · 100%
排名7 Nemotron 3.5 Lightning 厂商NVIDIA 生成速度276.9 tok/s tok/s 官方价$0.06 / $0.2 中转榜首 中转站数据不足
排名8 Nemotron 3 Nano Omni 30B A3B Reasoning 厂商NVIDIA 生成速度271.2 tok/s tok/s 官方价$0.195 / $1.095 中转榜首 中转站数据不足
排名9 gpt-oss-20b 厂商OpenAI 生成速度268.8 tok/s tok/s 官方价$0.07 / $0.2 中转榜首 中转站数据不足
排名10 Nova Micro 厂商Amazon 生成速度241.2 tok/s tok/s 官方价$0.035 / $0.14 中转榜首 中转站数据不足
排名11 Command A+ 厂商Cohere 生成速度239.0 tok/s tok/s 官方价暂未公布 中转榜首 中转站数据不足
排名12 DeepSeek V4 Flash Vision 厂商DeepSeek 生成速度237.2 tok/s tok/s 官方价$0.44 / $1.32 中转榜首 中转站数据不足
排名13 Qwen3.5 Omni Flash 厂商Alibaba 生成速度234.9 tok/s tok/s 官方价$0.1 / $0.8 中转榜首 中转站数据不足
排名14 Ministral 3 3B 厂商Mistral 生成速度234.1 tok/s tok/s 官方价$0.1 / $0.1 中转榜首 中转站数据不足
排名15 Granite 4.2 3B 厂商IBM 生成速度232.4 tok/s tok/s 官方价$0.03 / $0.12 中转榜首 中转站数据不足
排名16 DeepSeek V4.1 Flash 厂商DeepSeek 生成速度230.9 tok/s tok/s 官方价$0.3 / $1.2 中转榜首 中转站数据不足
排名17 Inkling Small 厂商Thinking Machines 生成速度224.8 tok/s tok/s 官方价$0.3 / $1.2 中转榜首 中转站数据不足
排名18 Nova 2.0 Lite 厂商Amazon 生成速度224.5 tok/s tok/s 官方价$0.3 / $2.5 中转榜首 中转站数据不足
排名19 Muse Spark 1.3 厂商Meta 生成速度221.0 tok/s tok/s 官方价$1.25 / $4.25 中转榜首 中转站数据不足
排名20 gpt-oss-120b 厂商OpenAI 生成速度213.6 tok/s tok/s 官方价$0.15 / $0.595 中转榜首 中转站数据不足