เริ่มต้นใช้งานลีดเดอร์บอร์ดDecode calculatorโมเดลReportsฮาร์ดแวร์เบนช์มาร์กตลาดซื้อขายเช่าProเอกสาร API
ภาษา
Actual Computer — Every computer, one endpoint

โมเดล

242 model groups · 959 total

Qwen3.8-27B

Qwen / Qwen3.8-27B

Qwenimage-text-to-text132 การทดสอบความเร็ว
27Bqwen3_5conversational
ดีที่สุด435 tok/s
มัธยฐาน49.0 tok/s
ต่ำสุด4.4 tok/s
Eval score· 3 evalsBF16+
69.4%
ดูผลทดสอบความเร็ว →

Qwen3.6-35B-A3B

Qwen / Qwen3.6-35B-A3B

Qwenimage-text-to-text205 การทดสอบความเร็ว
MoE3B active / 35B totalqwen3_5_moeconversational
ดีที่สุด6.0k tok/s
มัธยฐาน69.0 tok/s
ต่ำสุด6.4 tok/s
Eval score· 2 evalsBF16+
91.6%
ดูผลทดสอบความเร็ว →

Qwen3.6-27B

Qwen / Qwen3.6-27B

Qwenimage-text-to-text179 การทดสอบความเร็ว
27Bqwen3_5conversational
ดีที่สุด439 tok/s
มัธยฐาน43.7 tok/s
ต่ำสุด1.6 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.8-27B-MTP-GGUF

Jackrong / Qwen3.8-27B-MTP-GGUF

Qwenimage-text-to-text236 การทดสอบความเร็ว
27Bllama.cppvisionmultimodal
ดีที่สุด72.6 tok/s
มัธยฐาน36.6 tok/s
ต่ำสุด11.6 tok/s
ดูผลทดสอบความเร็ว →

Ornith-1.5-35B-A3B

ornith-ai / Ornith-1.5-35B-A3B

Qwentext-generation1 การทดสอบความเร็ว
MoE3B active / 35B totalqwen3_5_moeimage-text-to-textconversational
ดีที่สุด35.4 tok/s
มัธยฐาน35.4 tok/s
ต่ำสุด35.4 tok/s
ดูผลทดสอบความเร็ว →

gemma-4-26B-A4B

google / gemma-4-26B-A4B

Gemmaimage-text-to-text
MoE4B active / 26B totalgemma4
ดูผลทดสอบความเร็ว →

Qwen3.5-9B-Base

Qwen / Qwen3.5-9B-Base

Qwenimage-text-to-text
9Bqwen3_5conversational
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16

nvidia / NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16

text-generation16 การทดสอบความเร็ว
MoE3B active / 30B totalnemotron_hnvidianemotron-3.5
ดีที่สุด7.2k tok/s
มัธยฐาน140 tok/s
ต่ำสุด49.8 tok/s
ดูผลทดสอบความเร็ว →

Ornith-1.5-35B-A3B-GGUF

ornith-ai / Ornith-1.5-35B-A3B-GGUF

text-generation129 การทดสอบความเร็ว
MoE3B active / 35B totalconversational
ดีที่สุด131 tok/s
มัธยฐาน105 tok/s
ต่ำสุด26.5 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.8-Flash-Next

Qwen / Qwen3.8-Flash-Next

Qwenimage-text-to-text35 การทดสอบความเร็ว
180Bqwen4_expconversational
ดีที่สุด205 tok/s
มัธยฐาน69.0 tok/s
ต่ำสุด7.7 tok/s
Eval score· 2 evalsW4B
85.7%
ดูผลทดสอบความเร็ว →

MiniMax-M2.7

MiniMaxAI / MiniMax-M2.7

Minimaxtext-generation40 การทดสอบความเร็ว
MoE229Bminimax_m2conversationalfp8
ดีที่สุด496 tok/s
มัธยฐาน32.2 tok/s
ต่ำสุด0.5 tok/s
ดูผลทดสอบความเร็ว →

DeepSeek-V4-Flash-0731

deepseek-ai / DeepSeek-V4-Flash-0731

Deepseektext-generation73 การทดสอบความเร็ว
MoE304Bdeepseek_v48-bitfp8
ดีที่สุด404 tok/s
มัธยฐาน84.8 tok/s
ต่ำสุด19.0 tok/s
Eval score· 5 evalsFP8
90.4%
ดูผลทดสอบความเร็ว →

gemma-4-12B

google / gemma-4-12B

Gemmaany-to-any1 การทดสอบความเร็ว
12Bgemma4_unifiedimage-text-to-text
ดีที่สุด25.8 tok/s
มัธยฐาน25.8 tok/s
ต่ำสุด25.8 tok/s
ดูผลทดสอบความเร็ว →

granite-4.1-30b-base

ibm-granite / granite-4.1-30b-base

text-generation
30Bgranitelanguagegranite-4.1
ดูผลทดสอบความเร็ว →

gemma-4-E4B

google / gemma-4-E4B

Gemmaany-to-any3 การทดสอบความเร็ว
4Bgemma4image-text-to-text
ดีที่สุด71.2 tok/s
มัธยฐาน70.5 tok/s
ต่ำสุด70.5 tok/s
ดูผลทดสอบความเร็ว →

GLM-5.3-Flash

zai-org / GLM-5.3-Flash

image-text-to-text52 การทดสอบความเร็ว
321Bglm5_nextconversationalen
ดีที่สุด1.5k tok/s
มัธยฐาน127 tok/s
ต่ำสุด15.3 tok/s
Eval score· 8 evalsexl3+
73.4%
ดูผลทดสอบความเร็ว →

Qwen3.5-35B-A3B-Base

Qwen / Qwen3.5-35B-A3B-Base

Qwenimage-text-to-text
MoE3B active / 35B totalqwen3_5_moeconversational
ดูผลทดสอบความเร็ว →

Ornith-1.0-35B

ornith-ai / Ornith-1.0-35B

Qwentext-generation14 การทดสอบความเร็ว
MoE35Bqwen3_5_moeimage-text-to-textconversational
ดีที่สุด164 tok/s
มัธยฐาน71.8 tok/s
ต่ำสุด54.1 tok/s
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-Nano-12B-v2-Base

nvidia / NVIDIA-Nemotron-Nano-12B-v2-Base

text-generation
12Bnvidiaenes
ดูผลทดสอบความเร็ว →

Qwen3-8B-Base

Qwen / Qwen3-8B-Base

Qwentext-generation
8Bqwen3conversational
ดูผลทดสอบความเร็ว →

Ornith-1.5-9B

ornith-ai / Ornith-1.5-9B

Qwentext-generation92 การทดสอบความเร็ว
9Bqwen3_5image-text-to-textconversational
ดีที่สุด3.3k tok/s
มัธยฐาน73.3 tok/s
ต่ำสุด9.2 tok/s
Eval score· 1 evalBF16
81.7%
ดูผลทดสอบความเร็ว →

Qwen3.5-27B

Qwen / Qwen3.5-27B

Qwenimage-text-to-text19 การทดสอบความเร็ว
27Bqwen3_5conversational
ดีที่สุด287 tok/s
มัธยฐาน25.1 tok/s
ต่ำสุด2.2 tok/s
ดูผลทดสอบความเร็ว →

GLM-5.2

zai-org / GLM-5.2

text-generation
MoE753Bglm_moe_dsaconversationalen
ดูผลทดสอบความเร็ว →

DeepSeek-V4-Flash

deepseek-ai / DeepSeek-V4-Flash

Deepseektext-generation38 การทดสอบความเร็ว
MoE291Bdeepseek_v48-bitfp8
ดีที่สุด262 tok/s
มัธยฐาน28.5 tok/s
ต่ำสุด7.0 tok/s
Eval score· 1 evalIQ3_XXS
94.8%
ดูผลทดสอบความเร็ว →

Laguna-S-2.1

poolside / Laguna-S-2.1

text-generation47 การทดสอบความเร็ว
MoE118Blagunalaguna-s-2.1vllm
ดีที่สุด127 tok/s
มัธยฐาน41.9 tok/s
ต่ำสุด15.1 tok/s
ดูผลทดสอบความเร็ว →

LFM2.5-8B-A1B-Base

LiquidAI / LFM2.5-8B-A1B-Base

text-generation
MoE1B active / 8B totallfm2_moeliquidlfm2.5
ดูผลทดสอบความเร็ว →

gemma-4-31B

google / gemma-4-31B

Gemmaimage-text-to-text
31Bgemma4
ดูผลทดสอบความเร็ว →

gpt-oss-20b

openai / gpt-oss-20b

Gpttext-generation54 การทดสอบความเร็ว
MoE20Bgpt_ossvllmconversational
ดีที่สุด991 tok/s
มัธยฐาน107 tok/s
ต่ำสุด12.0 tok/s
ดูผลทดสอบความเร็ว →

Qwen2.5-7B

Qwen / Qwen2.5-7B

Qwentext-generation2 การทดสอบความเร็ว
7Bqwen2conversationalen
ดีที่สุด1.4k tok/s
มัธยฐาน1.4k tok/s
ต่ำสุด1.4k tok/s
ดูผลทดสอบความเร็ว →

InternViT-300M-448px

OpenGVLab / InternViT-300M-448px

image-feature-extraction
0.3Bintern_vit_6bfeature-extraction
ดูผลทดสอบความเร็ว →

Muse-Glimmer-30B

meta-models / Muse-Glimmer-30B

image-text-to-text28 การทดสอบความเร็ว
30Bmuse_glimmerconversational
ดีที่สุด332 tok/s
มัธยฐาน41.9 tok/s
ต่ำสุด12.8 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-0.6B-Base

Qwen / Qwen3-0.6B-Base

Qwentext-generation
0.6Bqwen3conversational
ดูผลทดสอบความเร็ว →

Phi-4-mini-reasoning

microsoft / Phi-4-mini-reasoning

Phitext-generation10 การทดสอบความเร็ว
4Bphi3nlpmath
ดีที่สุด162 tok/s
มัธยฐาน97.4 tok/s
ต่ำสุด32.9 tok/s
ดูผลทดสอบความเร็ว →

Ornith-1.5-9B-GGUF

ornith-ai / Ornith-1.5-9B-GGUF

text-generation52 การทดสอบความเร็ว
9Bconversational
ดีที่สุด92.0 tok/s
มัธยฐาน41.7 tok/s
ต่ำสุด32.3 tok/s
ดูผลทดสอบความเร็ว →

LFM2-350M

LiquidAI / LFM2-350M

text-generation39 การทดสอบความเร็ว
350Mlfm2liquidedge
ดีที่สุด637 tok/s
มัธยฐาน232 tok/s
ต่ำสุด142 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-Coder-30B-A3B-Instruct

Qwen / Qwen3-Coder-30B-A3B-Instruct

Qwentext-generation29 การทดสอบความเร็ว
MoE3B active / 30B totalqwen3_moeconversational
ดีที่สุด136 tok/s
มัธยฐาน80.5 tok/s
ต่ำสุด14.4 tok/s
Eval score· 1 evalQ4_K_M
92.1%
ดูผลทดสอบความเร็ว →

Llama-3.2-3B-Instruct

meta-llama / Llama-3.2-3B-Instruct

Llamatext-generation50 การทดสอบความเร็ว
3Bfacebookmetallama-3
ดีที่สุด489 tok/s
มัธยฐาน75.9 tok/s
ต่ำสุด10.0 tok/s
ดูผลทดสอบความเร็ว →

Ornith-1.0-9B

ornith-ai / Ornith-1.0-9B

Qwentext-generation44 การทดสอบความเร็ว
9Bqwen3_5image-text-to-textconversational
ดีที่สุด77.5 tok/s
มัธยฐาน25.7 tok/s
ต่ำสุด3.8 tok/s
Eval score· 3 evalsQ4_K_M
56.0%
ดูผลทดสอบความเร็ว →

Qwen3-14B-Base

Qwen / Qwen3-14B-Base

Qwentext-generation
14Bqwen3conversational
ดูผลทดสอบความเร็ว →

Laguna-XS-2.1

poolside / Laguna-XS-2.1

text-generation6 การทดสอบความเร็ว
MoE33Blagunalaguna-xs-2.1vllm
ดีที่สุด296 tok/s
มัธยฐาน106 tok/s
ต่ำสุด72.5 tok/s
ดูผลทดสอบความเร็ว →

LFM2.5-1.2B-Base

LiquidAI / LFM2.5-1.2B-Base

text-generation
1.2Blfm2liquidlfm2.5
ดูผลทดสอบความเร็ว →

gemma-3-12b-pt

google / gemma-3-12b-pt

Gemmaimage-text-to-text
12Bgemma3
ดูผลทดสอบความเร็ว →

Qwen3.5-4B-Base

Qwen / Qwen3.5-4B-Base

Qwenimage-text-to-text
4Bqwen3_5conversational
ดูผลทดสอบความเร็ว →

gemma-4-E2B

google / gemma-4-E2B

Gemmaany-to-any
2Bgemma4image-text-to-text
ดูผลทดสอบความเร็ว →

DeepSeek-R1-Distill-Qwen-7B

deepseek-ai / DeepSeek-R1-Distill-Qwen-7B

Deepseek-R1text-generation28 การทดสอบความเร็ว
7Bqwen2conversational
ดีที่สุด144 tok/s
มัธยฐาน63.6 tok/s
ต่ำสุด12.8 tok/s
ดูผลทดสอบความเร็ว →

MiniCPM5-1B-GGUF

openbmb / MiniCPM5-1B-GGUF

Llamatext-generation37 การทดสอบความเร็ว
1Bminicpmminicpm5long-context
ดีที่สุด222 tok/s
มัธยฐาน99.8 tok/s
ต่ำสุด32.0 tok/s
Eval score· 3 evals
52.2%
ดูผลทดสอบความเร็ว →

Ornstein3.6-27B-MTP-NSC-ACE-SABER

GestaltLabs / Ornstein3.6-27B-MTP-NSC-ACE-SABER

Qwenimage-text-to-text
27Bqwen3_5qwen3.6mtp
ดูผลทดสอบความเร็ว →

AceReason-Nemotron-1.1-7B

nvidia / AceReason-Nemotron-1.1-7B

Qwentext-generation28 การทดสอบความเร็ว
7Bqwen2nvidiareasoning
ดีที่สุด79.8 tok/s
มัธยฐาน63.6 tok/s
ต่ำสุด12.8 tok/s
ดูผลทดสอบความเร็ว →

LFM2-8B-A1B

LiquidAI / LFM2-8B-A1B

text-generation24 การทดสอบความเร็ว
MoE1B active / 8B totallfm2_moeliquidlfm2
ดีที่สุด243 tok/s
มัธยฐาน211 tok/s
ต่ำสุด9.9 tok/s
ดูผลทดสอบความเร็ว →

phi-4

microsoft / phi-4

Phitext-generation3 การทดสอบความเร็ว
15Bphi3nlpmath
ดีที่สุด77.0 tok/s
มัธยฐาน36.0 tok/s
ต่ำสุด36.0 tok/s
ดูผลทดสอบความเร็ว →

Nex-N2-mini

nex-agi / Nex-N2-mini

Qwentext-generation9 การทดสอบความเร็ว
MoE35Bqwen3_5_moeimage-text-to-textconversational
ดีที่สุด107 tok/s
มัธยฐาน104 tok/s
ต่ำสุด40.5 tok/s
ดูผลทดสอบความเร็ว →

Mistral-Small-24B-Base-2501

mistralai / Mistral-Small-24B-Base-2501

Mistral
24Bvllmmistral-commonen
ดูผลทดสอบความเร็ว →

Qwen3.5-122B-A10B

Qwen / Qwen3.5-122B-A10B

Qwenimage-text-to-text15 การทดสอบความเร็ว
MoE10B active / 122B totalqwen3_5_moeconversational
ดีที่สุด50.1 tok/s
มัธยฐาน26.4 tok/s
ต่ำสุด3.2 tok/s
ดูผลทดสอบความเร็ว →

DeepSeek-R1-Distill-Qwen-14B

deepseek-ai / DeepSeek-R1-Distill-Qwen-14B

Deepseek-R1text-generation10 การทดสอบความเร็ว
14Bqwen2conversational
ดีที่สุด50.9 tok/s
มัธยฐาน38.0 tok/s
ต่ำสุด9.0 tok/s
ดูผลทดสอบความเร็ว →

LFM2.5-350M-Base

LiquidAI / LFM2.5-350M-Base

text-generation
350Mlfm2liquidlfm2.5
ดูผลทดสอบความเร็ว →

GLM-4.7-Flash

zai-org / GLM-4.7-Flash

text-generation9 การทดสอบความเร็ว
MoE31Bglm4_moe_liteconversationalen
ดีที่สุด212 tok/s
มัธยฐาน93.3 tok/s
ต่ำสุด17.2 tok/s
ดูผลทดสอบความเร็ว →

Ornith-1.0-9B-GGUF

ornith-ai / Ornith-1.0-9B-GGUF

text-generation32 การทดสอบความเร็ว
9Bconversational
ดีที่สุด88.1 tok/s
มัธยฐาน34.9 tok/s
ต่ำสุด11.0 tok/s
Eval score· 1 eval
89.4%
ดูผลทดสอบความเร็ว →

Nemotron-Cascade-2-30B-A3B

nvidia / Nemotron-Cascade-2-30B-A3B

text-generation16 การทดสอบความเร็ว
MoE3B active / 30B totalnemotron_hnvidianemotron-cascade-2
ดีที่สุด197 tok/s
มัธยฐาน155 tok/s
ต่ำสุด89.8 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-1.7B-Base

Qwen / Qwen3-1.7B-Base

Qwentext-generation
1.7Bqwen3conversational
ดูผลทดสอบความเร็ว →

Meta-Llama-3-8B-Instruct

meta-llama / Meta-Llama-3-8B-Instruct

Llamatext-generation31 การทดสอบความเร็ว
8Bfacebookmetallama-3
ดีที่สุด148 tok/s
มัธยฐาน48.4 tok/s
ต่ำสุด13.6 tok/s
ดูผลทดสอบความเร็ว →

Ornith-1.0-35B-GGUF

ornith-ai / Ornith-1.0-35B-GGUF

text-generation31 การทดสอบความเร็ว
35Bconversational
ดีที่สุด310 tok/s
มัธยฐาน60.6 tok/s
ต่ำสุด27.4 tok/s
ดูผลทดสอบความเร็ว →

Qwen2.5-3B

Qwen / Qwen2.5-3B

Qwentext-generation
3Bqwen2conversationalen
ดูผลทดสอบความเร็ว →

Ministral-3-3B-Base-2512

mistralai / Ministral-3-3B-Base-2512

Mistral
3Bvllmmistral3mistral-common
ดูผลทดสอบความเร็ว →

Agents-A1

InternScience / Agents-A1

Qwentext-generation12 การทดสอบความเร็ว
MoE35Bqwen3_5_moeimage-text-to-textmoe
ดีที่สุด96.4 tok/s
มัธยฐาน76.7 tok/s
ต่ำสุด13.6 tok/s
Eval score· 1 eval
100.0%
ดูผลทดสอบความเร็ว →

gpt-oss-120b

openai / gpt-oss-120b

Gpttext-generation25 การทดสอบความเร็ว
MoE120Bgpt_ossvllmconversational
ดีที่สุด223 tok/s
มัธยฐาน72.6 tok/s
ต่ำสุด34.4 tok/s
Eval score· 2 evalsMXFP4
78.4%
ดูผลทดสอบความเร็ว →

LFM2.5-230M-Base

LiquidAI / LFM2.5-230M-Base

text-generation
230Mlfm2liquidlfm2.5
ดูผลทดสอบความเร็ว →

Qwen3.5-0.8B-Base

Qwen / Qwen3.5-0.8B-Base

Qwenimage-text-to-text1 การทดสอบความเร็ว
0.8Bqwen3_5conversational
ดีที่สุด2.7k tok/s
มัธยฐาน2.7k tok/s
ต่ำสุด2.7k tok/s
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF

lmstudio-community / NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF

26 การทดสอบความเร็ว
MoE3B active / 30B totalconversational
ดีที่สุด203 tok/s
มัธยฐาน36.4 tok/s
ต่ำสุด14.4 tok/s
ดูผลทดสอบความเร็ว →

Trinity-Mini-Base-Pre-Anneal

arcee-ai / Trinity-Mini-Base-Pre-Anneal

Arceetext-generation
MoE26Bafmoeenes
ดูผลทดสอบความเร็ว →

reka-flash-3

RekaAI / reka-flash-3

Llama23 การทดสอบความเร็ว
21B
ดีที่สุด36.3 tok/s
มัธยฐาน23.1 tok/s
ต่ำสุด6.0 tok/s
ดูผลทดสอบความเร็ว →

Qwen2.5-14B

Qwen / Qwen2.5-14B

Qwentext-generation
14Bqwen2conversationalen
ดูผลทดสอบความเร็ว →

Qwen3-Coder-Next

Qwen / Qwen3-Coder-Next

Qwentext-generation19 การทดสอบความเร็ว
MoE80Bqwen3_nextconversational
ดีที่สุด80.8 tok/s
มัธยฐาน55.8 tok/s
ต่ำสุด47.0 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-4B-Base

Qwen / Qwen3-4B-Base

Qwentext-generation
4Bqwen3conversational
ดูผลทดสอบความเร็ว →

GLM-5.3-Flash-BF16

zai-org / GLM-5.3-Flash-BF16

image-text-to-text
321Bglm5_nextconversationalen
ดูผลทดสอบความเร็ว →

Qwen2.5-32B

Qwen / Qwen2.5-32B

Qwentext-generation
32Bqwen2conversationalen
ดูผลทดสอบความเร็ว →

BTL-4

badtheorylabs / BTL-4

Qwentext-generation
MoE35Bqwen3_5_moeimage-text-to-textagentic
ดูผลทดสอบความเร็ว →

Hy-MT2-7B

tencent / Hy-MT2-7B

translation7 การทดสอบความเร็ว
7Bhunyuan_v1_densetext-generationzh
ดีที่สุด98.1 tok/s
มัธยฐาน31.0 tok/s
ต่ำสุด25.5 tok/s
Eval score· 3 evals
76.0%
ดูผลทดสอบความเร็ว →

DeepSeek-R1-Distill-Qwen-32B

deepseek-ai / DeepSeek-R1-Distill-Qwen-32B

Deepseek-R1text-generation4 การทดสอบความเร็ว
32Bqwen2conversational
ดีที่สุด23.3 tok/s
มัธยฐาน22.3 tok/s
ต่ำสุด21.4 tok/s
ดูผลทดสอบความเร็ว →

Nemotron-Cascade-14B-Thinking

nvidia / Nemotron-Cascade-14B-Thinking

Qwentext-generation18 การทดสอบความเร็ว
14Bqwen3nvidianemotron-cascade
ดีที่สุด51.9 tok/s
มัธยฐาน34.2 tok/s
ต่ำสุด6.2 tok/s
ดูผลทดสอบความเร็ว →

GLM-Z1-32B-0414

zai-org / GLM-Z1-32B-0414

text-generation17 การทดสอบความเร็ว
32Bglm4conversationalzh
ดีที่สุด22.5 tok/s
มัธยฐาน16.4 tok/s
ต่ำสุด5.7 tok/s
ดูผลทดสอบความเร็ว →

Olmo-3-1125-32B

allenai / Olmo-3-1125-32B

text-generation
32Bolmo3en
ดูผลทดสอบความเร็ว →

MiniCPM5-1B

openbmb / MiniCPM5-1B

Llamatext-generation16 การทดสอบความเร็ว
1Bminicpmminicpm5long-context
ดีที่สุด158 tok/s
มัธยฐาน101 tok/s
ต่ำสุด2.9 tok/s
Eval score· 2 evals
34.1%
ดูผลทดสอบความเร็ว →

North-Mini-Code-1.0

CohereLabs / North-Mini-Code-1.0

Coheretext-generation17 การทดสอบความเร็ว
MoE30Bcohere2_moeconversationalchat
ดีที่สุด258 tok/s
มัธยฐาน102 tok/s
ต่ำสุด38.7 tok/s
ดูผลทดสอบความเร็ว →

Llama-3.1-8B

meta-llama / Llama-3.1-8B

Llamatext-generation
8Bfacebookmetallama-3
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

nvidia / NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

Opttext-generation16 การทดสอบความเร็ว
MoE3B active / 30B totalnemotron_hnvidianemotron-3.5
ดีที่สุด6.7k tok/s
มัธยฐาน254 tok/s
ต่ำสุด77.1 tok/s
Eval score· 3 evalsNVFP4
74.8%
ดูผลทดสอบความเร็ว →

Step-3.7-Flash

stepfun-ai / Step-3.7-Flash

image-text-to-text5 การทดสอบความเร็ว
MoE201Bstep3p7vision-languagemultimodal
ดีที่สุด31.0 tok/s
มัธยฐาน30.8 tok/s
ต่ำสุด30.7 tok/s
ดูผลทดสอบความเร็ว →

gemma-3-1b-pt

google / gemma-3-1b-pt

Gemmatext-generation
1Bgemma3_text
ดูผลทดสอบความเร็ว →

DeepSeek-V4.1-Flash

deepseek-ai / DeepSeek-V4.1-Flash

Deepseekimage-text-to-text14 การทดสอบความเร็ว
763Bdeepseek_v41text-generationconversational
ดีที่สุด352 tok/s
มัธยฐาน74.0 tok/s
ต่ำสุด31.7 tok/s
ดูผลทดสอบความเร็ว →

QUEST-30B-RL

osunlp / QUEST-30B-RL

Qwentext-generation
MoE30Bqwen3_moequestconversational
ดูผลทดสอบความเร็ว →

Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16

nvidia / Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16

any-to-any5 การทดสอบความเร็ว
MoE3B active / 30B totalNemotronH_Nano_Omni_Reasoning_V3feature-extractionnvidia
ดีที่สุด107 tok/s
มัธยฐาน90.6 tok/s
ต่ำสุด57.9 tok/s
Eval score· 1 eval
100.0%
ดูผลทดสอบความเร็ว →

Agents-A1-4B

InternScience / Agents-A1-4B

Qwentext-generation
4Bqwen3_5image-text-to-textvlm
ดูผลทดสอบความเร็ว →

InternViT-6B-224px

OpenGVLab / InternViT-6B-224px

image-feature-extraction
6Bintern_vit_6bfeature-extraction
ดูผลทดสอบความเร็ว →

Qwen3-30B-A3B-Base

Qwen / Qwen3-30B-A3B-Base

Qwentext-generation
MoE3B active / 30B totalqwen3_moeconversational
ดูผลทดสอบความเร็ว →

KAT-Coder-V2.5-Dev

Kwaipilot / KAT-Coder-V2.5-Dev

Qwentext-generation4 การทดสอบความเร็ว
MoE35Bqwen3_5_moeimage-text-to-textcode
ดีที่สุด75.9 tok/s
มัธยฐาน75.0 tok/s
ต่ำสุด66.3 tok/s
ดูผลทดสอบความเร็ว →

Mellum2-12B-A2.5B-Instruct

JetBrains / Mellum2-12B-A2.5B-Instruct

text-generation3 การทดสอบความเร็ว
MoE2.5B active / 12B totalmellumconversationalen
ดีที่สุด83.5 tok/s
มัธยฐาน51.8 tok/s
ต่ำสุด41.8 tok/s
ดูผลทดสอบความเร็ว →

Mistral-Medium-3.5-128B

mistralai / Mistral-Medium-3.5-128B

Mistral13 การทดสอบความเร็ว
128Bmistral3vLLMen
ดีที่สุด7.4 tok/s
มัธยฐาน6.5 tok/s
ต่ำสุด6.2 tok/s
ดูผลทดสอบความเร็ว →

Tess-4-35B-A3B

migtissera / Tess-4-35B-A3B

Qwen12 การทดสอบความเร็ว
MoE3B active / 35B totalqwen3_5_moe
ดีที่สุด155 tok/s
มัธยฐาน140 tok/s
ต่ำสุด33.1 tok/s
ดูผลทดสอบความเร็ว →

GLM-4.5-Air

zai-org / GLM-4.5-Air

text-generation9 การทดสอบความเร็ว
MoE110Bglm4_moeconversationalen
ดีที่สุด2.5k tok/s
มัธยฐาน103 tok/s
ต่ำสุด6.2 tok/s
ดูผลทดสอบความเร็ว →

Ling-3.0-tiny

inclusionAI / Ling-3.0-tiny

text-generation9 การทดสอบความเร็ว
MoE8Bbailing_hybridconversational
ดีที่สุด369 tok/s
มัธยฐาน129 tok/s
ต่ำสุด52.6 tok/s
ดูผลทดสอบความเร็ว →

GLM-Z1-Rumination-32B-0414

zai-org / GLM-Z1-Rumination-32B-0414

text-generation11 การทดสอบความเร็ว
32Bglm4conversationalzh
ดีที่สุด22.4 tok/s
มัธยฐาน19.7 tok/s
ต่ำสุด8.8 tok/s
ดูผลทดสอบความเร็ว →

MiniMax-M2.5

MiniMaxAI / MiniMax-M2.5

Minimaxtext-generation2 การทดสอบความเร็ว
MoE229Bminimax_m2conversationalfp8
ดีที่สุด504 tok/s
มัธยฐาน419 tok/s
ต่ำสุด334 tok/s
ดูผลทดสอบความเร็ว →

granite-4.0-h-micro

ibm-granite / granite-4.0-h-micro

text-generation11 การทดสอบความเร็ว
MoE3Bgranitemoehybridlanguagegranite-4.0
ดีที่สุด141 tok/s
มัธยฐาน45.0 tok/s
ต่ำสุด7.9 tok/s
Eval score· 3 evalsQ4_K_M
53.3%
ดูผลทดสอบความเร็ว →

Mistral-Small-3.1-24B-Base-2503

mistralai / Mistral-Small-3.1-24B-Base-2503

Mistral
24Bvllmmistral3mistral-common
ดูผลทดสอบความเร็ว →

Seed-OSS-36B-Instruct

ByteDance-Seed / Seed-OSS-36B-Instruct

text-generation
36Bseed_ossvllmconversational
ดูผลทดสอบความเร็ว →

Qwen3.6-27B-DFlash

z-lab / Qwen3.6-27B-DFlash

Qwentext-generation10 การทดสอบความเร็ว
27Bqwen3feature-extractiondflash
ดีที่สุด215 tok/s
มัธยฐาน39.2 tok/s
ต่ำสุด26.9 tok/s
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3-Nano-30B-A3B-BF16

nvidia / NVIDIA-Nemotron-3-Nano-30B-A3B-BF16

text-generation3 การทดสอบความเร็ว
MoE3B active / 30B totalnemotron_hnvidiaconversational
ดีที่สุด313 tok/s
มัธยฐาน286 tok/s
ต่ำสุด117 tok/s
ดูผลทดสอบความเร็ว →

Ling-3.0-flash

inclusionAI / Ling-3.0-flash

text-generation9 การทดสอบความเร็ว
MoE127Bbailing_hybridconversational
ดีที่สุด72.3 tok/s
มัธยฐาน43.4 tok/s
ต่ำสุด33.6 tok/s
ดูผลทดสอบความเร็ว →

Hunyuan-MT-7B

tencent / Hunyuan-MT-7B

translation9 การทดสอบความเร็ว
7Bhunyuan_v1_densetext-generation
ดีที่สุด98.1 tok/s
มัธยฐาน74.3 tok/s
ต่ำสุด28.5 tok/s
ดูผลทดสอบความเร็ว →

MiMo-V2.5

XiaomiMiMo / MiMo-V2.5

text-generation5 การทดสอบความเร็ว
MoE311Bmimo_v2multimodalvision-language
ดีที่สุด33.9 tok/s
มัธยฐาน32.7 tok/s
ต่ำสุด28.1 tok/s
ดูผลทดสอบความเร็ว →

Hy-MT2-30B-A3B

tencent / Hy-MT2-30B-A3B

translation
MoE3B active / 30B totalhy_v3text-generationzh
ดูผลทดสอบความเร็ว →

Llama-3.2-1B-Instruct

meta-llama / Llama-3.2-1B-Instruct

Llamatext-generation7 การทดสอบความเร็ว
1Bfacebookmetallama-3
ดีที่สุด448 tok/s
มัธยฐาน184 tok/s
ต่ำสุด68.2 tok/s
ดูผลทดสอบความเร็ว →

SmolLM2-135M

HuggingFaceTB / SmolLM2-135M

Llamatext-generation
135Men
ดูผลทดสอบความเร็ว →

internlm3-8b-instruct

internlm / internlm3-8b-instruct

Internlmtext-generation
8Binternlm3conversational
ดูผลทดสอบความเร็ว →

Nemotron-Cascade-8B

nvidia / Nemotron-Cascade-8B

Qwentext-generation
8Bqwen3nvidiaNemotron-Cascade
ดูผลทดสอบความเร็ว →

UI-TARS-7B-DPO

ByteDance-Seed / UI-TARS-7B-DPO

Qwenimage-text-to-text
7Bqwen2_vlmultimodalgui
ดูผลทดสอบความเร็ว →

EXAONE-3.5-7.8B-Instruct

LGAI-EXAONE / EXAONE-3.5-7.8B-Instruct

text-generation8 การทดสอบความเร็ว
7.8Bexaonelg-aiexaone-3.5
ดีที่สุด26.8 tok/s
มัธยฐาน25.7 tok/s
ต่ำสุด11.2 tok/s
ดูผลทดสอบความเร็ว →

Ling-2.6-flash

inclusionAI / Ling-2.6-flash

text-generation8 การทดสอบความเร็ว
MoE107Bbailing_hybridconversationalen
ดีที่สุด94.9 tok/s
มัธยฐาน86.2 tok/s
ต่ำสุด82.3 tok/s
ดูผลทดสอบความเร็ว →

Qwen2.5-72B

Qwen / Qwen2.5-72B

Qwentext-generation
72Bqwen2conversationalen
ดูผลทดสอบความเร็ว →

Spark-X2.5-4B-Base

XHToken / Spark-X2.5-4B-Base

text-generation
4Bspark2_5llmsparkx2_5
ดูผลทดสอบความเร็ว →

Tinystories-gpt-0.1-3m

segestic / Tinystories-gpt-0.1-3m

Gpttext-generation5 การทดสอบความเร็ว
3Mgpt2en
ดีที่สุด5.0k tok/s
มัธยฐาน4.9k tok/s
ต่ำสุด1.3k tok/s
ดูผลทดสอบความเร็ว →

Qwen3-30B-A3B-Instruct-2507

Qwen / Qwen3-30B-A3B-Instruct-2507

Qwentext-generation4 การทดสอบความเร็ว
MoE3B active / 30B totalqwen3_moeconversational
ดีที่สุด100 tok/s
มัธยฐาน72.5 tok/s
ต่ำสุด16.6 tok/s
ดูผลทดสอบความเร็ว →

Kimi-Linear-48B-A3B-Instruct

moonshotai / Kimi-Linear-48B-A3B-Instruct

text-generation7 การทดสอบความเร็ว
MoE3B active / 48B totalkimi_linearconversational
ดีที่สุด281 tok/s
มัธยฐาน233 tok/s
ต่ำสุด90.0 tok/s
ดูผลทดสอบความเร็ว →

rwkv-7-world

BlinkDL / rwkv-7-world

Starcodertext-generation
rwkvcausal-lmen
ดูผลทดสอบความเร็ว →

Qwen3.5-2B-Base

Qwen / Qwen3.5-2B-Base

Qwenimage-text-to-text
2Bqwen3_5conversational
ดูผลทดสอบความเร็ว →

Llama-3.1-70B

meta-llama / Llama-3.1-70B

Llamatext-generation
70Bfacebookmetallama-3
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3-Super-120B-A12B-BF16

nvidia / NVIDIA-Nemotron-3-Super-120B-A12B-BF16

text-generation
MoE12B active / 120B totalnemotron_hnvidianemotron-3
ดูผลทดสอบความเร็ว →

Hy3

tencent / Hy3

text-generation
MoE299Bhy_v3hunyuanhy3
ดูผลทดสอบความเร็ว →

Qwen2.5-0.5B

Qwen / Qwen2.5-0.5B

Qwentext-generation
0.5Bqwen2conversationalen
ดูผลทดสอบความเร็ว →

DeepSeek-Coder-V2-Lite-Instruct

deepseek-ai / DeepSeek-Coder-V2-Lite-Instruct

Deepseek-Codertext-generation6 การทดสอบความเร็ว
MoE16Bdeepseek_v2conversational
ดีที่สุด150 tok/s
มัธยฐาน87.0 tok/s
ต่ำสุด39.0 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.8-Flash-Next-oQ4e-mtp

Jundot / Qwen3.8-Flash-Next-oQ4e-mtp

Qwen5 การทดสอบความเร็ว
180Bmlxqwen4_expoq
ดีที่สุด92.6 tok/s
มัธยฐาน70.6 tok/s
ต่ำสุด38.1 tok/s
ดูผลทดสอบความเร็ว →

glm-4-9b-chat

zai-org / glm-4-9b-chat

Chatglm
9Bglmthudmzh
ดูผลทดสอบความเร็ว →

SmolLM2-360M

HuggingFaceTB / SmolLM2-360M

Llamatext-generation
360Men
ดูผลทดสอบความเร็ว →

Qwen3-Coder-Next-FP8

Qwen / Qwen3-Coder-Next-FP8

Qwentext-generation5 การทดสอบความเร็ว
MoE80Bqwen3_nextconversationalfp8
ดีที่สุด190 tok/s
มัธยฐาน152 tok/s
ต่ำสุด112 tok/s
ดูผลทดสอบความเร็ว →

Llama-2-7b-hf

meta-llama / Llama-2-7b-hf

Llamatext-generation5 การทดสอบความเร็ว
7Bfacebookmetallama-2
ดีที่สุด202 tok/s
มัธยฐาน50.4 tok/s
ต่ำสุด19.1 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-VL-8B-Instruct

Qwen / Qwen3-VL-8B-Instruct

Qwenimage-text-to-text3 การทดสอบความเร็ว
8Bqwen3_vlconversational
ดีที่สุด95.9 tok/s
มัธยฐาน89.8 tok/s
ต่ำสุด58.8 tok/s
ดูผลทดสอบความเร็ว →

Qwen2.5-1.5B

Qwen / Qwen2.5-1.5B

Qwentext-generation
1.5Bqwen2conversationalen
ดูผลทดสอบความเร็ว →

Qwen3-32B

Qwen / Qwen3-32B

Qwentext-generation5 การทดสอบความเร็ว
32Bqwen3conversational
ดีที่สุด79.3 tok/s
มัธยฐาน22.8 tok/s
ต่ำสุด3.2 tok/s
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4

nvidia / NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4

Opttext-generation5 การทดสอบความเร็ว
MoE12B active / 120B totalnemotron_hnvidianemotron-3
ดีที่สุด262 tok/s
มัธยฐาน175 tok/s
ต่ำสุด49.6 tok/s
ดูผลทดสอบความเร็ว →

MiniCPM5-2B

openbmb / MiniCPM5-2B

Llamatext-generation4 การทดสอบความเร็ว
2Bminicpmminicpm5long-context
ดีที่สุด118 tok/s
มัธยฐาน66.8 tok/s
ต่ำสุด61.6 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-235B-A22B

Qwen / Qwen3-235B-A22B

Qwentext-generation
MoE22B active / 235B totalqwen3_moeconversational
ดูผลทดสอบความเร็ว →

Spark-X2.5-1.7B-Base

XHToken / Spark-X2.5-1.7B-Base

text-generation
1.7Bspark2_5llmsparkx2_5
ดูผลทดสอบความเร็ว →

Qwen3-235B-A22B-Thinking-2507

Qwen / Qwen3-235B-A22B-Thinking-2507

Qwentext-generation4 การทดสอบความเร็ว
MoE22B active / 235B totalqwen3_moeconversational
ดีที่สุด17.5 tok/s
มัธยฐาน15.8 tok/s
ต่ำสุด13.0 tok/s
ดูผลทดสอบความเร็ว →

granite-4.1-8b-base

ibm-granite / granite-4.1-8b-base

text-generation
8Bgranitelanguagegranite-4.1
ดูผลทดสอบความเร็ว →

Qwen2.5-VL-7B-Instruct

Qwen / Qwen2.5-VL-7B-Instruct

Qwenimage-text-to-text
7Bqwen2_5_vlmultimodalconversational
ดูผลทดสอบความเร็ว →

NVIDIA-Nemotron-3-Nano-4B-FP8

nvidia / NVIDIA-Nemotron-3-Nano-4B-FP8

text-generation
4Bnemotron_hnvidiaconversational
ดูผลทดสอบความเร็ว →

DeepSeek-V4-Flash-DSpark

deepseek-ai / DeepSeek-V4-Flash-DSpark

Deepseektext-generation4 การทดสอบความเร็ว
MoE165Bdeepseek_v48-bitfp8
ดีที่สุด262 tok/s
มัธยฐาน213 tok/s
ต่ำสุด46.4 tok/s
ดูผลทดสอบความเร็ว →

gemma-3-4b-pt

google / gemma-3-4b-pt

Gemmaimage-text-to-text
4Bgemma3
ดูผลทดสอบความเร็ว →

gemma-3n-E4B

google / gemma-3n-E4B

Gemmaimage-text-to-text
4Bgemma3nautomatic-speech-recognitionautomatic-speech-translation
ดูผลทดสอบความเร็ว →

MiniMax-M2

MiniMaxAI / MiniMax-M2

Minimaxtext-generation2 การทดสอบความเร็ว
MoE229Bminimax_m2conversationalfp8
ดีที่สุด493 tok/s
มัธยฐาน398 tok/s
ต่ำสุด303 tok/s
ดูผลทดสอบความเร็ว →

GLM-5.1

zai-org / GLM-5.1

text-generation
MoE754Bglm_moe_dsaconversationalen
ดูผลทดสอบความเร็ว →

granite-4.1-30b

ibm-granite / granite-4.1-30b

text-generation4 การทดสอบความเร็ว
30Bgranitelanguagegranite-4.1
ดีที่สุด17.9 tok/s
มัธยฐาน16.4 tok/s
ต่ำสุด15.6 tok/s
ดูผลทดสอบความเร็ว →

Gemopus-4-26B-A4B-it

Jackrong / Gemopus-4-26B-A4B-it

Gemmatext-generation4 การทดสอบความเร็ว
MoE4B active / 26B totalgemma4instruction-tunedreasoning
ดีที่สุด64.3 tok/s
มัธยฐาน55.0 tok/s
ต่ำสุด45.7 tok/s
ดูผลทดสอบความเร็ว →

MiMo-V2.6-Flash-RL

XiaomiMiMo / MiMo-V2.6-Flash-RL

text-generation3 การทดสอบความเร็ว
MoE311Bmimo_v2multimodalvision-language
ดีที่สุด193 tok/s
มัธยฐาน189 tok/s
ต่ำสุด154 tok/s
ดูผลทดสอบความเร็ว →

gemma-3-27b-pt

google / gemma-3-27b-pt

Gemmaimage-text-to-text
27Bgemma3
ดูผลทดสอบความเร็ว →

Nex-N2.5-mini

nex-agi / Nex-N2.5-mini

Qwentext-generation
MoE35Bqwen3_5_moeimage-text-to-textconversational
ดูผลทดสอบความเร็ว →

LFM2.5-2.6B-Base

LiquidAI / LFM2.5-2.6B-Base

text-generation
2.6Blfm2liquidlfm2.5
ดูผลทดสอบความเร็ว →

Qwen3-VL-30B-A3B-Instruct

Qwen / Qwen3-VL-30B-A3B-Instruct

Qwenimage-text-to-text2 การทดสอบความเร็ว
MoE3B active / 30B totalqwen3_vl_moeconversational
ดีที่สุด56.6 tok/s
มัธยฐาน52.2 tok/s
ต่ำสุด47.7 tok/s
ดูผลทดสอบความเร็ว →

Falcon-H1-0.5B-Base

tiiuae / Falcon-H1-0.5B-Base

Falcontext-generation
0.5Bfalcon_h1en
ดูผลทดสอบความเร็ว →

functiongemma-270m-it

google / functiongemma-270m-it

Gemmatext-generation3 การทดสอบความเร็ว
270Mgemma3_textgemma3google
ดีที่สุด206 tok/s
มัธยฐาน193 tok/s
ต่ำสุด169 tok/s
ดูผลทดสอบความเร็ว →

Falcon-H1-Tiny-90M-Instruct

tiiuae / Falcon-H1-Tiny-90M-Instruct

Falcontext-generation3 การทดสอบความเร็ว
90Mfalcon_h1edgeconversational
ดีที่สุด495 tok/s
มัธยฐาน425 tok/s
ต่ำสุด338 tok/s
ดูผลทดสอบความเร็ว →

gemma-3-270m

google / gemma-3-270m

Gemmatext-generation
270Mgemma3_textgemma3google
ดูผลทดสอบความเร็ว →

Ornith-1.0-397B

ornith-ai / Ornith-1.0-397B

Qwentext-generation
MoE397Bqwen3_5_moeimage-text-to-textconversational
ดูผลทดสอบความเร็ว →

Mellum2-12B-A2.5B-Thinking

JetBrains / Mellum2-12B-A2.5B-Thinking

text-generation
MoE2.5B active / 12B totalmellumconversationalen
ดูผลทดสอบความเร็ว →

diffusiongemma-26B-A4B-it

google / diffusiongemma-26B-A4B-it

Gemmaimage-text-to-text1 การทดสอบความเร็ว
MoE4B active / 26B totaldiffusion_gemmaconversational
ดีที่สุด529 tok/s
มัธยฐาน529 tok/s
ต่ำสุด529 tok/s
ดูผลทดสอบความเร็ว →

MiniCPM3-4B

openbmb / MiniCPM3-4B

text-generation3 การทดสอบความเร็ว
4Bminicpm3conversationalzh
ดีที่สุด35.6 tok/s
มัธยฐาน29.4 tok/s
ต่ำสุด6.1 tok/s
Eval score· 2 evals
100.0%
ดูผลทดสอบความเร็ว →

Ternary-Bonsai-8B-unpacked

prism-ml / Ternary-Bonsai-8B-unpacked

Qwen
8Bqwen3prismmlbonsai
ดูผลทดสอบความเร็ว →

Llama-4-Scout-17B-16E

meta-llama / Llama-4-Scout-17B-16E

Llamaimage-text-to-text
MoE17B active / 109B totalllama4facebookmeta
ดูผลทดสอบความเร็ว →

DeepSeek-V4-Flash-Vision-Exp

deepseek-ai / DeepSeek-V4-Flash-Vision-Exp

Deepseekimage-text-to-text1 การทดสอบความเร็ว
MoE305Bdeepseek_v4text-generation8-bit
ดีที่สุด180 tok/s
มัธยฐาน180 tok/s
ต่ำสุด180 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.8-27B-Uncensored-int4-AutoRound

johannrplaster / Qwen3.8-27B-Uncensored-int4-AutoRound

Qwenimage-text-to-text2 การทดสอบความเร็ว
27Bqwen3_5vllmintel-xpu
ดีที่สุด136 tok/s
มัธยฐาน117 tok/s
ต่ำสุด97.8 tok/s
ดูผลทดสอบความเร็ว →

stories-llama2-50k

delphi-suite / stories-llama2-50k

Llama2 การทดสอบความเร็ว
delphien
ดีที่สุด306.1k tok/s
มัธยฐาน171.4k tok/s
ต่ำสุด36.7k tok/s
ดูผลทดสอบความเร็ว →

LFM2-24B-A2B

LiquidAI / LFM2-24B-A2B

text-generation1 การทดสอบความเร็ว
MoE2B active / 24B totallfm2_moeliquidlfm2
ดีที่สุด161 tok/s
มัธยฐาน161 tok/s
ต่ำสุด161 tok/s
ดูผลทดสอบความเร็ว →

models-moved

ggml-org / models-moved

2 การทดสอบความเร็ว
ดีที่สุด16.7k tok/s
มัธยฐาน10.6k tok/s
ต่ำสุด4.4k tok/s
ดูผลทดสอบความเร็ว →

Qwen3.6-27b-ROCmFP4-CIRU-CHAOS-SPEED

jcbtc / Qwen3.6-27b-ROCmFP4-CIRU-CHAOS-SPEED

Qwentext-generation2 การทดสอบความเร็ว
27B
ดีที่สุด132 tok/s
มัธยฐาน92.3 tok/s
ต่ำสุด52.2 tok/s
Eval score· 1 evalROCmFP4
90.5%
ดูผลทดสอบความเร็ว →

MobileLLM-350M

facebook / MobileLLM-350M

text-generation2 การทดสอบความเร็ว
350Mmobilellmfacebookmeta
ดีที่สุด981 tok/s
มัธยฐาน714 tok/s
ต่ำสุด448 tok/s
ดูผลทดสอบความเร็ว →

MobileLLM-125M

facebook / MobileLLM-125M

text-generation2 การทดสอบความเร็ว
125Mmobilellmfacebookmeta
ดีที่สุด1.3k tok/s
มัธยฐาน987 tok/s
ต่ำสุด703 tok/s
ดูผลทดสอบความเร็ว →

OLMo-2-0425-1B

allenai / OLMo-2-0425-1B

text-generation
1Bolmo2en
ดูผลทดสอบความเร็ว →

LFM2-700M

LiquidAI / LFM2-700M

text-generation2 การทดสอบความเร็ว
0.7Blfm2liquidedge
ดีที่สุด114 tok/s
มัธยฐาน92.1 tok/s
ต่ำสุด70.3 tok/s
ดูผลทดสอบความเร็ว →

h2o-danube3-500m-chat

h2oai / h2o-danube3-500m-chat

Llamatext-generation2 การทดสอบความเร็ว
0.5Bgptllmlarge language model
ดีที่สุด163 tok/s
มัธยฐาน134 tok/s
ต่ำสุด105 tok/s
ดูผลทดสอบความเร็ว →

granite-4.0-1b-base

ibm-granite / granite-4.0-1b-base

text-generation
MoE1Bgranitemoehybridlanguagegranite-4.0
ดูผลทดสอบความเร็ว →

EXAONE-3.5-7.8B-Instruct-GGUF

LGAI-EXAONE / EXAONE-3.5-7.8B-Instruct-GGUF

text-generation2 การทดสอบความเร็ว
7.8Blg-aiexaoneexaone-3.5
ดีที่สุด27.2 tok/s
มัธยฐาน27.2 tok/s
ต่ำสุด27.2 tok/s
Eval score· 2 evals
78.3%
ดูผลทดสอบความเร็ว →

Phi-4-mini-instruct

microsoft / Phi-4-mini-instruct

Phitext-generation
4Bphi3nlpcode
ดูผลทดสอบความเร็ว →

Kimi-K2.5

moonshotai / Kimi-K2.5

image-text-to-text1 การทดสอบความเร็ว
1Tkimi_k25feature-extractioncompressed-tensors
ดีที่สุด74.0 tok/s
มัธยฐาน74.0 tok/s
ต่ำสุด74.0 tok/s
ดูผลทดสอบความเร็ว →

MiniMax-M2.1

MiniMaxAI / MiniMax-M2.1

Minimaxtext-generation2 การทดสอบความเร็ว
MoE229Bminimax_m2conversationalfp8
ดีที่สุด499 tok/s
มัธยฐาน416 tok/s
ต่ำสุด333 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.5-35B-A3B-4bit

mlx-community / Qwen3.5-35B-A3B-4bit

Qwenimage-text-to-text2 การทดสอบความเร็ว
MoE3B active / 35B totalqwen3_5_moemlxconversational
ดีที่สุด140 tok/s
มัธยฐาน122 tok/s
ต่ำสุด105 tok/s
ดูผลทดสอบความเร็ว →

MiniCPM5-2B-GGUF

openbmb / MiniCPM5-2B-GGUF

Llamatext-generation1 การทดสอบความเร็ว
2Bminicpmminicpm5long-context
ดีที่สุด39.1 tok/s
มัธยฐาน39.1 tok/s
ต่ำสุด39.1 tok/s
ดูผลทดสอบความเร็ว →

Ling-3.0-tiny-GGUF

inclusionAI / Ling-3.0-tiny-GGUF

text-generation1 การทดสอบความเร็ว
conversational
ดีที่สุด244 tok/s
มัธยฐาน244 tok/s
ต่ำสุด244 tok/s
ดูผลทดสอบความเร็ว →

qwen-3.8-27b-abliterated

heterodoxin / qwen-3.8-27b-abliterated

Qwen1 การทดสอบความเร็ว
27Bqwen3_5
ดีที่สุด4.4 tok/s
มัธยฐาน4.4 tok/s
ต่ำสุด4.4 tok/s
ดูผลทดสอบความเร็ว →

Ternary-Bonsai-1.7B-unpacked

prism-ml / Ternary-Bonsai-1.7B-unpacked

Qwen
1.7Bqwen3prismmlbonsai
ดูผลทดสอบความเร็ว →

Ternary-Bonsai-2-27B-DFlash2-vllm

fraserprice / Ternary-Bonsai-2-27B-DFlash2-vllm

1 การทดสอบความเร็ว
27B
ดีที่สุด361 tok/s
มัธยฐาน361 tok/s
ต่ำสุด361 tok/s
ดูผลทดสอบความเร็ว →

GLM-5.3-BF16

zai-org / GLM-5.3-BF16

text-generation1 การทดสอบความเร็ว
MoE753Bglm_moe_dsaconversationalen
ดีที่สุด6843.6k tok/s
มัธยฐาน6843.6k tok/s
ต่ำสุด6843.6k tok/s
ดูผลทดสอบความเร็ว →

Ling-3.0-flash-int4

inclusionAI / Ling-3.0-flash-int4

text-generation1 การทดสอบความเร็ว
MoE127Bbailing_hybridconversationalcompressed-tensors
ดีที่สุด37.3 tok/s
มัธยฐาน37.3 tok/s
ต่ำสุด37.3 tok/s
ดูผลทดสอบความเร็ว →

Falcon3-7B-Base

tiiuae / Falcon3-7B-Base

Llamatext-generation
7Bfalcon3enfr
ดูผลทดสอบความเร็ว →

Ornith-1.5-35B-A3B-NVFP4

ornith-ai / Ornith-1.5-35B-A3B-NVFP4

Qwentext-generation1 การทดสอบความเร็ว
MoE3B active / 35B totalqwen3_5_moeimage-text-to-textconversational
ดีที่สุด259 tok/s
มัธยฐาน259 tok/s
ต่ำสุด259 tok/s
Eval score· 3 evalsNVFP4
70.9%
ดูผลทดสอบความเร็ว →

Qwen3-30B-A3B-Thinking-2507

Qwen / Qwen3-30B-A3B-Thinking-2507

Qwentext-generation
MoE3B active / 30B totalqwen3_moeconversational
ดูผลทดสอบความเร็ว →

bitnet-b1.58-2B-4T-bf16

microsoft / bitnet-b1.58-2B-4T-bf16

text-generation
2Bbitnetchatlarge-language-model
ดูผลทดสอบความเร็ว →

Ministral-3-14B-Base-2512

mistralai / Ministral-3-14B-Base-2512

Mistral
14Bvllmmistral3mistral-common
ดูผลทดสอบความเร็ว →

rnj-1-instruct-GGUF

EssentialAI / rnj-1-instruct-GGUF

1 การทดสอบความเร็ว
conversational
ดีที่สุด123 tok/s
มัธยฐาน123 tok/s
ต่ำสุด123 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-4B-Thinking-2507

Qwen / Qwen3-4B-Thinking-2507

Qwentext-generation
4Bqwen3conversational
ดูผลทดสอบความเร็ว →

GLM-4.6V-Flash

zai-org / GLM-4.6V-Flash

image-text-to-text
10Bglm4vconversationalzh
ดูผลทดสอบความเร็ว →

gemma-3n-E4B-it-text-GGUF

lmstudio-community / gemma-3n-E4B-it-text-GGUF

Gemma1 การทดสอบความเร็ว
4Bconversational
ดีที่สุด135 tok/s
มัธยฐาน135 tok/s
ต่ำสุด135 tok/s
ดูผลทดสอบความเร็ว →

DeepSeek-R1-0528-Qwen3-8B

deepseek-ai / DeepSeek-R1-0528-Qwen3-8B

Deepseek-R1text-generation
8Bqwen3conversational
ดูผลทดสอบความเร็ว →

DeepSeek-Coder-V2-Lite-Instruct-FP8

RedHatAI / DeepSeek-Coder-V2-Lite-Instruct-FP8

Deepseek-Codertext-generation1 การทดสอบความเร็ว
MoE16Bdeepseek_v2fp8vllm
ดีที่สุด237 tok/s
มัธยฐาน237 tok/s
ต่ำสุด237 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-Coder-30B-A3B-Instruct-FP8

Qwen / Qwen3-Coder-30B-A3B-Instruct-FP8

Qwentext-generation1 การทดสอบความเร็ว
MoE3B active / 30B totalqwen3_moeconversationalfp8
ดีที่สุด26.1 tok/s
มัธยฐาน26.1 tok/s
ต่ำสุด26.1 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-Next-80B-A3B-Instruct

Qwen / Qwen3-Next-80B-A3B-Instruct

Qwentext-generation
MoE3B active / 80B totalqwen3_nextconversational
ดูผลทดสอบความเร็ว →

Kimi-K3

moonshotai / Kimi-K3

image-text-to-text
2.8Tkimi_k3feature-extractioncompressed-tensors
ดูผลทดสอบความเร็ว →

Inkling-Small

thinkingmachines / Inkling-Small

image-text-to-text
MoE266Binkling_mm_modelconversationalaudio-text-to-text
ดูผลทดสอบความเร็ว →

Qwen3.5-4B-Uncensored-HauhauCS-Aggressive

HauhauCS / Qwen3.5-4B-Uncensored-HauhauCS-Aggressive

Qwen1 การทดสอบความเร็ว
4Buncensoredqwen3.5en
ดีที่สุด82.9 tok/s
มัธยฐาน82.9 tok/s
ต่ำสุด82.9 tok/s
ดูผลทดสอบความเร็ว →

Harmonic-Hermes-9B-GGUF

DJLougen / Harmonic-Hermes-9B-GGUF

Qwen1 การทดสอบความเร็ว
9Bhermesqwen3_5reasoning
ดีที่สุด39.2 tok/s
มัธยฐาน39.2 tok/s
ต่ำสุด39.2 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.5-27B-Uncensored-HauhauCS-Aggressive

HauhauCS / Qwen3.5-27B-Uncensored-HauhauCS-Aggressive

Qwen1 การทดสอบความเร็ว
27Buncensoredqwen3.5en
ดีที่สุด30.8 tok/s
มัธยฐาน30.8 tok/s
ต่ำสุด30.8 tok/s
Eval score· 5 evalsQ4_K_M
91.5%
ดูผลทดสอบความเร็ว →

Mistral-Nemo-Base-2407

mistralai / Mistral-Nemo-Base-2407

Mistral
12Bvllmmistral-commonen
ดูผลทดสอบความเร็ว →

Falcon-H1-Tiny-Tool-Calling-90M

tiiuae / Falcon-H1-Tiny-Tool-Calling-90M

Falcontext-generation1 การทดสอบความเร็ว
90Mfalcon_h1edgeconversational
ดีที่สุด434 tok/s
มัธยฐาน434 tok/s
ต่ำสุด434 tok/s
ดูผลทดสอบความเร็ว →

Falcon-H1-Tiny-Coder-90M

tiiuae / Falcon-H1-Tiny-Coder-90M

Falcontext-generation1 การทดสอบความเร็ว
90Mfalcon_h1edge
ดีที่สุด426 tok/s
มัธยฐาน426 tok/s
ต่ำสุด426 tok/s
ดูผลทดสอบความเร็ว →

TinyStories-33M

roneneldan / TinyStories-33M

Gpttext-generation1 การทดสอบความเร็ว
33Mgpt_neo
ดีที่สุด641 tok/s
มัธยฐาน641 tok/s
ต่ำสุด641 tok/s
ดูผลทดสอบความเร็ว →

tinystories-lay4-hs128-hd2-1M

ivnle / tinystories-lay4-hs128-hd2-1M

Llamatext-generation1 การทดสอบความเร็ว
1Mconversational
ดีที่สุด3.6k tok/s
มัธยฐาน3.6k tok/s
ต่ำสุด3.6k tok/s
ดูผลทดสอบความเร็ว →

qwen-3-14b-instruct-gguf

lm-kit / qwen-3-14b-instruct-gguf

Qwen1 การทดสอบความเร็ว
14Bconversational
ดีที่สุด38.2 tok/s
มัธยฐาน38.2 tok/s
ต่ำสุด38.2 tok/s
ดูผลทดสอบความเร็ว →

Gemmable-4-12B-MTP-GGUF

Mia-AiLab / Gemmable-4-12B-MTP-GGUF

Gemma1 การทดสอบความเร็ว
12Bgemma-4gemmablereasoning
ดีที่สุด71.2 tok/s
มัธยฐาน71.2 tok/s
ต่ำสุด71.2 tok/s
ดูผลทดสอบความเร็ว →

DeepSeek-Coder-V2-Lite-Instruct-GGUF

bartowski / DeepSeek-Coder-V2-Lite-Instruct-GGUF

Deepseek-Codertext-generation1 การทดสอบความเร็ว
imatrixconversational
ดีที่สุด57.1 tok/s
มัธยฐาน57.1 tok/s
ต่ำสุด57.1 tok/s
ดูผลทดสอบความเร็ว →

gemma-4-31B-v2-MLX-4bit

jdfelo / gemma-4-31B-v2-MLX-4bit

Gemmaimage-text-to-text1 การทดสอบความเร็ว
31Bmlx-vlmgemma4mlx
ดีที่สุด33.4 tok/s
มัธยฐาน33.4 tok/s
ต่ำสุด33.4 tok/s
ดูผลทดสอบความเร็ว →

MiniMax-M3

MiniMaxAI / MiniMax-M3

Minimaximage-text-to-text
MoE427Bminimax_m3_vlmultimodalmoe
ดูผลทดสอบความเร็ว →

Unlimited-OCR

baidu / Unlimited-OCR

image-text-to-text1 การทดสอบความเร็ว
MoE3Bunlimited-ocrfeature-extractionbaidu
ดีที่สุด365 tok/s
มัธยฐาน365 tok/s
ต่ำสุด365 tok/s
ดูผลทดสอบความเร็ว →

gemma-4-26B-A4B-it-QAT-MLX-4bit

lmstudio-community / gemma-4-26B-A4B-it-QAT-MLX-4bit

Gemmaimage-text-to-text1 การทดสอบความเร็ว
MoE4B active / 26B totalgemma4mlxconversational
ดีที่สุด65.3 tok/s
มัธยฐาน65.3 tok/s
ต่ำสุด65.3 tok/s
ดูผลทดสอบความเร็ว →

granite-4.1-8b

ibm-granite / granite-4.1-8b

text-generation
8Bgranitelanguagegranite-4.1
ดูผลทดสอบความเร็ว →

Step-3.7-Flash-NVFP4

stepfun-ai / Step-3.7-Flash-NVFP4

Optimage-text-to-text1 การทดสอบความเร็ว
MoE104Bstep3p7vision-languagemultimodal
ดีที่สุด27.4 tok/s
มัธยฐาน27.4 tok/s
ต่ำสุด27.4 tok/s
ดูผลทดสอบความเร็ว →

Qwable-3.6-35b

Mia-AiLab / Qwable-3.6-35b

Qwen1 การทดสอบความเร็ว
35Bqwen3qwen3.6fable
ดีที่สุด54.1 tok/s
มัธยฐาน54.1 tok/s
ต่ำสุด54.1 tok/s
ดูผลทดสอบความเร็ว →

GPT-OSS-20B-Uncensored-HauhauCS-Aggressive

HauhauCS / GPT-OSS-20B-Uncensored-HauhauCS-Aggressive

Gpt1 การทดสอบความเร็ว
20Buncensoredabliteratedmxfp4
ดีที่สุด66.8 tok/s
มัธยฐาน66.8 tok/s
ต่ำสุด66.8 tok/s
ดูผลทดสอบความเร็ว →

UncensoredLM-DeepSeek-R1-Distill-Qwen-14B

uncensoredai / UncensoredLM-DeepSeek-R1-Distill-Qwen-14B

Deepseek-R11 การทดสอบความเร็ว
14Bqwen2
ดีที่สุด27.0 tok/s
มัธยฐาน27.0 tok/s
ต่ำสุด27.0 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.5-9B-Red_Team

LuisPPB16 / Qwen3.5-9B-Red_Team

Qwen1 การทดสอบความเร็ว
9Bqwen3_5llama.cppunsloth
ดีที่สุด35.9 tok/s
มัธยฐาน35.9 tok/s
ต่ำสุด35.9 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.5-0.8B-Q8_0.gguf

Manojb / Qwen3.5-0.8B-Q8_0.gguf

Qwen1 การทดสอบความเร็ว
0.8Bconversational
ดีที่สุด346 tok/s
มัธยฐาน346 tok/s
ต่ำสุด346 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.6-35B-A3B-4bit-DWQ

mlx-community / Qwen3.6-35B-A3B-4bit-DWQ

Qwentext-generation1 การทดสอบความเร็ว
MoE3B active / 35B totalmlxqwen3_5_moeconversational
ดีที่สุด78.9 tok/s
มัธยฐาน78.9 tok/s
ต่ำสุด78.9 tok/s
ดูผลทดสอบความเร็ว →

Qwen3.5-122B-A10B-GPTQ-Int4

Qwen / Qwen3.5-122B-A10B-GPTQ-Int4

Qwenimage-text-to-text1 การทดสอบความเร็ว
MoE10B active / 122B totalqwen3_5_moeconversational4-bit
ดีที่สุด49.1 tok/s
มัธยฐาน49.1 tok/s
ต่ำสุด49.1 tok/s
ดูผลทดสอบความเร็ว →

Llama-2-7b

meta-llama / Llama-2-7b

Llamatext-generation1 การทดสอบความเร็ว
7Bfacebookmetallama-2
ดีที่สุด110 tok/s
มัธยฐาน110 tok/s
ต่ำสุด110 tok/s
ดูผลทดสอบความเร็ว →

GLM-5

zai-org / GLM-5

text-generation
MoE754Bglm_moe_dsaconversationalen
ดูผลทดสอบความเร็ว →

DeepSeek-V4-Flash-2bit-DQ

mlx-community / DeepSeek-V4-Flash-2bit-DQ

Deepseektext-generation1 การทดสอบความเร็ว
MoE284Bmlxdeepseek_v4conversational
ดีที่สุด17.0 tok/s
มัธยฐาน17.0 tok/s
ต่ำสุด17.0 tok/s
ดูผลทดสอบความเร็ว →

Qwen3-VL-2B-Instruct

Qwen / Qwen3-VL-2B-Instruct

Qwenimage-text-to-text1 การทดสอบความเร็ว
2Bqwen3_vlconversational
ดีที่สุด27.9 tok/s
มัธยฐาน27.9 tok/s
ต่ำสุด27.9 tok/s
ดูผลทดสอบความเร็ว →

Gemopus-4-26B-A4B-it-GGUF

Jackrong / Gemopus-4-26B-A4B-it-GGUF

Llamaimage-text-to-text1 การทดสอบความเร็ว
MoE4B active / 26B totalgemma4llama.cppvision
ดีที่สุด94.5 tok/s
มัธยฐาน94.5 tok/s
ต่ำสุด94.5 tok/s
ดูผลทดสอบความเร็ว →

MiMo-V2.6-Flash-MOPD

XiaomiMiMo / MiMo-V2.6-Flash-MOPD

text-generation
MoE311Bmimo_v2multimodalvision-language
ดูผลทดสอบความเร็ว →

GLM-5.3

zai-org / GLM-5.3

text-generation
MoE753Bglm_moe_dsaconversationalen
ดูผลทดสอบความเร็ว →

Devstral-2-123B-Instruct-2512

mistralai / Devstral-2-123B-Instruct-2512

Mistral
123Bvllmministral3mistral-common
ดูผลทดสอบความเร็ว →

Kimi-K2.7-Code

moonshotai / Kimi-K2.7-Code

image-text-to-text
1Tkimi_k25feature-extractioncompressed-tensors
ดูผลทดสอบความเร็ว →

Qwen2-VL-7B

Qwen / Qwen2-VL-7B

Qwenimage-text-to-text
7Bqwen2_vlmultimodalconversational
ดูผลทดสอบความเร็ว →

Qwen3.5-9B-NSC-ACE-SABER-GGUF

GestaltLabs / Qwen3.5-9B-NSC-ACE-SABER-GGUF

Qwen
9Bqwen3_5nsc-acesaber
ดูผลทดสอบความเร็ว →

LFM2-24B-A2B-GGUF

lmstudio-community / LFM2-24B-A2B-GGUF

MoE2B active / 24B totalconversational
ดูผลทดสอบความเร็ว →