N-Length Sentences

Write sentences with exactly N words

Price-Performance Score Distribution (Top 20)

Click a model name to view its detail page.

ScoreCostTime
Gemini 3.1 Flash Lite100%$0.00011.5s
Gemini 3.1 Flash Lite (Reasoning)98%$0.00012.0s
Gemini 3.1 Flash Lite (Preview)100%$0.00011.2s
Gemma 4 26B96%$0.00003.8s
Gemini 3 Flash (Preview)99%$0.00041.9s
Inception Mercury 2100%$0.00071.2s
Gemini 3.5 Flash (Reasoning, Minimal)88%$0.00111.6s
Gemini 3.6 Flash (Reasoning, Minimal)90%$0.00111.8s
GPT-5.4 Nano (Reasoning, Low)100%$0.00085.7s
GPT-5.4 Nano (Reasoning)100%$0.00107.5s
Llama 3.1 70B84%$0.00022.1s
Nemotron 3 Super100%$0.000016.0s
GPT-5.4 Mini (Reasoning, Low)100%$0.00256.3s
Gemma 4 31B89%$0.00018.6s
Muse Spark 1.1 (Reasoning, Minimal)100%$0.00375.2s
GPT-5.4 Mini (Reasoning)100%$0.00388.1s
GPT-OSS 120B100%$0.000420.3s
Muse Spark 1.1 (Reasoning, Medium)100%$0.00547.4s
Claude Opus 4.594%$0.00526.8s
GPT-5 Nano100%$0.001028.2s
0.800.901.00

Cost vs Performance

Compares total cost for this test against the test score. Quadrant lines are drawn at the median values. Only models with available cost data are shown.

Most Stable Models (Top 20)

Ranked by stability (median × consistency). Click a model name to view its detail page.

ScoreConsistencyStability
Gemini 3.6 Flash (Reasoning)100%100%100%
Qwen3.7 Max100%100%100%
Grok 4.5 (Reasoning, High)100%100%100%
Gemini 3.1 Pro (Preview)100%100%100%
Muse Spark 1.1 (Reasoning, Medium)100%100%100%
Qwen3.6 Max Preview100%100%100%
Claude Sonnet 4.6 (Reasoning)100%100%100%
Z.AI GLM 5.2 (Reasoning, High)100%100%100%
Gemini 3.5 Flash (Reasoning)100%100%100%
Z.AI GLM 5 Turbo100%100%100%
MoonshotAI: Kimi K3 (Reasoning, High)100%100%100%
MoonshotAI: Kimi K2.6100%100%100%
Qwen 3.5 397B A17B100%100%100%
Grok 4.3 (Reasoning)100%100%100%
Grok 4.5 (Reasoning, Low)100%100%100%
GPT-5.4 (Reasoning, Low)100%100%100%
Thinking Machines Inkling (Reasoning)100%100%100%
Qwen 3.5 122B100%100%100%
Claude Sonnet 5 (Reasoning, Low)100%100%100%
Qwen 3.5 27B100%100%100%
100%

Top Overall Models (Top 20)

Ranked by composite score (performance, cost, speed & stability). Click a model name to view its detail page.

ScoreCostSpeedStability
Gemini 3.1 Flash Lite (Preview)100%$0.00011.2s100%
Gemini 3.1 Flash Lite100%$0.00011.5s100%
Inception Mercury 2100%$0.00071.2s98%
GPT-5.4 Nano (Reasoning)100%$0.00107.5s100%
GPT-5.4 Mini (Reasoning, Low)100%$0.00256.3s100%
Gemini 3 Flash (Preview)99%$0.00041.9s95%
Nemotron 3 Super100%$0.000016.0s100%
GPT-5.4 Mini (Reasoning)100%$0.00388.1s100%
GPT-5.4 Nano (Reasoning, Low)100%$0.00085.7s95%
Muse Spark 1.1 (Reasoning, Minimal)100%$0.00375.2s97%
Muse Spark 1.1 (Reasoning, Medium)100%$0.00547.4s100%
GPT-OSS 120B100%$0.000420.3s98%
GPT-5.6 Luna (Reasoning)100%$0.00727.8s97%
GPT-5 Nano100%$0.001028.2s100%
GPT-5.4 (Reasoning, Low)100%$0.009310.4s100%
Gemini 3.1 Flash Lite (Reasoning)98%$0.00012.0s85%
Grok 4.5 (Reasoning, Low)100%$0.009015.4s100%
o4 Mini100%$0.008320.8s100%
GPT-5.2100%$0.01115.0s100%
Gemini 3 Flash (Preview, Reasoning)100%$0.01017.7s100%
70%80%90%100%
Model Total â–¼Write sentences with 5 words eachWrite sentences with 10 words eachWrite sentences with 20 words each
Gemini 3.6 Flash (Reasoning)100%100%100%100%
Qwen3.7 Max100%100%100%100%
Grok 4.5 (Reasoning, High)100%100%100%100%
Gemini 3.1 Pro (Preview)100%100%100%100%
Muse Spark 1.1 (Reasoning, Medium)100%100%100%100%
Qwen3.6 Max Preview100%100%100%100%
Claude Sonnet 4.6 (Reasoning)100%100%100%100%
Z.AI GLM 5.2 (Reasoning, High)100%100%100%100%
Gemini 3.5 Flash (Reasoning)100%100%100%100%
Z.AI GLM 5 Turbo100%100%100%100%
MoonshotAI: Kimi K3 (Reasoning, High)100%100%100%100%
MoonshotAI: Kimi K2.6100%100%100%100%
Qwen 3.5 397B A17B100%100%100%100%
Grok 4.3 (Reasoning)100%100%100%100%
Grok 4.5 (Reasoning, Low)100%100%100%100%
1–15 of 161
Page 1 / 11

Write sentences with 5 words each

Write sentences with 10 words each

Write sentences with 20 words each