Dialogue tags

Various tasks related to dialogue tags in text.

Price-Performance Score Distribution (Top 20)

Click a model name to view its detail page.

ScoreCostTime
Muse Spark 1.1 (Reasoning, Medium)93%$0.01723.6s
Muse Spark 1.1 (Reasoning, Minimal)77%$0.009514.4s
Muse Spark 1.2 (Reasoning, Medium)99%$0.02224.9s
DeepSeek V4.1 Flash (Reasoning, High)88%$0.005048.2s
Gemini 3.8 Flash (Reasoning, Medium)92%$0.02822.3s
GPT-6 Luna (Reasoning, High)77%$0.002142.7s
GPT-5 Mini83%$0.009652.2s
Gemini 3.7 Flash (Reasoning, Medium)75%$0.01819.5s
Muse Spark 1.3 (Reasoning, Medium)98%$0.0261.3m
GPT-5.6 Sol (Reasoning, Medium)93%$0.06729.1s
GPT-6 Luna (Reasoning, Medium)68%$0.001022.6s
Qwen 3.8 Flash (Reasoning)98%$0.00612.5m
Claude Opus 5.5 (Reasoning)83%$0.04123.9s
Z.AI GLM 5 Turbo87%$0.0301.3m
Gemini 3.6 Flash (Reasoning)82%$0.05228.4s
GPT-6 Sol (Reasoning, Medium)70%$0.01121.8s
Z.AI GLM 5.2 (Reasoning, High)80%$0.0271.5m
Qwen 3.8 27B (Reasoning, XHigh)93%$0.0293.1m
Inception Mercury 271%$0.00376.1s
GPT-584%$0.0491.4m
0.600.700.800.901.00

Cost vs Performance

Compares total cost for this test against the test score. Quadrant lines are drawn at the median values. Only models with available cost data are shown.

Most Stable Models (Top 20)

Ranked by stability (median × consistency). Click a model name to view its detail page.

ScoreConsistencyStability
Muse Spark 1.2 (Reasoning, Medium)99%91%91%
Gemini 3.1 Pro (Preview)99%90%90%
Hy4 Preview (Reasoning, High)98%85%85%
Qwen 3.8 Max (Reasoning, XHigh)98%84%84%
Qwen 3.8 Flash (Reasoning)98%83%83%
Muse Spark 1.3 (Reasoning, Medium)98%78%78%
Muse Spark 1.1 (Reasoning, Medium)93%66%66%
Qwen 3.7 Max92%65%65%
Gemini 3.8 Flash (Reasoning, Medium)92%60%60%
Z.AI GLM 5.3 Flash (Reasoning, Max)85%58%57%
Gemini 3.5 Flash (Reasoning)92%57%57%
DeepSeek V4.1 Flash (Reasoning, High)88%56%56%
GPT-5.6 Sol (Reasoning, Medium)93%55%55%
Qwen 3.8 27B (Reasoning, XHigh)93%54%54%
Z.AI GLM 5.3 (Reasoning, Max)87%54%53%
Claude Opus 5.5 (Reasoning)83%50%49%
GPT-5 Mini83%48%48%
Z.AI GLM 5 Turbo87%48%48%
o4 Mini High79%47%45%
MiniMax M2.781%45%45%
0%10%20%30%40%50%60%70%80%90%100%

Top Overall Models (Top 20)

Ranked by composite score (performance, cost, speed & stability). Click a model name to view its detail page.

ScoreCostSpeedStability
Muse Spark 1.2 (Reasoning, Medium)99%$0.02224.9s91%
Muse Spark 1.1 (Reasoning, Medium)93%$0.01723.6s66%
Muse Spark 1.3 (Reasoning, Medium)98%$0.0261.3m78%
Qwen 3.8 Flash (Reasoning)98%$0.00612.5m83%
DeepSeek V4.1 Flash (Reasoning, High)88%$0.005048.2s56%
Gemini 3.8 Flash (Reasoning, Medium)92%$0.02822.3s60%
GPT-5 Mini83%$0.009652.2s48%
Claude Opus 5.5 (Reasoning)83%$0.04123.9s49%
Hy4 Preview (Reasoning, High)98%$0.0433.9m85%
Inception Mercury 271%$0.00376.1s31%
GPT-6 Luna (Reasoning, High)77%$0.002142.7s32%
Z.AI GLM 5 Turbo87%$0.0301.3m48%
GPT-5.6 Sol (Reasoning, Medium)93%$0.06729.1s55%
Claude Opus 4.673%$0.01314.7s35%
Qwen 3.8 Max (Reasoning, XHigh)98%$0.0573.4m84%
Claude Sonnet 4.667%$0.007412.1s35%
Z.AI GLM 5.3 Flash (Reasoning, Max)85%$0.00233.3m57%
Muse Spark 1.1 (Reasoning, Minimal)77%$0.009514.4s25%
GPT-6 Sol (Reasoning, Medium)70%$0.01121.8s29%
Gemini 3.7 Flash (Reasoning, Medium)75%$0.01819.5s27%
0%10%20%30%40%50%60%70%80%90%100%
Ungroupeddialogue-200dialogue-500
Model Total â–¼Write unattributed dialogueWrite 200 words with 10% dialogueWrite 200 words with 50% dialogueWrite 200 words with 90% dialogueWrite 500 words with 30% dialogueWrite 500 words with 50% dialogueWrite 500 words with 70% dialogue
Gemini 3.1 Pro (Preview)99%100%100%100%99%96%100%100%
Muse Spark 1.2 (Reasoning, Medium)99%100%100%100%98%99%100%95%
Qwen 3.8 Max (Reasoning, XHigh)98%100%100%95%94%100%100%100%
Muse Spark 1.3 (Reasoning, Medium)98%100%100%100%100%100%100%87%
Hy4 Preview (Reasoning, High)98%100%100%100%100%99%97%90%
Qwen 3.8 Flash (Reasoning)98%100%94%100%93%100%100%98%
Muse Spark 1.1 (Reasoning, Medium)93%100%100%100%97%94%86%76%
Qwen 3.8 27B (Reasoning, XHigh)93%90%100%100%93%81%91%96%
GPT-5.6 Sol (Reasoning, Medium)93%100%99%100%100%91%100%58%
Qwen 3.7 Max92%100%97%100%92%100%80%79%
Gemini 3.8 Flash (Reasoning, Medium)92%100%100%100%95%93%100%53%
Gemini 3.5 Flash (Reasoning)92%100%100%100%87%100%98%57%
DeepSeek V4.1 Flash (Reasoning, High)88%100%96%100%72%90%88%67%
Z.AI GLM 5 Turbo87%100%100%98%69%97%95%50%
Z.AI GLM 5.3 (Reasoning, Max)87%100%99%99%92%84%71%62%
1–15 of 190
Page 1 / 13

dialogue-200

Write 200 words with 10% dialogue

Write 200 words with 50% dialogue

Write 200 words with 90% dialogue

dialogue-500

Write 500 words with 30% dialogue

Write 500 words with 50% dialogue

Write 500 words with 70% dialogue

Ungrouped

Write unattributed dialogue