Relationship recall

Test: Relationship tree

Avg. Score
23.5%
Scenarios
2

Overall Performance

Rank ▲ Model Score Avg. Cost Avg. Time Stability
1GPT-5.6 Sol (Reasoning)98.6%$0.18659.0s92%
2Grok 4.5 (Reasoning, High)88.7%$0.0802.0m69%
3GPT-5.4 (Reasoning)96.3%$0.1752.6m87%
4GPT-5.5 (Reasoning)91.5%$0.2512.0m75%
5GPT-5.6 Sol68.7%$0.09618.1s29%
6GPT-5.6 Terra (Reasoning)60.9%$0.06024.2s26%
7GPT-5.5 (Reasoning, Low)65.0%$0.09742.6s20%
8Claude Opus 4.6 (Reasoning)88.7%$0.3562.6m69%
9Grok 4.5 (Reasoning, Low)57.5%$0.04049.7s15%
10GPT-5.4 (Reasoning, Low)42.3%$0.05335.5s26%
11GPT-5.562.8%$0.10537.1s16%
12Claude Opus 4.664.2%$0.15431.4s21%
13Gemini 3 Flash (Preview)28.3%$0.00877.1s19%
14MoonshotAI: Kimi K2.672.6%$0.0825.0m39%
15Gemini 2.5 Pro58.0%$0.09958.2s14%
16GPT-5.6 Terra31.6%$0.0349.4s15%
17GPT-5.6 Luna (Reasoning)34.1%$0.02718.6s11%
18GPT-5.425.4%$0.03317.4s17%
19Z.AI GLM 5.2 (Reasoning, High)33.8%$0.0391.8m25%
20Claude Opus 4.7 (Reasoning)61.7%$0.18425.0s15%
21GPT-5.129.3%$0.02517.7s11%
22DeepSeek V4 Flash (Reasoning)49.8%$0.00413.5m19%
23Gemini 3 Flash (Preview, Reasoning)41.5%$0.03040.3s4%
24Claude Sonnet 4.636.4%$0.08123.3s15%
25Claude Sonnet 5 (Reasoning, Low)59.2%$0.1751.7m26%
26GPT-5.4 Nano (Reasoning)19.5%$0.008841.7s17%
27Gemini 3.5 Flash (Reasoning)49.7%$0.11349.4s10%
28Gemini 3.1 Pro (Preview)65.3%$0.1721.5m14%
29GPT-5.235.0%$0.06250.7s13%
30Claude Opus 4.756.1%$0.18224.3s14%
31Claude Sonnet 5 (Reasoning)58.1%$0.1721.7m21%
32Xiaomi MIMO v2.526.5%$0.00271.1m10%
33Z.AI GLM 5 Turbo47.0%$0.0443.6m21%
34MoonshotAI: Kimi K2.560.5%$0.0315.4m24%
35Z.AI GLM 4.633.1%$0.0183.0m22%
36Inception Mercury 214.7%$0.009612.8s8%
37Claude Opus 4.8 (Reasoning)76.4%$0.3811.9m43%
38ByteDance Seed 1.618.7%$0.0141.2m13%
39Gemini 3.5 Flash (Reasoning, Minimal)20.7%$0.0246.3s2%
40Claude Sonnet 4.518.4%$0.07718.6s16%
41Grok 4.20 (Reasoning)16.9%$0.02740.0s11%
42Qwen3.7 Max50.8%$0.0453.5m10%
43Claude Opus 4.530.3%$0.13119.8s13%
44DeepSeek V4 Pro (Reasoning)31.7%$0.0202.3m9%
45GPT-551.8%$0.0922.3m4%
46MiniMax M2.511.6%$0.003645.0s7%
47Gemini 2.5 Flash9.3%$0.00756.1s4%
48MiniMax M2.711.0%$0.006321.4s4%
49Mistral Large 38.2%$0.009117.5s6%
50Gemini 3.1 Flash Lite (Reasoning)6.0%$0.00333.2s5%
51Mistral Medium 3.19.4%$0.01021.2s6%
52Grok 4.38.4%$0.00947.8s4%
53Gemini 3.1 Flash Lite (Preview)5.8%$0.00463.2s4%
54Ministral 3 8B7.6%$0.002217.0s4%
55Qwen 3.5 397B A17B28.3%$0.0452.6m16%
56Claude Sonnet 516.0%$0.06817.1s10%
57Ministral 8B6.4%$0.001615.6s4%
58Gemini 3.1 Flash Lite5.9%$0.00313.3s2%
59DeepSeek V4 Pro7.4%$0.008317.3s4%
60DeepSeek V3.28.7%$0.004633.9s5%
61Gemma 4 26B6.5%$0.001827.2s5%
62o4 Mini High21.0%$0.0591.3m11%
63Qwen 3.6 Flash11.4%$0.01551.7s7%
64GPT-5.4 Mini (Reasoning, Low)6.8%$0.01414.4s5%
65GPT-5.4 Mini6.1%$0.00877.9s3%
66DeepSeek V4 Flash11.8%$0.002051.4s4%
67Ministral 3 14B6.9%$0.003125.4s4%
68GPT-5 Mini20.3%$0.0192.0m9%
69o4 Mini12.0%$0.03745.7s8%
70Grok 4.205.9%$0.0207.5s4%
71Z.AI GLM 4.58.0%$0.007548.1s6%
72Ministral 3 3B3.5%$0.00079.9s3%
73GPT-4.17.0%$0.0248.5s4%
74Mistral Large 29.2%$0.03720.5s6%
75Ministral 3B4.1%$0.00079.8s2%
76Xiaomi MIMO v2.5 Pro20.6%$0.00761.9m5%
77GPT-5.6 Luna4.5%$0.0128.7s3%
78Qwen 3.6 35B10.4%$0.0141.1m8%
79GPT-5.4 Nano3.1%$0.002611.2s2%
80GPT-5.4 Mini (Reasoning)38.2%$0.1172.8m18%
81GPT-4o, Aug. 6th (temp=0)9.3%$0.0328.4s1%
82Mistral Small 3.2 24B3.5%$0.001713.8s1%
83GPT-4.1 Mini3.5%$0.004626.0s3%
84Z.AI GLM 5.168.0%$0.0817.3m26%
85GPT-5.4 Nano (Reasoning, Low)2.4%$0.003813.8s2%
86MiniMax M359.9%$0.0369.3m44%
87Writer: Palmyra X53.9%$0.01618.4s3%
88Claude Haiku 4.54.8%$0.0248.2s2%
89GPT-4o Mini (temp=0)2.6%$0.001920.7s1%
90DeepSeek V3.19.1%$0.005552.0s1%
91Mistral NeMO2.2%$0.002415.4s0%
92GPT-4.1 Nano0.2%$0.00096.9s0%
93Gemini 2.5 Flash Lite0.2%$0.00234.8s0%
94Mistral Small 40.4%$0.00307.4s0%
95DeepSeek-V2 Chat4.3%$0.004934.0s1%
96DeepSeek V3 (2024-12-26)3.3%$0.004540.2s3%
97Claude Sonnet 412.5%$0.07217.5s4%
98Grok 4.3 (Reasoning)1.5%$0.01313.9s1%
99Mistral Small 4 (Reasoning)2.0%$0.005124.7s1%
100Z.AI GLM 4.731.8%$0.0253.7m9%
101Qwen 3.5 35B13.1%$0.0152.0m8%
102Llama 3.1 70B3.1%$0.006434.0s1%
103GPT-OSS 120B13.4%$0.00402.2m7%
104Gemini 2.5 Flash Lite (Reasoning)5.6%$0.00731.0m2%
105GPT-4o Mini (temp=1)1.4%$0.002633.4s1%
106Gemini 2.5 Flash (Reasoning)6.1%$0.02337.3s1%
107Qwen 3.5 27B25.1%$0.0293.7m15%
108Z.AI GLM 540.4%$0.0374.6m11%
109ByteDance Seed 1.6 Flash1.4%$0.002034.2s0%
110Gemma 3 4B0.1%$0.000727.5s0%
111Gemma 3 27B0.2%$0.001627.5s0%
112GPT-4o, Aug. 6th (temp=1)1.6%$0.0299.1s1%
113Gemma 3 12B0.0%$0.001430.4s0%
114Qwen3 235B A22B Instruct 25073.1%$0.00171.0m2%
115Hermes 3 70B1.2%$0.004542.7s0%
116Cydonia 24B V4.12.6%$0.00401.0m1%
117Aion 2.017.7%$0.0243.0m10%
118DeepSeek V3 (2025-03-24)0.8%$0.003750.3s0%
119Aion 3.0 Mini35.2%$0.0304.9m13%
120Qwen 2.5 72B1.7%$0.00561.2m1%
121Qwen 3.5 Plus (2026-02-15)24.9%$0.0213.9m10%
122Gemma 4 31B6.8%$0.00281.9m3%
123Hermes 3 405B1.8%$0.0151.0m1%
124Qwen3.6 Max Preview34.7%$0.0843.7m10%
125Qwen 3.6 27B17.7%$0.0342.7m5%
126Aion 3.054.8%$0.0745.8m9%
127Qwen 3.5 Flash16.3%$0.00403.8m10%
128Claude Opus 4.8 (Reasoning, Low)61.4%$0.3831.9m25%
129Qwen 3.5 Plus (2026-04-20)11.8%$0.0233.1m8%
130WizardLM 2 8x22b6.2%$0.00982.3m2%
131ByteDance Seed 2.0 Lite20.3%$0.0143.6m1%
132Arcee AI: Trinity Mini0.5%$0.00371.9m0%
133Nemotron 3 Super23.0%$0.00005.5m13%
134Cohere Command R+ (Aug. 2024)0.4%$0.05756.5s0%
135Gemma 4 26B (Reasoning)8.1%$0.00413.1m3%
136Z.AI GLM 4.7 Flash3.9%$0.00502.8m4%
137GPT-5 Nano1.9%$0.00802.2m1%
138Qwen 3 32B2.0%$0.00422.9m2%
139Z.AI GLM 4.5 Air4.8%$0.00713.2m2%
140Nemotron 3 Nano0.4%$0.00392.8m0%
141Qwen 3.5 122B12.1%$0.0354.0m6%
142Gemma 4 31B (Reasoning)19.5%$0.00435.8m2%
143Claude Sonnet 4.6 (Reasoning)70.7%$0.4485.9m32%
144ByteDance Seed 2.0 Mini12.7%$0.00628.7m11%
145Qwen 3.5 9B4.6%$0.00407.8m1%
146Claude Opus 413.6%$0.3682.4m7%
23.49%

Individual Scenarios

Model # 1 # 2 # 3 # 4 # 5 Avg ▼
GPT-5.6 Sol (Reasoning)100100100100100100.0%
Claude Opus 4.6 (Reasoning)100100100100100100.0%
Grok 4.5 (Reasoning, High)100100100100100100.0%
Gemini 3.1 Pro (Preview)100100100100100100.0%
GPT-5.4 (Reasoning)100100100100100100.0%
GPT-5.5 (Reasoning)100100100100100100.0%
Claude Sonnet 4.6 (Reasoning)100100100100100100.0%
Claude Opus 4.7 (Reasoning)100100100100100100.0%
GPT-5.5 (Reasoning, Low)100100100100100100.0%
Claude Opus 4.8 (Reasoning)100100100100100100.0%
GPT-5.5100100100100100100.0%
GPT-51001001001009198.2%
Claude Opus 4.7100100100838393.1%
Z.AI GLM 5.11001001001005591.0%
Aion 3.01001001001005591.0%
Gemini 2.5 Pro1001001001005591.0%
MoonshotAI: Kimi K2.6100100100836890.1%
Claude Opus 4.61001001001004989.8%
Grok 4.5 (Reasoning, Low)100100100915589.2%
GPT-5.6 Sol1001001001004488.8%
Claude Sonnet 5 (Reasoning)10010091685582.7%
Qwen3.7 Max100100100682778.9%
GPT-5.6 Terra (Reasoning)10010083684478.8%
Claude Sonnet 5 (Reasoning, Low)10010068555575.5%
MoonshotAI: Kimi K2.5100100100352772.3%
Gemini 3.5 Flash (Reasoning)10010010055171.3%
Gemini 3 Flash (Preview, Reasoning)10010010055171.3%
Z.AI GLM 5 Turbo1006868494465.7%
Claude Opus 4.8 (Reasoning, Low)1001006855164.8%
MiniMax M3836868554463.3%
Qwen3.6 Max Preview1005555553559.8%
Z.AI GLM 510010055271659.5%
GPT-5.4 (Reasoning, Low)757549494458.4%
Claude Sonnet 4.61005544444457.3%
GPT-5.4 Mini (Reasoning)916844442153.4%
GPT-5.2837544352452.0%
GPT-5.6 Terra834944443951.7%
GPT-5.6 Luna (Reasoning)1006844351151.5%
Aion 3.0 Mini100615535150.4%
Z.AI GLM 4.6555555443949.5%
GPT-5.1836144312448.4%
Z.AI GLM 4.791555535648.2%
Gemini 3 Flash (Preview)555544393946.3%
Claude Opus 4.51004427272745.0%
DeepSeek V4 Flash (Reasoning)1004427242143.1%
DeepSeek V4 Pro (Reasoning)1005527161642.6%
Xiaomi MIMO v2.51003927271641.7%
Qwen 3.5 Plus (2026-02-15)685544212141.6%
Qwen 3.5 397B A17B554444442141.4%
GPT-5.4493939393941.1%
Gemini 3.5 Flash (Reasoning, Minimal)100552711840.3%
ByteDance Seed 2.0 Lite10055277438.5%
Z.AI GLM 5.2 (Reasoning, High)444444272737.1%
o4 Mini High554431272736.7%
Gemma 4 31B (Reasoning)55554427236.6%
Nemotron 3 Super68393531034.4%
Qwen 3.5 27B75352727032.7%
GPT-5 Mini614427161632.6%
ByteDance Seed 1.6443931181829.9%
Qwen 3.6 27B83311813529.9%
Claude Sonnet 4.5272727272727.0%
Claude Sonnet 5442724211626.2%
Grok 4.20 (Reasoning)442424241626.1%
Inception Mercury 2393924131325.7%
Qwen 3.5 Flash443127131325.7%
Xiaomi MIMO v2.5 Pro4935247323.5%
GPT-OSS 120B313121211022.5%
DeepSeek V4 Flash39242416721.8%
Claude Sonnet 427272727121.7%
GPT-5.4 Nano (Reasoning)35242416821.2%
Claude Opus 427272724121.1%
Qwen 3.5 35B27272421620.8%
MiniMax M2.735271616719.9%
Qwen 3.5 122B31272116619.9%
Qwen 3.6 Flash312721111019.9%
MiniMax M2.5272421161119.7%
ByteDance Seed 2.0 Mini272416161619.5%
Qwen 3.6 35B272116161318.4%
GPT-4o, Aug. 6th (temp=0)4921135017.6%
DeepSeek V3.127242413017.6%
o4 Mini27211616817.4%
Qwen 3.5 Plus (2026-04-20)31211613617.2%
Gemini 2.5 Flash27241810717.0%
Mistral Large 2242113131316.9%
Aion 2.0493500016.8%
Grok 4.33118138715.4%
Gemma 4 26B (Reasoning)2727117214.9%
Mistral Large 3211313131314.8%
DeepSeek V3.224161310613.6%
Ministral 3 8B2116166512.4%
Ministral 3 14B16161111611.9%
DeepSeek V4 Pro271388211.8%
Gemma 4 31B2116116411.4%
GPT-4.1241188511.2%
Gemma 4 26B131111101011.1%
GPT-5.4 Mini13131310611.1%
Z.AI GLM 4.5181687711.1%
Gemini 3.1 Flash Lite (Reasoning)11111111810.8%
Mistral Medium 3.1241873110.6%
Gemini 3.1 Flash Lite1811118410.6%
GPT-5.4 Mini (Reasoning, Low)1813118110.3%
Gemini 3.1 Flash Lite (Preview)161188810.3%
WizardLM 2 8x22b242421110.3%
Grok 4.2021117659.9%
Ministral 8B18117649.2%
Qwen 3.5 9B16108718.4%
Claude Haiku 4.513138228.0%
DeepSeek-V2 Chat2476217.9%
Z.AI GLM 4.5 Air24103207.8%
Ministral 3B1686607.1%
Gemini 2.5 Flash (Reasoning)2722116.5%
Writer: Palmyra X51186616.4%
Mistral Small 3.2 24B1087616.3%
GPT-4.1 Mini876556.0%
Z.AI GLM 4.7 Flash1066545.9%
GPT-5.6 Luna1364335.8%
Llama 3.1 70B1384215.7%
DeepSeek V3 (2024-12-26)776635.6%
Gemini 2.5 Flash Lite (Reasoning)1643225.5%
Ministral 3 3B877415.4%
Qwen3 235B A22B Instruct 2507886215.1%
GPT-4o Mini (temp=0)1055324.9%
GPT-5.4 Nano1143214.4%
Mistral NeMO1361004.1%
Cydonia 24B V4.11322103.7%
Mistral Small 4 (Reasoning)644303.3%
GPT-5 Nano654203.3%
Qwen 3 32B643213.2%
Qwen 2.5 72B632223.1%
GPT-5.4 Nano (Reasoning, Low)1021103.0%
GPT-4o Mini (temp=1)532212.6%
Hermes 3 405B722102.5%
GPT-4o, Aug. 6th (temp=1)632002.4%
Hermes 3 70B811102.1%
Grok 4.3 (Reasoning)332202.1%
ByteDance Seed 1.6 Flash710001.6%
DeepSeek V3 (2025-03-24)332001.6%
Arcee AI: Trinity Mini500001.0%
Cohere Command R+ (Aug. 2024)220000.8%
Nemotron 3 Nano111000.7%
Mistral Small 4200000.5%
Gemma 3 27B100000.3%
GPT-4.1 Nano000000.3%
Gemini 2.5 Flash Lite100000.2%
Gemma 3 4B000000.1%
Gemma 3 12B000000.0%
Model # 1 # 2 # 3 # 4 # 5 Avg ▼
GPT-5.6 Sol (Reasoning)1001001001008697.3%
GPT-5.4 (Reasoning)10010096868092.6%
GPT-5.5 (Reasoning)868686866982.9%
Claude Opus 4.6 (Reasoning)808080776977.3%
Grok 4.5 (Reasoning, High)808080776977.3%
Claude Opus 4.8 (Reasoning, Low)865954504258.1%
MiniMax M3806969333256.5%
DeepSeek V4 Flash (Reasoning)937748442156.5%
MoonshotAI: Kimi K2.6905652403855.1%
Claude Opus 4.8 (Reasoning)935042423852.8%
MoonshotAI: Kimi K2.5726159322048.6%
GPT-5.6 Sol866440322148.5%
Z.AI GLM 5.1594642404045.1%
GPT-5.6 Terra (Reasoning)803838362243.0%
Claude Sonnet 5 (Reasoning, Low)804640301943.0%
Claude Sonnet 4.6 (Reasoning)744432292941.4%
Claude Opus 4.6594038362038.6%
Claude Sonnet 5 (Reasoning)464238241933.6%
Gemini 3.1 Pro (Preview)806443230.6%
Z.AI GLM 5.2 (Reasoning, High)463526242230.4%
GPT-5.5 (Reasoning, Low)69322921030.1%
Z.AI GLM 5 Turbo6148267028.4%
Gemini 3.5 Flash (Reasoning)442727241928.2%
GPT-5.4 (Reasoning, Low)443820151426.1%
Grok 4.5 (Reasoning, Low)462622201525.9%
GPT-5.5353532161125.6%
Gemini 2.5 Pro56262616125.0%
Claude Opus 4.7 (Reasoning)5032229423.3%
GPT-5.4 Mini (Reasoning)40322418223.0%
Qwen3.7 Max6126260022.6%
Z.AI GLM 5504684021.4%
DeepSeek V4 Pro (Reasoning)5629116220.8%
Aion 3.0 Mini4429270019.9%
Claude Opus 4.733301310919.1%
Aion 2.0322216131118.7%
Aion 3.0642550018.6%
GPT-5.227201915918.1%
GPT-5.4 Nano (Reasoning)25211917717.8%
Xiaomi MIMO v2.5 Pro661083217.6%
Qwen 3.5 27B292116111117.5%
Z.AI GLM 4.632211511516.8%
GPT-5.6 Luna (Reasoning)25241412916.7%
Claude Opus 4.52718149915.6%
Claude Sonnet 4.620191713815.5%
Z.AI GLM 4.721181711915.4%
Qwen 3.5 397B A17B25241311415.2%
Gemini 3 Flash (Preview, Reasoning)331183311.8%
Nemotron 3 Super2221140011.6%
GPT-5.6 Terra15131110811.4%
Xiaomi MIMO v2.5351092111.3%
Gemini 3 Flash (Preview)211575310.3%
GPT-5.1201287410.1%
Claude Sonnet 4.5131111869.8%
GPT-5.412119979.8%
Qwen3.6 Max Preview1698879.5%
Qwen 3.5 Plus (2026-02-15)14106558.3%
Mistral Medium 3.12177328.2%
GPT-5 Mini1399558.0%
Grok 4.20 (Reasoning)12119427.7%
ByteDance Seed 1.619105407.5%
Qwen 3.5 Flash1775416.9%
o4 Mini1096436.5%
Qwen 3.5 Plus (2026-04-20)1366526.3%
Claude Opus 4977526.1%
ByteDance Seed 2.0 Mini1095326.0%
Claude Sonnet 51086335.8%
Gemini 2.5 Flash Lite (Reasoning)1973105.8%
Gemini 2.5 Flash (Reasoning)2422205.7%
Qwen 3.6 27B1085325.6%
GPT-51354325.5%
Qwen 3.5 35B1465205.4%
o4 Mini High876425.4%
Z.AI GLM 4.5974324.9%
Qwen 3.5 122B954404.3%
GPT-OSS 120B754324.3%
DeepSeek V3.2653323.8%
Ministral 8B843313.7%
Inception Mercury 2961113.6%
MiniMax M2.5643223.6%
Claude Sonnet 4822223.3%
GPT-5.4 Mini (Reasoning, Low)653213.2%
GPT-5.6 Luna543223.2%
Qwen 3.6 Flash822213.0%
DeepSeek V4 Pro1011112.9%
GPT-4.1443222.8%
Ministral 3 8B543212.8%
Gemma 4 31B (Reasoning)432202.4%
Qwen 3.6 35B533002.3%
Gemma 4 31B322222.2%
WizardLM 2 8x22b432102.1%
ByteDance Seed 2.0 Lite333202.1%
MiniMax M2.7432112.1%
Gemma 4 26B222222.0%
Grok 4.20432001.9%
Ministral 3 14B332111.9%
Z.AI GLM 4.7 Flash522001.9%
GPT-5.4 Nano322211.8%
DeepSeek V4 Flash322211.8%
GPT-5.4 Nano (Reasoning, Low)322111.8%
Z.AI GLM 4.5 Air421101.7%
Ministral 3 3B421101.6%
Gemini 2.5 Flash222111.6%
Claude Haiku 4.5222111.6%
Mistral Large 3222111.5%
Mistral Large 2221111.5%
Grok 4.3321101.4%
Cydonia 24B V4.1421101.4%
Writer: Palmyra X5331001.4%
Gemini 3.1 Flash Lite221111.3%
Gemini 3.1 Flash Lite (Preview)211111.3%
Gemma 4 26B (Reasoning)600001.3%
Gemini 3.1 Flash Lite (Reasoning)211111.2%
Hermes 3 405B510001.1%
Ministral 3B211101.1%
Qwen3 235B A22B Instruct 2507411001.1%
GPT-4o, Aug. 6th (temp=0)211111.1%
Gemini 3.5 Flash (Reasoning, Minimal)221001.1%
GPT-5.4 Mini211101.0%
GPT-4.1 Mini211101.0%
DeepSeek V3 (2024-12-26)211001.0%
Grok 4.3 (Reasoning)211100.9%
Qwen 3 32B311000.9%
GPT-4o, Aug. 6th (temp=1)111100.9%
Qwen 3.5 9B111100.9%
Mistral Small 4 (Reasoning)111100.8%
DeepSeek-V2 Chat211000.7%
Mistral Small 3.2 24B111000.6%
DeepSeek V3.1110000.6%
GPT-5 Nano111000.5%
Llama 3.1 70B110000.5%
Mistral Small 4110000.4%
GPT-4o Mini (temp=0)110000.4%
Hermes 3 70B200000.4%
Qwen 2.5 72B100000.4%
Mistral NeMO100000.3%
Gemini 2.5 Flash Lite100000.2%
GPT-4o Mini (temp=1)000000.1%
ByteDance Seed 1.6 Flash00.1%
Gemma 3 4B000000.1%
Gemma 3 27B000000.0%
Cohere Command R+ (Aug. 2024)000000.0%
GPT-4.1 Nano000000.0%
Arcee AI: Trinity Mini000000.0%
DeepSeek V3 (2025-03-24)000000.0%
Nemotron 3 Nano000000.0%
Gemma 3 12B000000.0%