Extremely unscientific benchmark on local models 2026-08-26

2026-08-26 09:08:06 - No Comments

Local model benchmark — harness: opencode 1.18.16

Model Pass rate First-try validity Avg repairs Avg generation Avg execution Tokens/sec
hf.co/unsloth/Qwen3.8-27B-GGUF:UD-Q4_K_M 86/99 (86.9%) 100.0% 0.00 2m 26s 122 ms 5.6
hf.co/unsloth/Qwen3.8-27B-GGUF:UD-Q5_K_XL 89/99 (89.9%) 100.0% 0.00 2m 38s 74 ms 5.6
laguna-xs.2:latest 91/99 (91.9%) 100.0% 0.00 93.31 s 224 ms 34.1
muse-glimmer:30b 87/99 (87.9%) 100.0% 0.00 2m 11s 172 ms 11.6
nemotron-3.5-lightning:30b 78/99 (78.8%) 98.9% 0.01 2m 45s 124 ms 46.7
ornith:35b 72/99 (72.7%) 100.0% 0.00 49.96 s 3.40 s 34.6
qwen3.6:27b 85/99 (85.9%) 100.0% 0.00 2m 18s 129 ms 3.9
qwen3.6:35b 78/99 (78.8%) 100.0% 0.00 53.89 s 3.43 s 23.9
qwen3.8:27b 91/99 (91.9%) 100.0% 0.00 72.79 s 129 ms 15.4

Be the first to leave a comment!


Leave a Reply

Your email address will not be published. Required fields are marked *

This site uses Akismet to reduce spam. Learn how your comment data is processed.