Open model directory

43 models · leaderboard snapshot from local.ai (2026-08). Intelligence = 10% τ² + 35% GAIA + 55% GDPval. Each model page adds quant-size estimates, VRAM fit checks and the self-hosting savings calculator.

ModelMakerParamsIntelligenceτ²GAIAGDPval
Step 3.7 FlashStepFun148B78.899%87%70%details →
DeepSeek V4 Flash 0731DeepSeek162B77.585%76%77%details →
DeepSeek V4 FlashDeepSeek162B77.380%82%74%details →
Qwen3.6 27BQwen27B76.5100%74%74%details →
Qwen3.6 35B A3BMoEQwen35BA3B74.999%74%71%details →
Ornith 1.0 35BHCompany35B74.199%72%71%details →
Agents A1agentsr0b0tlab72.593%82%63%details →
Ornith 1.0 397BHCompany397B72.497%69%70%details →
Laguna S 2.1Liquid71.662%73%73%details →
Nex N2 MiniInternScience71.385%79%64%details →
Gemma 4 31B ItGoogle31B66.277%71%61%details →
Nemotron 3.5 LightningNVIDIA65.562%68%65%details →
Nemotron 3 Super 120B A12BMoENVIDIA120BA12B64.668%70%60%details →
Gemma 4 26B A4BMoEGoogle26BA4B62.880%65%58%details →
Holo 3.1 35B A3BMoEPrismML35BA3B60.797%59%55%details →
Qwen3.5 9B BaseQwen9B59.399%54%55%details →
Bonsai 27BXiaomi27B5968%59%58%details →
Laguna XS 2.1Liquid58.857%64%56%details →
Gpt Oss 120BOpenAI120B55.565%56%53%details →
Qwen3.5 9BQwen9B55.398%55%47%details →
Gemma 4 12B ItGoogle12B5482%54%49%details →
Diffusiongemma 26B A4B ItMoEdiffusionGoogle26BA4B50.366%45%51%details →
Gpt Oss 20BOpenAI20B43.378%44%37%details →
Nemotron 3 Nano 30B A3BMoENVIDIA30BA3B42.439%46%41%details →
Mimo V2 FlashXiaomi3985%38%31%details →
Nemotron 3 Nano Omni 30B A3B ReasoningMoEreasoningNVIDIA30BA3B34.148%33%32%details →
Gemma 4 E4B ItedgeGoogle4B28.414%30%30%details →
Gemma 4 E2B ItedgeGoogle2B20.68%26%19%details →
LFM2.5 8B A1BMoEedgeLiquid8BA1B17.994%9%10%details →
Gemma 4 12B Coder Fable5 Composer2.5 V1Googledetails →
Llama 3.1 70BMeta70Bdetails →
Llama 3.1 70B InstructMeta70Bdetails →
Llama 3.1 Nemotron 70BNVIDIA70Bdetails →
Llama 3.3 70B InstructMeta70Bdetails →
Nemotron 3 Ultra 550B A55BMoENVIDIA550BA55Bdetails →
Qwen2 72B InstructQwen72Bdetails →
Qwen2.5 32BQwen32Bdetails →
Qwen2.5 72BQwen72Bdetails →
Qwen2.5 72B InstructQwen72Bdetails →
Qwen2.5 Coder 32BcodingQwen32Bdetails →
Qwen3 235B A22BMoEQwen235BA22Bdetails →
Qwen3-32BQwen32Bdetails →
Qwen3.5 122B A10BMoEQwen122BA10Bdetails →

Makers represented: DeepSeek, Google, HCompany, InternScience, Liquid, Meta, NVIDIA, OpenAI, PrismML, Qwen, StepFun, Xiaomi, r0b0tlab. Benchmark methodology and measurements belong to local.ai / Exo Labs; this directory is an independent presentation layer with fit and cost estimates.