Frontier zone · Model releases

The frontier of open-weight model releases

Open-weight model releases tracked by RunLocalAI — recent additions, rising families, distill chains, multimodal and reasoning waves. Each card links into the catalog with authority badges (L1.25 enriched · benchmark-backed · verdict) so you can scan editorial coverage at a glance.

By Eruo Fredoline · Refreshed continuously from catalog seed
Filter

Filtered results (28)

Models matching your filters. Clear filters by clicking “Any” on each row above, or remove individual filters via the URL.

Muse Glimmer 30B

Meta · 2026-08-10
30Bworkstation
BenchmarkVerdictMultimodal

Gemma 4 26B MoE

Google · 2026-04-02
26Bworkstation

Gemma 4 MoE — workstation efficiency variant

VerdictMultimodal

Gemma 4 12B

Google · 2026-04-02
12Bconsumer

multimodal general assistant on 12-16GB GPUs

Multimodal

Qwen3.5 9B

Alibaba · 2026-03-02
9Bconsumer

multilingual chat and coding on 8-12GB GPUs

Multimodal

Phi-4 Multimodal

Microsoft · 2026-02-25
14Bconsumer

16GB-consumer multimodal Q&A

VerdictMultimodal

MiniCPM-V 3 8B

OpenBMB · 2025-08-14
8Bconsumer

consumer multimodal document Q&A

VerdictMultimodal

MedGemma 27B

Google · 2025-05-20
27Bworkstation

medical-domain fine-tune of Gemma 3 27B

VerdictMultimodal

Gemma 3 12B

Google · 2025-03-12
12Bconsumer

consumer-tier multilingual chat with vision support in 'it' variant

BenchmarkVerdictMultimodal

Qwen 2.5-VL 72B

Alibaba · 2025-03-10
72Bdatacenter

frontier-tier multimodal serving

VerdictMultimodal

Qwen 2.5-VL 7B

Alibaba · 2025-03-10
7Bconsumer

consumer-tier OCR + image Q&A

VerdictMultimodal

Janus-Pro 7B

DeepSeek AI · 2025-01-29
7Bconsumer

consumer multimodal with image-generation

VerdictMultimodal

InternVL 2.5 78B

OpenGVLab · 2024-12-05
78Bdatacenter

datacenter-tier permissive VLM

VerdictMultimodal

InternVL 2.5 26B

OpenGVLab · 2024-12-05
26Bconsumer

permissively-licensed VLM at 24GB VRAM

VerdictMultimodal

PaliGemma 2 10B

Google · 2024-12-05
10Bconsumer

VLM fine-tuning at 24GB VRAM

VerdictMultimodal

Llama 3.2 90B Vision Instruct

Meta · 2024-09-25
90Bdatacenter

datacenter vision-language Llama at 70B-class

VerdictMultimodal

Llama 3.2 90B Vision

Meta · 2024-09-25
90Bdatacenter

datacenter-tier multimodal serving

VerdictMultimodal

Molmo 72B

Allen Institute (AI2) · 2024-09-25
72Bdatacenter

datacenter-tier open VLM for agent UI

VerdictMultimodal

Llama 3.2 11B Vision Instruct

Meta · 2024-09-25
11Bconsumer

consumer-tier vision-language Llama

BenchmarkVerdictMultimodal

Molmo 7B-D

Allen Institute (AI2) · 2024-09-25
8Bconsumer

open-research VLM with UI grounding

VerdictMultimodal

Pixtral 12B

Mistral AI · 2024-09-17
12Bconsumer

consumer-tier vision-language Mistral

VerdictMultimodal

MiniCPM-V 2.6 8B

OpenBMB · 2024-08-30
8Bconsumer

consumer multimodal document Q&A

VerdictMultimodal

Qwen 2-VL 7B

Alibaba · 2024-08-29
7Bconsumer

consumer-tier multimodal — pre-2.5-VL baseline

VerdictMultimodal

LLaVA-OneVision 7B

LLaVA Team · 2024-08-06
7Bconsumer

permissively-licensed multi-image / video VLM

VerdictMultimodal

GLM-4V 9B

Zhipu AI · 2024-06-04
13.9Bconsumer

Chinese document VLM

VerdictMultimodal

LLaVA 1.6 Mistral 7B

LLaVA Team · 2024-01-30
7Bconsumer

consumer-tier vision-language with permissive license

VerdictMultimodal

Nemotron 3 Nano Omni 33B

NVIDIA
33Bworkstation

multimodal video/audio/image/text tasks on 32GB+ GPUs

BenchmarkMultimodal

Ministral 3 14B

Mistral AI
14Bconsumer

general chat with vision on 16GB GPUs

Multimodal

Trendyol LLM Asure 12B

Trendyol
11.8Bconsumer

Turkish business workflow assistants

BenchmarkMultimodal

Going deeper

  • Ecosystem maps — structured-landscape views (memory frameworks, inference runtimes, MCP, coding agents).
  • Execution stacks — recipes that combine models with runtimes + hardware.
  • Frontier index — broader ecosystem-momentum view across coding agents, inference runtimes, memory systems, MCP.
  • Benchmarks — measured tokens-per-second + topology fields across hardware/model/runtime triples.