Free LLMs

Täglich aktualisierte Übersicht aller Modelle, die kostenlos nutzbar sind – ob Open Weight, Free API Tier oder lokal.

153
Modelle
38
Aktiv
115
Inaktiv
26
Gerüchte

MAI-Voice-2

Aktiv

Microsoft MAI-Voice-2, kostenlos über OpenRouter

Free API Tier·Proprietär·
Quelle ↗

MAI-Transcribe 1.5

Aktiv

Microsoft MAI-Transcribe 1.5, kostenlos über OpenRouter

Free API Tier·Proprietär·
Quelle ↗

MAI-Image-2.5

Aktiv

Microsoft MAI-Image-2.5, kostenlos über OpenRouter

Free API Tier·Proprietär·
Quelle ↗

Qwen3.7 Plus

Aktiv

Alibaba Qwen3.7 Plus, kostenlos über OpenRouter

Free API Tier·Proprietaer·
Quelle ↗

Riverflow V2.5 Pro

Aktiv

Sourceful Riverflow V2.5 Pro, kostenlos über OpenRouter

Free API Tier·Proprietary·
Quelle ↗

Riverflow V2.5 Fast

Aktiv

Sourceful Riverflow V2.5 Fast, kostenlos über OpenRouter

Free API Tier·Proprietary·
Quelle ↗

Nemotron 3.5 Content Safety (free)

Aktiv

NVIDIA Nemotron 3.5 Content Safety, kostenlos über OpenRouter

Open Weight·NVIDIA Open License·
Quelle ↗

Nemotron 3 Ultra (free)

Aktiv

NVIDIA Nemotron 3 Ultra, 550B Parameter (55B aktiv), 1M Kontext, kostenlos über OpenRouter

Open Weight·550B (55B aktiv)·NVIDIA Open License·
Quelle ↗

Llama Nemotron Rerank VL 1B V2 (free)

Aktiv

NVIDIA Nemotron Rerank VL 1B V2 für Multimodal-Rewriting, kostenlos über OpenRouter

Open Weight·1B·Open·
Quelle ↗

Claude Fable Latest

Aktiv

Anthropic Claude Fable Latest, kostenlos über OpenRouter

Free API Tier·Proprietär·
Quelle ↗

Claude Fable 5

Aktiv

Anthropic Claude Fable 5, kostenlos über OpenRouter

Free API Tier·Proprietär·
Quelle ↗

Nex-N2-Pro (free)

Aktiv

Nex AGI Nex-N2-Pro, agentischer MoE mit 17B aktiven Parametern (397B gesamt), kostenlos über OpenRouter

Free API Tier·397B (17B aktiv)·
Quelle ↗

Gemini 3.5 Flash

Aktiv

Googles neuestes Flash-Modell mit verbesserter Geschwindigkeit und Effizienz, optimiert für Echtzeitanwendungen.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Qwen3.7 Max

Aktiv

Alibabas aktuelles Flaggschiff-Modell der Qwen-Reihe mit verbesserten Reasoning-Fähigkeiten und multimodaler Unterstützung.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Grok Build 0.1

Aktiv

xAI Grok Build 0.1 ist ein frühes Entwicklungsmodell mit Fokus auf Code-Generierung und technische Problemlösung.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Kimi K2.6

Aktiv

Aktualisiert: Kimi K2.6 weiterhin kostenlos auf OpenRouter und Ollama Cloud verfügbar.

·
Quelle ↗

Gemma 4 31B

Aktiv

Aktualisiert: Google Gemma 4 31B weiterhin kostenlos auf OpenRouter verfügbar.

·
Quelle ↗

Gemma 4 26B A4B

Aktiv

Update: Weiterhin kostenlos auf OpenRouter.

·

Nicht mehr in Quellen gefunden

MiniMax M3

Aktiv

MiniMax M3, das neueste KI-Modell von MiniMax, bietet multimodale Fähigkeiten mit Fokus auf Text- und Bildverständnis, verfügbar auf OpenRouter zum kostenlosen Testen.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Claude Opus 4.8

Aktiv

Anthropics leistungsstärkstes Modell mit fortschrittlichen Reasoning-Fähigkeiten, dynamischen Workflows und verbesserter Code-Generierung.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Cohere Command Light

Aktiv

Coheres neues leichtgewichtiges Command-Modell für einfache Aufgaben mit niedrigeren Kosten, verfügbar auf Amazon Bedrock.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Fusion

Aktiv

Ein von OpenRouter bereitgestelltes kostenloses Modell, das mehrere Modelle zu einem optimierten Output kombiniert.

Free API Tier·Proprietaer·
Quelle ↗

Gemma 4 12B

Aktiv

Googles neues offenes Multimodal-Modell (12B Parameter), encoder-frei, verarbeitet Text und Bild-Eingaben, gibt Text aus. Open Weight unter Apache 2.0.

Open Weight·12B·Apache 2.0·
Quelle ↗

Laguna XS.2

Aktiv

Kompaktes multimodales Modell aus OpenRouters Free-Collection.

Free API Tier·
Quelle ↗

Laguna M.1

Aktiv

Multimodales Modell aus OpenRouters Free-Collection.

Free API Tier·
Quelle ↗

Nemotron 3 Nano Omni

Aktiv

NVIDIA Nemotron 3 Nano Omni – kostenloses multimodales Modell in OpenRouters Free Collection.

Free API Tier·
Quelle ↗

Nemotron 3 Super

Aktiv

NVIDIA Nemotron 3 Super – kostenlose Variante in OpenRouters Free Collection.

Free API Tier·
Quelle ↗

Nemotron Nano 12B 2 VL

Aktiv

NVIDIA Nemotron Nano 12B – kleines, kostenloses Vision-Language-Modell in OpenRouters Free Collection.

Free API Tier·12B·
Quelle ↗

Nemotron 3 Nano 30B A3B

Aktiv

NVIDIA Nemotron 3 Nano 30B – aktivierte Variante (30B aktiv, 3B Basis), kostenlos in OpenRouter.

Open Weight·30B active / 3B base·
Quelle ↗

Llama Nemotron Embed VL 1B V2

Aktiv

NVIDIA Llama Nemotron Embed – kleines Vision-Language-Embedding-Modell (1B), kostenlos in OpenRouter.

Free API Tier·1B·
Quelle ↗

LFM2.5-1.2B-Thinking

Aktiv

Kleines Denk-Modell (1.2B) aus OpenRouters Free Collection.

Free API Tier·1.2B·
Quelle ↗

LFM2.5-1.2B-Instruct

Aktiv

Kleines Instruct-Modell (1.2B) aus OpenRouters Free Collection.

Free API Tier·1.2B·
Quelle ↗

Nex-N2-Pro

Aktiv

Agentisches Mixture-of-Experts-Modell von Nex AGI mit 17B aktiven Parametern (397B total). Basierend auf Qwen3.5-Architektur, unterstützt Reasoning, Function Calling, Bild+Text-Eingabe und strukturierte Ausgaben. Optimiert für Coding, Tool-Use und langfristige Agenten-Workflows. Apache 2.0 Lizenz.

Open Weight·397B (17B aktiv)·Apache 2.0·
Quelle ↗

Nano Banana Pro

Aktiv

Neues Bildgenerierungs- und Editierungsmodell von Google DeepMind. Basiert auf Gemini 3 Pro. Verfügbar über Google AI Studio. Free API Tier mit Ratelimits.

Free API Tier··Proprietär (Google)·
Quelle ↗

Llama Nemotron Rerank VL 1B V2

Aktiv

NVIDIAs leichtes Reranker-Modell, optimiert für Relevanz-Scoring von Textpassagen. Verfügbar auf OpenRouter mit kostenlosem API-Zugang und optimiert für RAG-Pipelines und Suchanwendungen.

Free API Tier·1B·NVIDIA Open Model License·
Quelle ↗

Supra-50M-Reasoning

Aktiv

Extrem kleines Reasoning-Modell (50M Parameter) von SupraLabs. Produziert vollständige Thinking-Chain vor jeder Antwort. Apache 2.0 Lizenz, läuft auf CPU. SFT auf SupraThink-Dataset-500x.

Open Weight·50M·Apache 2.0·
Quelle ↗

DeepSeek V4 Flash

Aktiv

Aktualisiert: DeepSeek V4 Flash weiterhin kostenlos auf OpenRouter und Ollama Cloud verfügbar.

·
Quelle ↗

Claude Opus 4.8 (Fast)

Aktiv

Anthropics neuestes Spitzenmodell Claude Opus 4.8 mit schnellerer Inferenz (Fast-Variante). Unterstützt dynamische Workflows und verbesserte Code-Generierung.

Free API Tier·unbekannt·proprietär·
Quelle ↗

Gerüchte

Claude Fable 5

Anthropic veröffentlicht Claude Fable 5 am 9. Juni 2026 — eine öffentliche Version des zuvor internen Mythos-Modells, das Videospiele generieren kann. Auf OpenRouter als 'Claude Fable Latest' und 'Claude Fable 5' gelistet, aber nicht explizit als 'free' markiert. Möglicherweise mit eingeschränktem Free-Tier.

TechCrunch·
Quelle ↗

Cohere Coding Model (unreleased)

Cohere gibt Early Access zu einem neuen, unveröffentlichten Coding-Modell auf r/LocalLLaMA bekannt. Das Modell ist ein komplett neues Pre-Trained-Modell, spezialisiert auf Code-Generierung.

r/LocalLLaMA·
Quelle ↗

Cohere BLS-Mini-Code-1.0

Cohere's 30B MoE Coding-Modell mit 3B aktiven Parametern. Early Access auf HuggingFace veröffentlicht. Läuft lokal mit moderatem VRAM. 1.701 Downloads im letzten Monat.

Reddit r/LocalLLaMA·
Quelle ↗

MiniMax M3 Open Weights

MiniMax M3 wurde am 1. Juni 2026 veröffentlicht. Das Unternehmen hat angekündigt, dass technischer Report und Modellgewichte innerhalb von ~10 Tagen nach Launch veröffentlicht werden. Die Veröffentlichung der Open Weights steht in den nächsten Tagen bevor.

Kilo Code·
Quelle ↗

Gemma 4 QAT für mobile Geräte

Google hat Gemma 4 QAT (Quantization-Aware Training) Modelle veröffentlicht, die speziell für mobile Geräte und Laptops optimiert sind. Verfügbar in 2B, 4B, 12B und 26B Varianten. Reduziert Speicherbedarf bei gleichbleibender Genauigkeit.

Google The Keyword·
Quelle ↗

KoHRM-Text-1.4B FullSFT Terminal ToolBench

LLM-OS-Models hat KoHRM-Text-1.4B mit FullSFT auf LFM25-Terminal-ToolBench trainiert. Koreanisch-Englisch HRM-Modell für Terminal/Tool-Nutzung, 1.4B Parameter.

HuggingFace·
Quelle ↗

Gemma 4 weitere Varianten

Weitere Gemma 4 Modelle werden erwartet, moeglicherweise ein Gegenstueck zu Qwen 27B (dichtes Modell).

r/LocalLLaMA·
Quelle ↗

Holo3.1 VLM Familie

Neue Vision-Language-Modelle fuer Computer-Use-Agenten: Holo3.1-0.8B, Holo3.1-4B, Holo3.1-9B.

r/LocalLLaMA·
Quelle ↗

MiniMax M3

MiniMax M3 wurde Ende Mai / Anfang Juni veroeffentlicht. Open-Weight Coding-Modell, konkurriert mit Qwen3-Coder-Next.

OpenRouter / Kilo Code·
Quelle ↗

ChartNet

ChartNet ist ein neues KI-Modell, das Chart-Daten lesen und interpretieren kann. Es ermoeglicht kleineren Modellen, kommerzielle Rivalen bei Chart-basierten Aufgaben zu uebertreffen.

TechXplore·
Quelle ↗

Microsoft MAI-Thinking-1 Details

Weitere Details zu Microsofts MAI-Modellfamilie von der Build 2026. MAI-Thinking-1 ist speziell fuer komplexe Reasoning-Aufgaben optimiert und koennte bald als kostenloser API-Tier verfuegbar sein.

Latent Space·
Quelle ↗

Microsoft MAI-Familie

Microsoft hat auf der Build 2026 sieben neue MAI-Modelle angekündigt, darunter MAI-Thinking-1, MAI-Image-2.5 und MAI-Transcribe-1.5. Drei davon sind bereits kostenlos auf OpenRouter verfügbar.

Microsoft AI·
Quelle ↗

NVIDIA Cosmos 3 & Nemotron 3 Ultra

NVIDIA hat auf der Computex Cosmos 3 (World Foundation Model) und Nemotron 3 Ultra angekuendigt. Details zu freien API-Tiers stehen noch aus.

Latent Space·
Quelle ↗

OpenAI GPT-5.5 Short Context

OpenAI hat GPT-5.5 Short Context mit günstigeren Preisen ($12.50/M Tokens input) auf Azure veröffentlicht.

PricePerToken·
Quelle ↗

GPT-5.5 frei zugänglich

Spekulationen dass OpenAI GPT-5.5 für alle ChatGPT-Nutzer freigeben könnte.

Reddit r/LocalLLaMA·
Quelle ↗

Qwen 3.7 Open Weights

Die Community wartet auf die Open-Weight-Veröffentlichung von Qwen 3.7.

r/LocalLLaMA·
Quelle ↗

OpenAI Phi-5 (Gerücht)

Gerüchte über ein neues Open-Weight-Modell von OpenAI, das als 'Phi-5' bezeichnet wird. Wurde in r/LocalLLaMA diskutiert, aber keine offizielle Bestätigung.

r/LocalLLaMA·
Quelle ↗

DeepSeek Reasonix

DeepSeek Coding-Agent mit V4 Flash und optimiertem KV-Caching.

DeepSeek·
Quelle ↗

OpenAI Phi-5 Gerücht

Gerüchte über neues OpenAI-Open-Weight-Modell 'Phi-5' in r/LocalLLaMA.

r/LocalLLaMA·
Quelle ↗

SubQ 1M-Preview

Subquadratic hat mit SubQ 1M-Preview das erste kommerzielle nicht-Transformer-Modell vorgestellt. Mit einem nativen Kontextfenster von 12 Mio. Token und bis zu 52× schnellerer Attention bei großen Kontexten könnte es eine Architektur-Revolution einläuten. Derzeit nur als API-Preview verfügbar.

devFlokers·
Quelle ↗

GPT-5.5 Instant

OpenAI hat GPT-5.5 Instant veröffentlicht, mit 50% weniger Halluzinationen im kostenlosen Tarif. Eine günstigere, schnellere Variante von GPT-5.5 für den freien Zugang.

devFlokers·
Quelle ↗

Qwen 3.7 open-weight release

Qwen3.7 Max is on OpenRouter but community is waiting for open-weight release. Qwen team seen as less enthusiastic about full open-weight releases recently.

Reddit r/LocalLLaMA·
Quelle ↗

BitNet new model releases

New BitNet (1-bit) models released that can run on CPU without special quantization libraries.

Reddit r/LocalLLaMA·
Quelle ↗

Meta Avocado

Meta's next-generation LLM 'Avocado' reportedly delayed to May 2026 after internal tests showed it lagging behind competing models from Google, OpenAI, and others.

Instagram / tech rumor·
Quelle ↗

Qwen3.7 open-weight variants

Community speculation about upcoming open-weight releases of Qwen3.7 in smaller sizes (35B A3B and below), following the proprietary Qwen3.7-Max launch.

Reddit r/LocalLLaMA·
Quelle ↗

Qwen 3.7 open-weight variants

Community discussion about upcoming open-weight releases of Qwen 3.7 in smaller sizes following the proprietary Qwen3.7-Max launch. Reddit thread shows ongoing anticipation.

Reddit r/LocalLLaMA·
Quelle ↗