Gemma 4 12B
Google · Gemma License
Unser Standard-Modell für alles, was auf der eigenen GPU laufen soll. Offene Gewichte, läuft via Ollama auf unserer RTX 3090 — kein API-Call, keine Kosten je Aufruf, nichts verlässt das Haus.
- Anbieter
- Tier
- lokal (eigene GPU)
- Lizenz
- Gemma License
- Gewichte
- offen (self-hostbar)
- Selbst betrieben
- ja
- Parameter
- 12 Mrd
- Modalitäten
- Text
- Aufgabe
- Langtext
Unsere Sicht
Einschätzung
- Gemma 4 12B ist aktuell das Default-Lokalmodell in mana-llm. Es ist der Beleg für unsere These „Frontier-nahe Qualität passt heute auf eigene Hardware" — gut genug für die meisten Text-Aufgaben, ohne eine fremde Cloud zu brauchen.
- Es ist ein Thinking-Modell: Es erzeugt internen Reasoning-Overhead. Bei sehr eng gesetztem Token-Limit kann die eigentliche Antwort leer bleiben — ein Detail, das man beim Integrieren kennen muss.
Stärken
- Offene Gewichte, vollständig self-hostbar.
- Läuft auf einer einzelnen RTX 3090.
- Keine Kosten und kein Datenabfluss pro Aufruf.
Grenzen
- Gemma License ist offen, aber nicht so permissiv wie Apache-2.0.
- Thinking-Overhead kostet Token und Latenz.
Im Verein
Wo wir es einsetzen
- mana-llm — Default-Modell für lokale Text-Operationen.
Notizen
Gemma 4 12B wurde unser lokales Default-Modell, nachdem Ollama 0.30.6 einen Crash der Vorversion behob. gemma3:12b bleibt als Fallback-Netz erhalten.
Die ausführliche Recherche zur Frage, ob ein Modell dieser Klasse auf unserer eigenen GPU wirklich trägt, steht unter Recherchen.
Belegt durch
Womit das zusammenhängt
Modelle
Weitere Steckbriefe
-
lokal (eigene GPU)Whisper large-v3-turbo
-
lokal (eigene GPU)Qwen3-TTS 1.7B
-
lokal (eigene GPU)FLUX.2 [klein] 4B
-
lokal (eigene GPU)Krea 2
-
lokal (eigene GPU)ACE-Step
-
lokal (eigene GPU)Chroma1-HD
-
lokal (eigene GPU)MusicGen
-
on-deviceQwen2.5 0.5B
-
lokal (eigene GPU)TRELLIS
-
lokal (eigene GPU)HTDemucs v4
-
lokal (eigene GPU)Pixtral 12B
-
lokal (eigene GPU)Ideogram 4.0
-
lokal (eigene GPU)SenseNova U1.5 8B-MoT
-
lokal (eigene GPU)Qwen-Image-Edit 2511
-
ChinaMiniMax H3
-
ChinaMiniMax Music 3
Ein Steckbrief sagt, was ein Modell ist. Welches Modell eine konkrete Aufgabe gewinnt, entscheiden wir nicht aus dem Bauch, sondern messen es — Qualität gegen Kosten, pro Operation.