Modelle · on-device · lokal · EU · Frontier

Welche KI wir einsetzen — und warum genau diese.

Ein Steckbrief pro Modell: wer es baut, unter welcher Lizenz, ob wir es selbst betreiben können, und was wir ehrlich davon halten. Wir bevorzugen, was auf dem Gerät oder auf unserer eigenen GPU läuft — fremde Cloud nur, wo es ein Modell sonst nicht schafft. Welches Modell eine konkrete Aufgabe wirklich gewinnt, messen wir separat unter Messungen; wie das alles zusammenhängt und welche Modalitäten wir bis heute nicht geprüft haben, steht unter Unabhängige KI; die langen Berichte über KI-Entwicklungen stehen unter Recherchen. Was davon gerade auf welcher Maschine läuft — mit Speicher, Tempo und, wo wir es haben, dem Stromverbrauch — steht gleich darunter in der Betriebs-Tafel.

  • 17 Steckbriefe
  • 13 im Einsatz
  • 15 selbst betreibbar
  • 5 Modalitäten

Was auf welcher Maschine läuft

Ein Eintrag je Modell und Maschine — Whisper steht deshalb zweimal da. Was fehlt, bleibt leer: geschätzte Zahlen wären hier schlimmer als gar keine.

Woher eine Zahl kommt
  • gemessen Aus einem eigenen Lauf, mit Datum. Trägt eine Aussage über Leistung.
  • veranschlagt Steht so im Code, weil der GPU-Vermittler ein Budget braucht. Nie an der Karte nachgeprüft — eine Buchungsgröße, kein Messwert.
  • beurteilt Ein Mensch hat hingesehen und entschieden, datiert und abgenommen. Belegt — aber keine Zahl.
  • nicht erhoben Niemand hat es je gemessen.
  • 19 in einem Dienst
  • 5 in der Werkstatt
  • 11 ohne Steckbrief
  • 21 Zahlen gemessen
  • 13 nur veranschlagt
  • 4 beurteilt

Sprache verstehen

Modell Lizenz Wo es läuft GPU belegt Tempo Wortfehler je Stunde Audio
Whisper large-v3-turbo OpenAI · 809 Mio MIT Dienst GPU-Box · RTX 3090 mana-stt 7 000 MB Lease-Budget 142× Echtzeit 06.08.2026, 80-Minuten-Aufnahme 5,4 % 06.08.2026 1,7 Wh 06.08.2026
Whisper large-v3-turbo derselbe Weg auf der CPU MIT Dienst Bestandsrechner · i5-6500T · 35 W mana-stt-ersatz entfällt 3,07× Echtzeit 06.08.2026 6,2 % 06.08.2026 8,8 Wh 06.08.2026

Sprechen

Modell Lizenz Wo es läuft GPU belegt Rechenzeit je Sek. Audio Wortfehler Strom
Qwen3-TTS 1.7B Alibaba · Standardstimme Apache-2.0 Dienst GPU-Box · RTX 3090 mana-tts-qwen 2,60 Stimmen-Blindlauf 5,2 % Rang 3 von 9
Piper Thorsten-Voice · Kerstin und Thorsten CC0 Dienst GPU-Box · RTX 3090 mana-tts 0,18 – 0,20 Stimmen-Blindlauf 4,7 – 5,1 % Rang 1 und 2 von 9
Orpheus-3B Canopy Labs · fünf Stimmen Llama-3.2, nicht OSI Dienst GPU-Box · RTX 3090 mana-tts 8 000 MB Lease-Budget 4,0 – 9,0 Stimmen-Blindlauf 7,3 – 15,3 % Ränge 5 bis 9 von 9
F5-TTS im Dienst verfügbar ungeklärt Dienst GPU-Box · RTX 3090 mana-tts 6 000 MB Lease-Budget

Text und Sehen

Modell Lizenz Wo es läuft GPU belegt Tempo Güte Strom
Pixtral 12B Mistral AI Apache-2.0 Dienst GPU-Box · RTX 3090 mana-llm 12 000 MB Größenklasse 1,00 nutriphi · Essen erkennen
Gemma 3 12B Google · das tatsächlich gemessene Gemma License Dienst GPU-Box · RTX 3090 mana-llm 12 000 MB Größenklasse 0,98 pageta · zusammenfassen
Gemma 4 12B Google · das katalogisierte Gemma License Dienst GPU-Box · RTX 3090 mana-llm 12 000 MB Größenklasse 0,80 nutriphi · nur eine Messung
Gemma 3 4B Google · auf dem Telefon Gemma License Dienst Telefon on-device entfällt 0,93 pageta · zusammenfassen
Qwen2.5 0.5B Alibaba Apache-2.0 Dienst Telefon on-device entfällt
Qwen3-VL 8B Alibaba Apache-2.0 geprüft GPU-Box · RTX 3090 6 000 MB Größenklasse 0,60 nutriphi · 47 % Pflichtprüfungen

Bilder

Modell Lizenz Wo es läuft GPU belegt Tempo Güte Strom
FLUX.2 [klein] 4B Black Forest Labs Apache-2.0 Dienst GPU-Box · RTX 3090 mana-image-gen 13 000 MB Lease-Budget
Krea 2 turbo Krea · fp8 Krea 2 Community License Werkstatt GPU-Box · RTX 3090 ComfyUI
Juggernaut-XL v9 RunDiffusion · SDXL ungeprüft Werkstatt GPU-Box · RTX 3090 ComfyUI
Qwen-Image-Edit 2511 Alibaba · GGUF Q4 Apache-2.0 Werkstatt GPU-Box · RTX 3090 ComfyUI
Chroma1-HD lodestones Apache-2.0 Werkstatt GPU-Box · RTX 3090 ComfyUI
Ideogram 4.0 Ideogram nicht kommerziell geprüft
gpt-image-2 · Gemini 3 Pro Image OpenAI und Google · fremde Rechner proprietär Dienst nicht bei uns mana-image-edits entfällt

Bewegtbild

Modell Lizenz Wo es läuft GPU belegt je 2 Sek. Video Urteil Strom
Wan 2.2 I2V A14B Alibaba · GGUF Q5, zwei Hälften Apache-2.0 Werkstatt GPU-Box · RTX 3090 Videowerkstatt → ComfyUI 9 800 MB während des Laufs, 04.08.2026 132,2 s 04.08.2026, aus /history gewinnt gegen LTXV und Hunyuan Vergleich 28.06.2026, von Till abgenommen
HunyuanVideo I2V 720p Tencent · GGUF Q4 ungeprüft geprüft GPU-Box · liegt geladen da bewegt gut, aber nicht bildtreu Vergleich 28.06.2026
LTX-Video 2B Lightricks · v0.9.5 ungeprüft geprüft GPU-Box · liegt geladen da zerfliesst bei Körperbewegung Vergleich 28.06.2026
MiniMax H3 MiniMax · 33 Mrd CH offen, EU gesperrt geprüft nicht selbst betreibbar entfällt

Musik und Klang

Modell Lizenz Wo es läuft GPU belegt Tempo Urteil Strom
ACE-Step 1.5 ACE Studio · StepFun Apache-2.0 Dienst GPU-Box · RTX 3090 mana-acestep15 9 000 MB Lease-Budget
ACE-Step v1 ACE Studio · StepFun · 3,5 Mrd Apache-2.0 Dienst GPU-Box · RTX 3090 mana-music-gen 10 000 MB Lease-Budget
MiniMax Music 3 MiniMax Namensnennungspflicht geprüft nicht aufgesetzt kein Wechselgrund geprüft 14.08.2026 · 32 kHz gegen 48
MusicGen Meta · 3,3 Mrd CC BY-NC geprüft nicht aufgesetzt
HTDemucs v4 Meta MIT Dienst GPU-Box · RTX 3090 mana-stems 5 000 MB Lease-Budget

Dreidimensionales

Modell Lizenz Wo es läuft GPU belegt je Auftrag Güte Strom
TRELLIS Microsoft Research MIT Dienst GPU-Box · WSL, kein Container mana-3d 16 000 MB an einem echten Lauf, 29.07.2026 5 – 21 min Erfahrungswert aus dem Betrieb
BiRefNet-portrait Freistellen MIT Dienst GPU-Box · über ComfyUI mana-portrait-3d 3 500 MB Lease-Budget
DepthAnything V2 vits Tiefenkarte Apache-2.0 Dienst GPU-Box · über ComfyUI mana-portrait-3d 3 500 MB Lease-Budget

Stand 2026-09-07. Jede Spalte hat genau eine Quelle — Modell und Lizenz aus den Steckbriefen, Dienst und Adresse aus dem Port-Register, Maschine aus dem Organigramm des Arms rechenwerk, die GPU-Zahlen aus den Lease-Aufrufen der Dienste selbst, die Stimmen-Werte aus dem Blindlauf und die Güte der Sprachmodelle aus den Messungen. Ein Modell ohne Steckbrief ist kein Versehen: es läuft, wurde aber nie beschrieben. Wer betreibt das alles: das Team Rechenwerk.

Bild und Video

Bilder erzeugen. Hier ist die Lizenz häufiger der Blocker als die Hardware.

Musik und Klang

Die Modalität mit der dünnsten offenen Auswahl — und ohne belastbaren öffentlichen Vergleich.

Wir verfolgen mehr Modelle, als hier stehen — die ungetestete Vorstufe pflegen wir intern. Öffentlich wird ein Modell erst, wenn wir es geprüft haben. Jede Einschätzung steht mit Quellen daneben.