Welche KI wir einsetzen — und warum genau diese.
Ein Steckbrief pro Modell: wer es baut, unter welcher Lizenz, ob wir es selbst betreiben können, und was wir ehrlich davon halten. Wir bevorzugen, was auf dem Gerät oder auf unserer eigenen GPU läuft — fremde Cloud nur, wo es ein Modell sonst nicht schafft. Welches Modell eine konkrete Aufgabe wirklich gewinnt, messen wir separat unter Messungen; wie das alles zusammenhängt und welche Modalitäten wir bis heute nicht geprüft haben, steht unter Unabhängige KI; die langen Berichte über KI-Entwicklungen stehen unter Recherchen. Was davon gerade auf welcher Maschine läuft — mit Speicher, Tempo und, wo wir es haben, dem Stromverbrauch — steht gleich darunter in der Betriebs-Tafel.
- 17 Steckbriefe
- 13 im Einsatz
- 15 selbst betreibbar
- 5 Modalitäten
Was auf welcher Maschine läuft
Ein Eintrag je Modell und Maschine — Whisper steht deshalb zweimal da. Was fehlt, bleibt leer: geschätzte Zahlen wären hier schlimmer als gar keine.
- gemessen Aus einem eigenen Lauf, mit Datum. Trägt eine Aussage über Leistung.
- veranschlagt Steht so im Code, weil der GPU-Vermittler ein Budget braucht. Nie an der Karte nachgeprüft — eine Buchungsgröße, kein Messwert.
- beurteilt Ein Mensch hat hingesehen und entschieden, datiert und abgenommen. Belegt — aber keine Zahl.
- nicht erhoben Niemand hat es je gemessen.
- 19 in einem Dienst
- 5 in der Werkstatt
- 11 ohne Steckbrief
- 21 Zahlen gemessen
- 13 nur veranschlagt
- 4 beurteilt
Sprache verstehen
| Modell | Lizenz | Wo es läuft | GPU belegt | Tempo | Wortfehler | je Stunde Audio |
|---|---|---|---|---|---|---|
| Whisper large-v3-turbo OpenAI · 809 Mio | MIT | Dienst GPU-Box · RTX 3090 mana-stt | 7 000 MB Lease-Budget | 142× Echtzeit 06.08.2026, 80-Minuten-Aufnahme | 5,4 % 06.08.2026 | 1,7 Wh 06.08.2026 |
| Whisper large-v3-turbo derselbe Weg auf der CPU | MIT | Dienst Bestandsrechner · i5-6500T · 35 W mana-stt-ersatz | entfällt | 3,07× Echtzeit 06.08.2026 | 6,2 % 06.08.2026 | 8,8 Wh 06.08.2026 |
Sprechen
| Modell | Lizenz | Wo es läuft | GPU belegt | Rechenzeit je Sek. Audio | Wortfehler | Strom |
|---|---|---|---|---|---|---|
| Qwen3-TTS 1.7B Alibaba · Standardstimme | Apache-2.0 | Dienst GPU-Box · RTX 3090 mana-tts-qwen | — | 2,60 Stimmen-Blindlauf | 5,2 % Rang 3 von 9 | — |
| Piper Thorsten-Voice · Kerstin und Thorsten | CC0 | Dienst GPU-Box · RTX 3090 mana-tts | — | 0,18 – 0,20 Stimmen-Blindlauf | 4,7 – 5,1 % Rang 1 und 2 von 9 | — |
| Orpheus-3B Canopy Labs · fünf Stimmen | Llama-3.2, nicht OSI | Dienst GPU-Box · RTX 3090 mana-tts | 8 000 MB Lease-Budget | 4,0 – 9,0 Stimmen-Blindlauf | 7,3 – 15,3 % Ränge 5 bis 9 von 9 | — |
| F5-TTS im Dienst verfügbar | ungeklärt | Dienst GPU-Box · RTX 3090 mana-tts | 6 000 MB Lease-Budget | — | — | — |
Text und Sehen
| Modell | Lizenz | Wo es läuft | GPU belegt | Tempo | Güte | Strom |
|---|---|---|---|---|---|---|
| Pixtral 12B Mistral AI | Apache-2.0 | Dienst GPU-Box · RTX 3090 mana-llm | 12 000 MB Größenklasse | — | 1,00 nutriphi · Essen erkennen | — |
| Gemma 3 12B Google · das tatsächlich gemessene | Gemma License | Dienst GPU-Box · RTX 3090 mana-llm | 12 000 MB Größenklasse | — | 0,98 pageta · zusammenfassen | — |
| Gemma 4 12B Google · das katalogisierte | Gemma License | Dienst GPU-Box · RTX 3090 mana-llm | 12 000 MB Größenklasse | — | 0,80 nutriphi · nur eine Messung | — |
| Gemma 3 4B Google · auf dem Telefon | Gemma License | Dienst Telefon on-device | entfällt | — | 0,93 pageta · zusammenfassen | — |
| Qwen2.5 0.5B Alibaba | Apache-2.0 | Dienst Telefon on-device | entfällt | — | — | — |
| Qwen3-VL 8B Alibaba | Apache-2.0 | geprüft GPU-Box · RTX 3090 | 6 000 MB Größenklasse | — | 0,60 nutriphi · 47 % Pflichtprüfungen | — |
Bilder
| Modell | Lizenz | Wo es läuft | GPU belegt | Tempo | Güte | Strom |
|---|---|---|---|---|---|---|
| FLUX.2 [klein] 4B Black Forest Labs | Apache-2.0 | Dienst GPU-Box · RTX 3090 mana-image-gen | 13 000 MB Lease-Budget | — | — | — |
| Krea 2 turbo Krea · fp8 | Krea 2 Community License | Werkstatt GPU-Box · RTX 3090 ComfyUI | — | — | — | — |
| Juggernaut-XL v9 RunDiffusion · SDXL | ungeprüft | Werkstatt GPU-Box · RTX 3090 ComfyUI | — | — | — | — |
| Qwen-Image-Edit 2511 Alibaba · GGUF Q4 | Apache-2.0 | Werkstatt GPU-Box · RTX 3090 ComfyUI | — | — | — | — |
| Chroma1-HD lodestones | Apache-2.0 | Werkstatt GPU-Box · RTX 3090 ComfyUI | — | — | — | — |
| Ideogram 4.0 Ideogram | nicht kommerziell | geprüft — | — | — | — | — |
| gpt-image-2 · Gemini 3 Pro Image OpenAI und Google · fremde Rechner | proprietär | Dienst nicht bei uns mana-image-edits | entfällt | — | — | — |
Bewegtbild
| Modell | Lizenz | Wo es läuft | GPU belegt | je 2 Sek. Video | Urteil | Strom |
|---|---|---|---|---|---|---|
| Wan 2.2 I2V A14B Alibaba · GGUF Q5, zwei Hälften | Apache-2.0 | Werkstatt GPU-Box · RTX 3090 Videowerkstatt → ComfyUI | 9 800 MB während des Laufs, 04.08.2026 | 132,2 s 04.08.2026, aus /history | gewinnt gegen LTXV und Hunyuan Vergleich 28.06.2026, von Till abgenommen | — |
| HunyuanVideo I2V 720p Tencent · GGUF Q4 | ungeprüft | geprüft GPU-Box · liegt geladen da | — | — | bewegt gut, aber nicht bildtreu Vergleich 28.06.2026 | — |
| LTX-Video 2B Lightricks · v0.9.5 | ungeprüft | geprüft GPU-Box · liegt geladen da | — | — | zerfliesst bei Körperbewegung Vergleich 28.06.2026 | — |
| MiniMax H3 MiniMax · 33 Mrd | CH offen, EU gesperrt | geprüft nicht selbst betreibbar | entfällt | — | — | — |
Musik und Klang
| Modell | Lizenz | Wo es läuft | GPU belegt | Tempo | Urteil | Strom |
|---|---|---|---|---|---|---|
| ACE-Step 1.5 ACE Studio · StepFun | Apache-2.0 | Dienst GPU-Box · RTX 3090 mana-acestep15 | 9 000 MB Lease-Budget | — | — | — |
| ACE-Step v1 ACE Studio · StepFun · 3,5 Mrd | Apache-2.0 | Dienst GPU-Box · RTX 3090 mana-music-gen | 10 000 MB Lease-Budget | — | — | — |
| MiniMax Music 3 MiniMax | Namensnennungspflicht | geprüft nicht aufgesetzt | — | — | kein Wechselgrund geprüft 14.08.2026 · 32 kHz gegen 48 | — |
| MusicGen Meta · 3,3 Mrd | CC BY-NC | geprüft nicht aufgesetzt | — | — | — | — |
| HTDemucs v4 Meta | MIT | Dienst GPU-Box · RTX 3090 mana-stems | 5 000 MB Lease-Budget | — | — | — |
Dreidimensionales
| Modell | Lizenz | Wo es läuft | GPU belegt | je Auftrag | Güte | Strom |
|---|---|---|---|---|---|---|
| TRELLIS Microsoft Research | MIT | Dienst GPU-Box · WSL, kein Container mana-3d | 16 000 MB an einem echten Lauf, 29.07.2026 | 5 – 21 min Erfahrungswert aus dem Betrieb | — | — |
| BiRefNet-portrait Freistellen | MIT | Dienst GPU-Box · über ComfyUI mana-portrait-3d | 3 500 MB Lease-Budget | — | — | — |
| DepthAnything V2 vits Tiefenkarte | Apache-2.0 | Dienst GPU-Box · über ComfyUI mana-portrait-3d | 3 500 MB Lease-Budget | — | — | — |
Stand 2026-09-07. Jede Spalte hat genau eine Quelle — Modell und
Lizenz aus den Steckbriefen, Dienst und Adresse aus dem Port-Register, Maschine
aus dem Organigramm des Arms rechenwerk, die GPU-Zahlen aus den
Lease-Aufrufen der Dienste selbst, die Stimmen-Werte aus dem Blindlauf und die
Güte der Sprachmodelle aus den Messungen. Ein Modell
ohne Steckbrief ist kein Versehen: es läuft, wurde aber nie beschrieben.
Wer betreibt das alles: das Team Rechenwerk.
Sprachmodelle
Text verstehen und schreiben — die Modelle hinter Zusammenfassungen, Vorschlägen und Bilderkennung.
-
lokal offene Gewichte im EinsatzGemma 4 12BUnser Standard-Modell für alles, was auf der eigenen GPU laufen soll. Offene Gewichte, läuft via Ollama auf unserer RTX 3090 — kein API-Call, keine Kosten je Aufruf, nichts verlässt das Haus.Steckbrief →
-
on-device offene Gewichte im EinsatzQwen2.5 0.5BKlein genug fürs Smartphone. Läuft direkt auf dem Gerät — für leichte Aufgaben wie eine Überschrift vorschlagen, ohne dass je etwas hochgeladen wird. Apache-2.0 und frei verfügbar, also ohne Hürde.Steckbrief →
-
lokal offene Gewichte im EinsatzPixtral 12BUnser lokales Modell, wenn ein Bild eingeschätzt werden soll. Multimodal, Apache-2.0, aus Europa — und self-hostbar auf der eigenen GPU. Erster gemessen-gepinnter Eintrag in unserem Operations-Routing.Steckbrief →
-
China offene Gewichte nicht im EinsatzMiniMax H3Das erste offene Video-Modell, das Bild und Ton in einem Durchgang erzeugt — und das erste, dessen Lizenz uns die Nutzung überhaupt erlaubt, weil die Schweiz nicht auf der Sperrliste steht. Auf unsere Karte passt es trotzdem nicht: Nicht der Grafikspeicher ist die Wand, sondern der Arbeitsspeicher daneben.Steckbrief →
Sprache hören und sprechen
Aufnahmen verschriftlichen, Texte vorlesen. Beides läuft vollständig auf eigener Hardware.
-
lokal offene Gewichte im EinsatzWhisper large-v3-turboDas Modell, das bei uns jede Aufnahme in Text verwandelt — und der seltene Fall, in dem ein US-Konzern etwas unter MIT-Lizenz veröffentlicht hat. Es läuft auf allem, von der Grafikkarte bis zum ausgemusterten Büro-PC.Steckbrief →
-
lokal offene Gewichte im EinsatzQwen3-TTS 1.7BDie Stimme, die spricht, wenn eine unserer Apps vorliest. Sie hat sich in zwei blinden Durchgängen gegen neun Mitbewerber durchgesetzt — und sie löst nebenbei ein Problem, das keine Messung sichtbar macht: Sie braucht keinen menschlichen Stimmspender.Steckbrief →
Bild und Video
Bilder erzeugen. Hier ist die Lizenz häufiger der Blocker als die Hardware.
-
lokal offene Gewichte im EinsatzFLUX.2 [klein] 4BUnser Bildgenerator — und die Antwort auf einen Fall, den wir vorher schon einmal dokumentiert haben: ein technisch besseres Modell, das wir wegen seiner Lizenz nicht anfassen durften. Dieses hier dürfen wir.Steckbrief →
-
lokal offene Gewichte im EinsatzKrea 2Das Bildmodell unserer Wahl. Es rendert lesbaren Text im Bild — die Aufgabe, an der offene Modelle klassisch scheitern — und läuft auf der eigenen Karte. Die Lizenz ist keine Standardlizenz, erlaubt uns aber ausdrücklich die kommerzielle Nutzung.Steckbrief →
-
lokal offene Gewichte im EinsatzChroma1-HDEin vollständig Apache-2.0 lizenziertes Bildmodell auf der eigenen Karte. Es steht im Katalog von canvaslit und ist unsere Rückfallebene für alles, was ohne jede Lizenzauflage entstehen muss.Steckbrief →
-
lokal offene Gewichte nicht im EinsatzIdeogram 4.0Ein Bildgenerierungs-Modell mit ladbaren Gewichten, das sogar auf unsere eigene GPU passt — und im Text-im-Bild führend ist. Der Haken steht im Lizenznamen: „Non-Commercial". Für eine Vereins-App ist das ein harter Blocker. Wir haben es geprüft, damit klar ist, warum nicht.Steckbrief →
-
lokal offene Gewichte im EinsatzSenseNova U1.5 8B-MoTEin Modell, das Bilder erzeugt, bearbeitet UND versteht — in einer Architektur, ohne Vision-Encoder und ohne VAE. Es läuft seit dem 2026-08-23 auf unserer eigenen Karte, unter echtem Apache-2.0, und es setzt deutsche Schlagzeilen fehlerfrei, obwohl die Modellkarte nur Englisch und Chinesisch verspricht. Kleine Schrift kann es nicht.Steckbrief →
-
lokal offene Gewichte im EinsatzQwen-Image-Edit 2511Das genaueste Werkzeug, das wir für kleine Eingriffe an echten Fotos haben. Es ändert, was man verlangt, und lässt den Rest buchstäblich in Ruhe — bis hin zu den Schattenwürfen auf den Dielen. Dafür kann es keine Schrift, es ist langsam, und ohne Vorlage geht gar nichts.Steckbrief →
Musik und Klang
Die Modalität mit der dünnsten offenen Auswahl — und ohne belastbaren öffentlichen Vergleich.
-
lokal offene Gewichte im EinsatzACE-StepDas Modell, mit dem wir Musik erzeugen — und zugleich der Beleg dafür, dass es in der Musik keine belastbare Rangliste für offene Modelle gibt. Wir können sagen, dass es läuft. Wir können nicht sagen, wo es steht.Steckbrief →
-
lokal offene Gewichte nicht im EinsatzMusicGenDas einzige Musikmodell mit offenen Gewichten, das in der öffentlichen Arena überhaupt antritt — auf dem letzten Platz, und unter einer Lizenz, die kommerzielle Nutzung ausschließt. Wir setzen es nicht ein. Es steht hier, weil es die Lage in dieser Modalität in einem Satz erklärt.Steckbrief →
-
lokal offene Gewichte im EinsatzHTDemucs v4Zerlegt ein Musikstück in seine Spuren — Gesang, Schlagzeug, Bass, Rest. Der unspektakulärste Dienst auf unserer Karte und einer der nützlichsten: Ohne ihn gäbe es kein Karaoke.Steckbrief →
-
China offene Gewichte nicht im EinsatzMiniMax Music 3Das erste offene Musik-Modell, das ein ganzes Lied über fünf Minuten in einem Durchgang zusammenhält — und das erste MiniMax-Modell, das auf unsere Karte passt. Am 14.08. selbst nachgemessen: besser als seine eigenen Angaben, aber es verlangt die ganze Karte und einen Schalter, der neun Zehntel seines Tempos kostet.Steckbrief →
Dreidimensionales
Aus einem Foto ein Objekt, das sich drehen lässt.
Wir verfolgen mehr Modelle, als hier stehen — die ungetestete Vorstufe pflegen wir intern. Öffentlich wird ein Modell erst, wenn wir es geprüft haben. Jede Einschätzung steht mit Quellen daneben.