Team im Verein · rechenwerk
Rechenwerk
Was bei uns rechnet, rechnet nachprüfbar bei uns — und wo es das nicht tut, steht der Grund daneben.
- 18 Dienste
- 5 Maschinen
- 42 Texte
Was das Team betreibt
Aus dem Organigramm des Vereins, nicht aus dieser Seite gepflegt.
Dienste
- mana-3d
- mana-comfy-mcp
- mana-evals
- mana-gpu-broker
- mana-image-edits
- mana-image-gen
- mana-llm
- mana-music-gen
- mana-portrait-3d
- mana-research
- mana-splat
- mana-splat-worker
- mana-stems
- mana-stimmen
- mana-stt
- mana-stt-ersatz
- mana-tts
- mana-tts-ersatz
Maschinen
- mana-gpu-box GPU-Box
- mana-node-1 EliteDesk G2-A
- mana-node-2 EliteDesk
- mana-node-3 EliteDesk 800 G3 DM 65W
- mana-server Mac Mini
Was das Team geschrieben hat
Verteilt über 7 Sammlungen — hier zusammengeführt über die Team-Zuordnung, die jedes Stück selbst trägt.
Modelle 15
- ACE-Step Das Modell, mit dem wir Musik erzeugen — und zugleich der Beleg dafür, dass es in der Musik keine belastbare Rangliste für offene Modelle gibt. Wir kö…
- FLUX.2 [klein] 4B Unser Bildgenerator — und die Antwort auf einen Fall, den wir vorher schon einmal dokumentiert haben: ein technisch besseres Modell, das wir wegen sei…
- Gemma 4 12B Unser Standard-Modell für alles, was auf der eigenen GPU laufen soll. Offene Gewichte, läuft via Ollama auf unserer RTX 3090 — kein API-Call, keine Ko…
- HTDemucs v4 Zerlegt ein Musikstück in seine Spuren — Gesang, Schlagzeug, Bass, Rest. Der unspektakulärste Dienst auf unserer Karte und einer der nützlichsten: Ohn…
- Ideogram 4.0 Ein Bildgenerierungs-Modell mit ladbaren Gewichten, das sogar auf unsere eigene GPU passt — und im Text-im-Bild führend ist. Der Haken steht im Lizenz…
- MiniMax H3 Das erste offene Video-Modell, das Bild und Ton in einem Durchgang erzeugt — und das erste, dessen Lizenz uns die Nutzung überhaupt erlaubt, weil die …
- MiniMax Music 3 Das erste offene Musik-Modell, das ein ganzes Lied über fünf Minuten in einem Durchgang zusammenhält — und das erste MiniMax-Modell, das auf unsere Ka…
- MusicGen Das einzige Musikmodell mit offenen Gewichten, das in der öffentlichen Arena überhaupt antritt — auf dem letzten Platz, und unter einer Lizenz, die ko…
- Pixtral 12B Unser lokales Modell, wenn ein Bild eingeschätzt werden soll. Multimodal, Apache-2.0, aus Europa — und self-hostbar auf der eigenen GPU. Erster gemess…
- Qwen-Image-Edit 2511 Das genaueste Werkzeug, das wir für kleine Eingriffe an echten Fotos haben. Es ändert, was man verlangt, und lässt den Rest buchstäblich in Ruhe — bis…
- Qwen2.5 0.5B Klein genug fürs Smartphone. Läuft direkt auf dem Gerät — für leichte Aufgaben wie eine Überschrift vorschlagen, ohne dass je etwas hochgeladen wird. …
- Qwen3-TTS 1.7B Die Stimme, die spricht, wenn eine unserer Apps vorliest. Sie hat sich in zwei blinden Durchgängen gegen neun Mitbewerber durchgesetzt — und sie löst …
- SenseNova U1.5 8B-MoT Ein Modell, das Bilder erzeugt, bearbeitet UND versteht — in einer Architektur, ohne Vision-Encoder und ohne VAE. Es läuft seit dem 2026-08-23 auf uns…
- TRELLIS Aus einem Foto wird ein dreidimensionales Objekt. Läuft bei uns als eigener Dienst auf der Grafikkarte — und war der Anlass für einen unangenehmen Fun…
- Whisper large-v3-turbo Das Modell, das bei uns jede Aufnahme in Text verwandelt — und der seltene Fall, in dem ein US-Konzern etwas unter MIT-Lizenz veröffentlicht hat. Es l…
Messungen 4
- Muster aus der Timeline lesen: hier zahlt sich Frontier aus Die ehrliche Gegenprobe: eine wirklich analytische Aufgabe. Hier brechen die lokalen und günstigen Modelle ein — nur die teuren Frontier-Modelle (GPT-…
- Lernkarten generieren: das lokale Modell genügt Strukturierte Ausgabe ist härter als reiner Text. Das winzige Gerät-Modell reicht hier nicht mehr — aber das lokale 12-Mrd-Modell schon: 0,90 von 1,00…
- Essen vom Foto erfassen: das lokale Modell trifft am besten Wir haben sechs Modelle dasselbe Foto analysieren lassen — vom lokalen Modell auf der eigenen GPU bis zum teuersten Frontier-Modell. Das lokale, in Eu…
- Artikel zusammenfassen: das Gerät-Modell reicht Wir haben 12 Modelle von der Geräte-Klasse bis zum teuersten Frontier gegeneinander gemessen. Ergebnis: das kleine, lokal auf dem Gerät laufende Model…
Recherchen 8
- DeepSeek Harness — der Agenten-Unterbau wird austauschbar Nicht das Sprachmodell, sondern das Programm darum herum entscheidet, was ein KI-Agent kann: Werkzeuge, Dateizugriff, Sitzungen, Subagenten. Diese Sch…
- FLUX 3 — der Hersteller unseres Bildmodells macht oben zu Am 23. Juli 2026 hat Black Forest Labs FLUX 3 angekündigt: Bild, Video, Ton und Roboter-Bewegung aus einem einzigen Modell. Seit dem 4. August ist der…
- Gemma 4 12B auf der eigenen GPU — was es ablösen könnte Googles neues offenes Modell läuft mit 16 GB RAM lokal und ist multimodal. Auf unserer 24-GB-Workstation ist Platz dafür. Wir prüfen: Welche Modelle e…
- MiniMax H3 — offene Video-Gewichte, die unsere Karte nicht satt bekommt Am 31. Juli 2026 hat MiniMax H3 vorgestellt, am 3. August die Gewichte freigegeben: Video mit eigenem Ton, aus einem Modell. Wir haben geprüft, ob das…
- Persönliche KI-Agenten — OpenClaw, Hermes und was davon zu uns passt OpenClaw und Hermes sind Programme, die man auf dem eigenen Rechner laufen lässt und denen man per Chat Aufträge gibt: Dateien lesen, Termine setzen, …
- Alle Maschinen, dieselbe Aufgabe: wer rechnet was? Der Verein betreibt einen Mac mini als Hauptserver, eine Workstation mit RTX 3090 und drei ausgemusterte Büro-PCs. Wir haben drei davon dieselben Aufn…
- Spracherkennung auf einem zehn Jahre alten Büro-PC 59 Messungen auf ausgemusterten Mini-PCs ohne Grafikkarte: elf Verfahren, vier Testkorpora bis zu 80 Minuten Länge. Die Kiste schreibt eine Stunde Sit…
- Sprechende Köpfe auf eigener GPU — fünf Wege, ein Ton Wir haben unseren eigenen gerechneten Erzähler, ein Verfahren von 2023 und drei Fassungen eines Diffusionsmodells von 2026 dieselben 19 Sekunden sprec…
Forschung 8
- Der Riegel davor und der Riegel darin — was authentik uns nicht abnimmt authentik ist der meistgenannte quelloffene Anmeldedienst zum Selbstbetreiben: ein zentraler Ausweisgeber, davor gesetzte Wächter-Container für Softwa…
- Agenten mit eigenem Schlüssel — vier Lehren aus einer offenen Agenten-Werkstatt Ein Zahlungsunternehmen hat im Juli 2026 seine interne Arbeitsumgebung offengelegt: ein selbst betreibbarer Chat-Dienst, in dem KI-Agenten nicht Werkz…
- GNM — Googles parametrisches Kopfmodell, erstmals unter freier Lizenz Google hat im Juli 2026 GNM veröffentlicht — ein statistisches 3D-Modell des menschlichen Kopfes, trainiert auf großen Scan-Datensätzen. Das Besondere…
- Offene Bildmodelle rendern lesbaren Kartentext — lokal statt in der Cloud figgos erzeugte seine Karten-Bilder bisher über Google Gemini in der Cloud. Ein eigener Bake-off über sechs offene Modelle zeigt: Krea2 rendert fehler…
- Ein Schritt je Stück — der fotoechte sprechende Kopf neben unserem gerechneten LeapTalk erzeugt aus einem Porträt und einer Tonspur ein lippensynchrones Video — streamend, unbegrenzt lang, mit einem einzigen Rechenschritt je Vide…
- Vom kahlen Kopf zum Erzähler — zehn Schritte im Browser Wir haben Googles GNM-Kopfmodell zu einem sprechenden Vortragenden ausgebaut, der einen Foliensatz erzählt und dabei in der Ecke des Bildschirms sitzt…
- Noten statt Prompt — ein Modell singt die geschriebene Melodie VocalRender nimmt als Eingabe, was auch eine Komponistin schreibt: Silben, Tonhöhen, Notenwerte, Tempo. Apache-2.0, self-hostbar, 2,3 Milliarden Param…
- Zwei Köpfe und ein Prüfblick — Lehren aus einem Bewerbungs-Werkzeug Ein Geophysiker hat sich ein quelloffenes Werkzeug gebaut, das seine Bewerbungen schreibt. Der Zweck interessiert uns nicht. Interessant ist, wie stre…
Thesen 4
- Frontier-nahe KI passt jetzt auf einen Laptop Google DeepMinds Gemma 4 12B läuft mit 16 GB RAM lokal — multimodal, unter Apache 2.0, und schlägt in Mathe und Coding das eigene 27-Mrd- Modell von v…
- KI löst inzwischen die Mehrheit echter Programmier-Aufgaben SWE-bench — echte GitHub-Issues fixen — sprang in einem Jahr von 4,4 % auf 71,7 %. Der Autonomie-Horizont verdoppelt sich etwa alle sieben Monate. Die…
- Gestrige Spitzenfähigkeit wird Jahr für Jahr ~10× billiger Für ein einmal erreichtes Leistungsniveau fiel der KI-Preis historisch beispiellos schnell — rund 280-fach in zwei Jahren. Das jeweils beste Modell bl…
- Offene Modelle holen die proprietären fast ein Der Leistungsabstand schrumpfte in einem Jahr von ~8 % auf ~1,7 %, der Zeitverzug von ~1 Jahr auf ~3 Monate. Fähige KI lässt sich damit selbst betreib…
Probleme 2
- KI-Trainingsdaten ohne Konsens — Wäsche im Industriemaßstab Die großen Sprach- und Bildmodelle wurden mit Daten trainiert, die ihren Anbietern weder gehörten noch zur Nutzung freigegeben waren. Bücher, Code, Ku…
- Cloud-Energiehunger als Selbstzweck Hyperscale-Rechenzentren wachsen schneller als Strom-Netze sie versorgen können. Ein erheblicher Teil dieser Last sind nicht „notwendige Berechnungen"…
Lösungen 1
- Eigenbetrieb auf einem Mac Mini Die ganze Vereins-Infrastruktur läuft auf einer überschaubaren Maschine in der Schweiz, nicht in einer Hyperscale-Cloud. Wir können sie sehen, anfasse…
Flächen, Dienste und Maschinen kommen aus docs/arme-aufloesung.json — dem
Organigramm, das in der Markenarchitektur
entschieden wird. Die Texte tragen ihre Team-Zuordnung selbst im Kopf. Beide
Mengen werden gezählt, nicht aufgeschrieben: was hier steht, kann nicht
veralten, ohne dass die Quelle sich ändert.