Was hier rechnet
Fünf Rechner, achtzehn eigene Dienste, dreizehn Modelle mit offenen Gewichten — und zwei Ausfälle an einem einzigen Tag, beide selbst verschuldet. Der erste Bericht des Arms, der kein Publikum hat.
- 5
- Maschinen, alle im selben Raum
- 18
- eigene Dienste
- 13
- Modelle im offenen Katalog
- 2
- Ausfälle an einem Tag, beide selbst verschuldet
Beschreibt den Stand am 18. August 2026 · veröffentlicht am 8. September 2026
Der Arm rechenwerk ist der einzige des Hauses ohne Publikum. Er hat keine
App, keine Landing und keine Nutzerinnen — er hat fünf Rechner und achtzehn
selbst gebaute Dienste, und alles andere steht auf ihnen. Ein Release heisst
hier deshalb nicht Ankündigung, sondern Rechenschaft: was steht da, was tut es,
was hat es getan, und was hat nicht funktioniert.
Dieser Bericht ist der erste. Er beschreibt den Stand am 18. August 2026 — dem Tag, an dem die ersten drei Flächen des Hauses released wurden.
1 · Das Blech
Fünf Maschinen, alle im selben Raum, alle im Eigentum des Hauses. Keine Cloud für den Betrieb, keine Miete pro Monat, keine Rechnung pro Aufruf.
| Maschine | Was drin ist | Wofür |
|---|---|---|
| GPU-Box | Ryzen 9 5950X · 16 Kerne · 64 GB · RTX 3090 mit 24 GB VRAM · Windows 11 + WSL2 | die Rechenstelle: Sprache, Bild, Ton, 3D |
| Mac Mini | M4 · 10 Kerne · 16 GB · 256 GB intern + 4 TB USB-SSD | trägt die Plattformdienste, alle Landings und alle Apps |
| G2-A (node-1) | HP EliteDesk 800 G2 · i5-6500T · 8 GB · Debian 13 | Gegen-Wächter über den Mini · zweiter Metrik-Pfad · Android-Builds |
| G2-B (node-2) | HP EliteDesk 800 G2 · 8 GB · Debian 13 | Überwachung · CPU-Ausweich für Sprache · ESP32-Werkbank |
| G3 (node-3) | HP EliteDesk 800 G3 · i5-7500 · 8 GB · Debian 13 | Agentenlabor (fremder Code) · Messreihen |
Drei der fünf sind gebrauchte Büro-Kleinrechner. Das ist kein Sparzwang, sondern die Bauart: was 35 Watt zieht und im Regal steht, darf ausfallen, und der zweite Metrik-Pfad auf node-1 existiert genau dafür.
🔴 Eine Grenze, die heute weh tut: node-1 bis node-3 haben je 8 GB. Für das Agentenlabor reicht das nicht; das steht so im Bestand und ist nicht weggeplant.
2 · Was darauf läuft — achtzehn eigene Dienste
Alle selbst gebaut, alle im eigenen Netz, keiner als fremder SaaS eingekauft:
- Sprache —
mana-llm(Textmodelle),mana-sttundmana-tts(Sprache zu Text und zurück), dazumana-stt-ersatz/-tts-ersatzals CPU-Ausweich auf node-2, wenn die Box aus ist - Bild und 3D —
mana-image-gen,mana-image-edits,mana-portrait-3d,mana-splatundmana-splat-worker,mana-mesh,mana-comfy-mcp - Ton —
mana-music-gen,mana-stems(Spuren trennen),mana-stimmen - Betrieb und Messung —
mana-gpu-broker(verteilt die Arbeit auf die Box),mana-evals(misst Modelle gegeneinander),mana-research
Warum das zählt: jede dieser Fähigkeiten wäre als Zukauf ein Betrag pro Aufruf und ein Vertrag mit einem fremden Rechenzentrum. Hier ist sie eine Maschine, die ohnehin steht. Der Preis dafür ist nicht null — er ist Strom, Wartung und die Ausfälle unten.
3 · Wie damit Welle 1 entstanden ist
Die ersten drei Flächen — seepuls, pipfold, kartomo — sind nicht auf
fremder Infrastruktur gebaut worden:
- Gebaut: die Godot-Fassung von pipfold wird auf dem Mac Mini exportiert
und ausgeliefert, die Android-Pakete baut node-1. Der eigene Paket-Server
(
fdroid.mana.how) verteilt sie — ohne fremden Store, ohne Review, ohne Gebühr. - Betrieben: alle drei laufen als Container auf dem Mac Mini, hinter dem eigenen Tunnel. 186 Container zum Zeitpunkt dieses Berichts.
- Gemessen: die Reichweite misst
umami.mana.how— auf eigenen Servern, ohne fremden Zähler. Was die Suchmaschinen sehen, misstmana-seo. - Beworben: die Bilder der Landings entstehen auf der GPU-Box, die
Redaktion für die Kanäle (
redaktion.mana.how) ist ein eigener Dienst, und die Beiträge liegen als Textdateien in git statt in einem Planungswerkzeug.
4 · Welche Modelle wir fahren und prüfen
Dreizehn Modelle stehen im offenen Katalog (mana.how/modelle) — alle mit
offenen Gewichten, die meisten lokal auf der 3090:
| Wofür | Modell | Grösse |
|---|---|---|
| Text, Standard lokal | Gemma 4 12B (Google) | 12 Mrd |
| Text, sehr klein / auf dem Gerät | Qwen2.5 0.5B (Alibaba) | 0,5 Mrd |
| Bild verstehen | Pixtral 12B (Mistral) | 12 Mrd |
| Bild erzeugen | FLUX.2 Klein (Black Forest Labs) · Ideogram 4 | 4 / 9,3 Mrd |
| Sprache zu Text | Whisper large-v3-turbo (OpenAI, offene Gewichte) | 809 Mio |
| Text zu Sprache | Qwen3-TTS (Alibaba) | 1,7 Mrd |
| Musik | ACE-Step · MusicGen (Meta) · MiniMax Music 3 | 3,5 / 3,3 / 11 Mrd |
| Spuren trennen | HTDemucs (Meta) | — |
| 3D aus Bild | TRELLIS (Microsoft Research) | — |
| Video / Figuren | MiniMax H3 | 33 Mrd |
Was daraus in Apps wandert: die Sprachmodelle stecken bereits hinter
mana-llm und damit hinter jeder App, die Text versteht; Whisper und Qwen3-TTS
tragen die Hör- und Sprech-Funktionen; TRELLIS und die Bildmodelle sind die
Rechenseite von rundum, comicello und lumetour.
🛑 Ein Modell im Katalog ist kein Versprechen an eine App. Zwei der dreizehn laufen in China gehostet und sind damit ausdrücklich nicht für Wohnraum-Daten zugelassen; welches Modell eine App benutzen darf, entscheidet die Weiche, nicht der Katalog.
5 · Was nicht funktioniert hat
Ein Transparenzbericht, der nur Ausstattung aufzählt, ist eine Broschüre. Ausgerechnet am Tag dieses Berichts gab es zwei Ausfälle, beide selbst verschuldet:
- Nachts, rund zehn Stunden: nicht die Maschine fiel aus, sondern der eigene Wächter legte eine gesunde VM um — eine einzelne langsame Probe reichte. Danach schwieg er neun Stunden lang mit derselben Logzeile. Gemeldet hat ihn niemand, weil sein Meldeweg auf der Flotte lag, die gerade unten war.
- Nachmittags, 42 Minuten: dieselbe Klasse, nach dem Fix. Der harte Neustart des Wächters verschlechterte die Lage: vorher lief die VM und nur die Weiterleitung fehlte, danach war sie unten und kam dreimal nicht hoch.
Beides ist repariert, das zweite noch nicht in der Wurzel. Der Satz, der bleibt: ein Automat, der heilen soll, kann schaden — und ein Alarm, der über die Anlage läuft, die er bewacht, ist keiner.
Offene Punkte
- Strom und echte Kosten pro Monat sind nicht gemessen. Solange das so ist, ist „günstiger als Cloud“ eine Behauptung, keine Zahl.
- Kein Geo-Off-Site für die Sicherungen — sie liegen verschlüsselt auf der GPU-Box, also im selben Raum.
- Ein Restore ist noch nie geübt worden.
- 8 GB je EliteDesk deckeln, was das Agentenlabor kann.