Berichte · rechenwerk

Was hier rechnet

Fünf Rechner, achtzehn eigene Dienste, dreizehn Modelle mit offenen Gewichten — und zwei Ausfälle an einem einzigen Tag, beide selbst verschuldet. Der erste Bericht des Arms, der kein Publikum hat.

5
Maschinen, alle im selben Raum
18
eigene Dienste
13
Modelle im offenen Katalog
2
Ausfälle an einem Tag, beide selbst verschuldet

Beschreibt den Stand am 18. August 2026 · veröffentlicht am 8. September 2026

Der Arm rechenwerk ist der einzige des Hauses ohne Publikum. Er hat keine App, keine Landing und keine Nutzerinnen — er hat fünf Rechner und achtzehn selbst gebaute Dienste, und alles andere steht auf ihnen. Ein Release heisst hier deshalb nicht Ankündigung, sondern Rechenschaft: was steht da, was tut es, was hat es getan, und was hat nicht funktioniert.

Dieser Bericht ist der erste. Er beschreibt den Stand am 18. August 2026 — dem Tag, an dem die ersten drei Flächen des Hauses released wurden.

1 · Das Blech

Fünf Maschinen, alle im selben Raum, alle im Eigentum des Hauses. Keine Cloud für den Betrieb, keine Miete pro Monat, keine Rechnung pro Aufruf.

Maschine Was drin ist Wofür
GPU-Box Ryzen 9 5950X · 16 Kerne · 64 GB · RTX 3090 mit 24 GB VRAM · Windows 11 + WSL2 die Rechenstelle: Sprache, Bild, Ton, 3D
Mac Mini M4 · 10 Kerne · 16 GB · 256 GB intern + 4 TB USB-SSD trägt die Plattformdienste, alle Landings und alle Apps
G2-A (node-1) HP EliteDesk 800 G2 · i5-6500T · 8 GB · Debian 13 Gegen-Wächter über den Mini · zweiter Metrik-Pfad · Android-Builds
G2-B (node-2) HP EliteDesk 800 G2 · 8 GB · Debian 13 Überwachung · CPU-Ausweich für Sprache · ESP32-Werkbank
G3 (node-3) HP EliteDesk 800 G3 · i5-7500 · 8 GB · Debian 13 Agentenlabor (fremder Code) · Messreihen

Drei der fünf sind gebrauchte Büro-Kleinrechner. Das ist kein Sparzwang, sondern die Bauart: was 35 Watt zieht und im Regal steht, darf ausfallen, und der zweite Metrik-Pfad auf node-1 existiert genau dafür.

🔴 Eine Grenze, die heute weh tut: node-1 bis node-3 haben je 8 GB. Für das Agentenlabor reicht das nicht; das steht so im Bestand und ist nicht weggeplant.

2 · Was darauf läuft — achtzehn eigene Dienste

Alle selbst gebaut, alle im eigenen Netz, keiner als fremder SaaS eingekauft:

  • Sprachemana-llm (Textmodelle), mana-stt und mana-tts (Sprache zu Text und zurück), dazu mana-stt-ersatz/-tts-ersatz als CPU-Ausweich auf node-2, wenn die Box aus ist
  • Bild und 3Dmana-image-gen, mana-image-edits, mana-portrait-3d, mana-splat und mana-splat-worker, mana-mesh, mana-comfy-mcp
  • Tonmana-music-gen, mana-stems (Spuren trennen), mana-stimmen
  • Betrieb und Messungmana-gpu-broker (verteilt die Arbeit auf die Box), mana-evals (misst Modelle gegeneinander), mana-research

Warum das zählt: jede dieser Fähigkeiten wäre als Zukauf ein Betrag pro Aufruf und ein Vertrag mit einem fremden Rechenzentrum. Hier ist sie eine Maschine, die ohnehin steht. Der Preis dafür ist nicht null — er ist Strom, Wartung und die Ausfälle unten.

3 · Wie damit Welle 1 entstanden ist

Die ersten drei Flächen — seepuls, pipfold, kartomo — sind nicht auf fremder Infrastruktur gebaut worden:

  • Gebaut: die Godot-Fassung von pipfold wird auf dem Mac Mini exportiert und ausgeliefert, die Android-Pakete baut node-1. Der eigene Paket-Server (fdroid.mana.how) verteilt sie — ohne fremden Store, ohne Review, ohne Gebühr.
  • Betrieben: alle drei laufen als Container auf dem Mac Mini, hinter dem eigenen Tunnel. 186 Container zum Zeitpunkt dieses Berichts.
  • Gemessen: die Reichweite misst umami.mana.how — auf eigenen Servern, ohne fremden Zähler. Was die Suchmaschinen sehen, misst mana-seo.
  • Beworben: die Bilder der Landings entstehen auf der GPU-Box, die Redaktion für die Kanäle (redaktion.mana.how) ist ein eigener Dienst, und die Beiträge liegen als Textdateien in git statt in einem Planungswerkzeug.

4 · Welche Modelle wir fahren und prüfen

Dreizehn Modelle stehen im offenen Katalog (mana.how/modelle) — alle mit offenen Gewichten, die meisten lokal auf der 3090:

Wofür Modell Grösse
Text, Standard lokal Gemma 4 12B (Google) 12 Mrd
Text, sehr klein / auf dem Gerät Qwen2.5 0.5B (Alibaba) 0,5 Mrd
Bild verstehen Pixtral 12B (Mistral) 12 Mrd
Bild erzeugen FLUX.2 Klein (Black Forest Labs) · Ideogram 4 4 / 9,3 Mrd
Sprache zu Text Whisper large-v3-turbo (OpenAI, offene Gewichte) 809 Mio
Text zu Sprache Qwen3-TTS (Alibaba) 1,7 Mrd
Musik ACE-Step · MusicGen (Meta) · MiniMax Music 3 3,5 / 3,3 / 11 Mrd
Spuren trennen HTDemucs (Meta)
3D aus Bild TRELLIS (Microsoft Research)
Video / Figuren MiniMax H3 33 Mrd

Was daraus in Apps wandert: die Sprachmodelle stecken bereits hinter mana-llm und damit hinter jeder App, die Text versteht; Whisper und Qwen3-TTS tragen die Hör- und Sprech-Funktionen; TRELLIS und die Bildmodelle sind die Rechenseite von rundum, comicello und lumetour.

🛑 Ein Modell im Katalog ist kein Versprechen an eine App. Zwei der dreizehn laufen in China gehostet und sind damit ausdrücklich nicht für Wohnraum-Daten zugelassen; welches Modell eine App benutzen darf, entscheidet die Weiche, nicht der Katalog.

5 · Was nicht funktioniert hat

Ein Transparenzbericht, der nur Ausstattung aufzählt, ist eine Broschüre. Ausgerechnet am Tag dieses Berichts gab es zwei Ausfälle, beide selbst verschuldet:

  • Nachts, rund zehn Stunden: nicht die Maschine fiel aus, sondern der eigene Wächter legte eine gesunde VM um — eine einzelne langsame Probe reichte. Danach schwieg er neun Stunden lang mit derselben Logzeile. Gemeldet hat ihn niemand, weil sein Meldeweg auf der Flotte lag, die gerade unten war.
  • Nachmittags, 42 Minuten: dieselbe Klasse, nach dem Fix. Der harte Neustart des Wächters verschlechterte die Lage: vorher lief die VM und nur die Weiterleitung fehlte, danach war sie unten und kam dreimal nicht hoch.

Beides ist repariert, das zweite noch nicht in der Wurzel. Der Satz, der bleibt: ein Automat, der heilen soll, kann schaden — und ein Alarm, der über die Anlage läuft, die er bewacht, ist keiner.

Offene Punkte

  • Strom und echte Kosten pro Monat sind nicht gemessen. Solange das so ist, ist „günstiger als Cloud“ eine Behauptung, keine Zahl.
  • Kein Geo-Off-Site für die Sicherungen — sie liegen verschlüsselt auf der GPU-Box, also im selben Raum.
  • Ein Restore ist noch nie geübt worden.
  • 8 GB je EliteDesk deckeln, was das Agentenlabor kann.