mana-gpu-broker
Die Schlange vor der einen Grafikkarte — teilt Speicher zu, damit sich sieben KI-Dienste nicht gegenseitig abschiessen.
Der Verein hat eine Grafikkarte und sieben Dienste, die sie brauchen. Ohne Absprache laden zwei davon gleichzeitig ihre Modelle, der Speicher reicht nicht, und beide stürzen ab — der eine, der zuerst da war, inklusive. Der Broker ist die Absprache.
Wer rechnen will, fragt vorher nach einem Platz und sagt dazu, wie viel Speicher er braucht und wie lange er ihn ungefähr hält. Passt es ins Budget, darf er sofort; passt es nicht, wartet er. Mehrere dürfen gleichzeitig, solange die Summe ins Budget passt — serialisiert wird nur so weit wie nötig.
Zwei Entscheidungen darin sind wichtiger, als sie klingen:
Wer wartet, wird nicht überholt. Die Zuteilung stoppt beim ersten Wartenden, der nicht mehr hineinpasst, statt kleinere Aufträge an ihm vorbeizulassen. Das kostet Auslastung und verhindert, dass ein grosser Auftrag ewig hinten steht.
Der Mensch geht vor dem Stapel. Spracherkennung und Sprachausgabe haben Vorrang vor Bild, Musik und Trennung — hinter den ersten beiden wartet jemand, hinter den anderen ein Auftrag.
Interessanterweise rechnet der Broker selbst nichts und läuft nicht einmal auf der Box: er sitzt auf dem Mac Mini und entscheidet nur, wer auf die Karte darf.
Der ehrliche Haken: die Speichermengen, mit denen die Dienste anfragen, sind zum grössten Teil Schätzungen, keine Messungen — bei den Sprachmodellen sogar nur eine Tabelle nach Modellgrösse. Genau zwei Werte im ganzen Haus stammen aus einem echten Lauf. Die Betriebs-Tafel weist beides getrennt aus, statt es zu vermischen.
Stack & Infrastruktur
- Sprache
- TypeScript
- Stack
- TypeScript · Hono · Bun · in-memory, optional Redis
- Port
- 3131
- Hosting
- Eigenbetrieb auf Vereins-Infrastruktur. Keine Drittpartei, kein Cloud-Anbieter, kein Managed-Service.
- Code
- git.mana.how
Infrastruktur unter diesem Service
Welche Vereins-Hardware, eigenen Dienste und bewussten Externe mana-gpu-broker konkret benutzt. Jedes Item hat eine eigene Seite mit Stand und Mitigation.
-
Maschinemana-serverApple Mac mini M4 · Tägerwilen (Schweiz)Der Hauptserver des Vereins — ein Mac mini M4 in Tägerwilen (Schweiz), der die ganze Plattform trägt.
-
Maschinemana-gpuWorkstation mit RTX 3090 · Tägerwilen (Schweiz)Eigene KI-Inferenz-Workstation für die Workloads, die wir nicht auslagern wollen.
Wer ihn benutzt
- mana-stt
- mana-tts
- mana-image-gen
- mana-music-gen
- mana-stems
- mana-3d
- mana-llm
Was er für den Verein verkörpert
-
EigenbetriebEigene Infrastruktur, quelloffener Stack.
-
LanglebigkeitBewährte Stacks, gute Doku.
-
AchtsamkeitKeine Engagement-Tricks.
Was läuft, was nicht
Phase: Live.
- Die Speicherwerte, mit denen die Dienste anfragen, sind fast alle geschätzt statt gemessen — zwei von elf tragen eine echte Messung.
- Läuft noch per Hand gestartet statt aus der gemeinsamen Compose-Datei.
Weitere Services dieser Kategorie
Sprache, Text und Bild — selbst gehostet, soweit es geht.
-
mana-llmEine Schnittstelle vor Anthropic, OpenAI, Gemini — ein Ort für API-Keys, ein Cost-Tracking, ein Audit.
-
mana-sttSelbst gehostetes Speech-to-Text via Whisper auf eigenem GPU-Server — Sprache verlässt die Vereins-Infrastruktur nicht.
-
mana-stt-ersatzDerselbe Spracherkenner auf einem zehn Jahre alten Büro-PC — langsamer, aber genauso genau, und er läuft, wenn die Grafikkarte ausfällt.
-
mana-ttsSelbst gehostetes Text-to-Speech auf eigenem GPU-Server — Vereins-Stimme statt Big-Cloud-Stimme.
mana-gpu-broker ist einer von vielen Plattform-Services, die unter den Apps des Vereins laufen. Eigenbetrieb statt SaaS, dokumentiert statt undurchsichtig.