mana-stems
Trennt eine fertige Aufnahme in Gesang und Begleitung — die Grundlage für Karaoke aus eigenem Material.
Aus einem fertigen Lied werden zwei Spuren: Gesang und alles andere. Damit lässt sich aus vorhandenem Material eine Karaoke-Fassung bauen, ohne dass die Aufnahme das Haus verlässt. Ein Stück braucht rund 14 Sekunden.
Das Modell ist HTDemucs v4 unter MIT — eine der wenigen Stellen im KI-Feld, wo die freieste Lizenz zugleich der Stand der Technik ist.
Eine Betriebsgeschichte, die hier hingehört: der Dienst war sechs Wochen weg und niemand hat es gemeldet. Er lief bis zum 11. Juli 2026, geriet bei einer Datenbank-Umstellung in eine Neustart-Schleife und kam nach einem Plattentausch nicht zurück — weil sein Deploy ein handgemachtes Unikat ohne Compose-Datei war. Seit dem 27. Juli steht er wieder, diesmal in der gemeinsamen Compose-Datei der Box. Die Lehre steht im Wächter-Text: ein Dienst, den kein Register kennt, fehlt niemandem auf.
Stack & Infrastruktur
- Sprache
- Polyglott
- Stack
- TypeScript · Demucs HTDemucs v4 · PyTorch · CUDA · RTX 3090
- Port
- 3120
- Hosting
- Eigenbetrieb auf Vereins-Infrastruktur. Keine Drittpartei, kein Cloud-Anbieter, kein Managed-Service.
- Code
- git.mana.how
Infrastruktur unter diesem Service
Welche Vereins-Hardware, eigenen Dienste und bewussten Externe mana-stems konkret benutzt. Jedes Item hat eine eigene Seite mit Stand und Mitigation.
Was er für den Verein verkörpert
-
DatensouveränitätVerwahrer statt Eigentümer.
-
EigenbetriebEigene Infrastruktur, quelloffener Stack.
-
UnabhängigkeitSchweizer Verein, keine Investoren.
-
OffenheitCode und Mittelverwendung öffentlich.
Was läuft, was nicht
Phase: Live.
- Trenngüte und Zeit je Stück sind nie systematisch gemessen worden.
Weitere Services dieser Kategorie
Sprache, Text und Bild — selbst gehostet, soweit es geht.
-
mana-llmEine Schnittstelle vor Anthropic, OpenAI, Gemini — ein Ort für API-Keys, ein Cost-Tracking, ein Audit.
-
mana-sttSelbst gehostetes Speech-to-Text via Whisper auf eigenem GPU-Server — Sprache verlässt die Vereins-Infrastruktur nicht.
-
mana-stt-ersatzDerselbe Spracherkenner auf einem zehn Jahre alten Büro-PC — langsamer, aber genauso genau, und er läuft, wenn die Grafikkarte ausfällt.
-
mana-ttsSelbst gehostetes Text-to-Speech auf eigenem GPU-Server — Vereins-Stimme statt Big-Cloud-Stimme.
mana-stems ist einer von vielen Plattform-Services, die unter den Apps des Vereins laufen. Eigenbetrieb statt SaaS, dokumentiert statt undurchsichtig.