# ════════════════════════════════════════════════ # ARIA Compute-Node — Konfiguration # Kopieren nach .env und anpassen (pro Worker-Node eine eigene .env) # ════════════════════════════════════════════════ # ─── Welche Dienste startet DIESER Node? ────────── # Komma-getrennt aus: voxtral, whisper, f5tts, llm # Nur die aufgefuehrten Dienste starten bei `docker compose up -d`. # nur STT-Box (Voxtral) → COMPOSE_PROFILES=voxtral # nur STT-Box (Whisper) → COMPOSE_PROFILES=whisper # nur TTS-Box → COMPOSE_PROFILES=f5tts # nur LLM-Box → COMPOSE_PROFILES=llm # Kleine Karte (wenig VRAM): Whisper + F5-TTS auf EINER GPU # → COMPOSE_PROFILES=whisper,f5tts # All-in-One, grosse Karte → COMPOSE_PROFILES=voxtral,f5tts,llm # Hinweis: voxtral UND whisper zusammen NICHT sinnvoll — beide sind STT und # wuerden dieselbe Anfrage doppelt beantworten. Pro Node genau EINEN STT waehlen: # Voxtral-3B (~9 GB, beste Qualitaet) ODER Whisper (klein, passt neben F5-TTS). COMPOSE_PROFILES=whisper,f5tts # ─── Node-Name ──────────────────────────────────── # Freier Name dieses Rechners. Erscheint in Diagnostic (Flotten-Anzeige) und # in den Logs, und bildet die Instanz-ID der Dienste (z.B. f5tts@ai-box). NODE_NAME=ai-box # ─── GPU-Zuordnung pro Dienst ───────────────────── # Setzt NVIDIA_VISIBLE_DEVICES fuer den jeweiligen Container. # Einzelne Karte → "0" oder "1"; mehrere Karten → "0,1". # Braucht das NVIDIA Container Toolkit (registriert die `nvidia`-Runtime). # Nur die GPUs der aktiven Profile (COMPOSE_PROFILES) sind ueberhaupt relevant. WHISPER_GPU=0 # kleines STT → passt neben F5-TTS auf EINE Karte F5TTS_GPU=0 # TTS ist klein → gleiche Karte wie Whisper VOXTRAL_GPU=1 # STT-3B ~9 GB → nur auf einer groesseren Karte (z.B. 12 GB) LLM_GPU=0 # lokales LLM (teilt sich ggf. die Karte mit F5-TTS) # ─── RVS-Verbindung (gleiche Daten wie auf der ARIA-VM) ─── RVS_HOST=mobil.hacker-net.de RVS_PORT=444 RVS_TLS=true RVS_TLS_FALLBACK=true RVS_TOKEN=dein_token_hier # ─── Optional ───────────────────────────────────── # HF_TOKEN= # nur falls ein HF-gated Modell (z.B. Voxtral) geladen wird # WHISPER_MODEL=small # tiny|base|small|medium|large-v3 (Hot-Swap via Diagnostic) # WHISPER_LANGUAGE=de # LLM_MODEL=qwen3-8b # Key aus llama-swap/config.yaml