From 75daadf72deb90073030f2906ccea5652c2a6992 Mon Sep 17 00:00:00 2001 From: duffyduck Date: Sat, 15 Aug 2026 01:53:59 +0200 Subject: [PATCH] fix(xtts): GPU-Pinning an 8GB+12GB-Realitaet anpassen Die zwei 3060 sind ungleich (GPU0=8GB, GPU1=12GB), nicht 12+12. Groesstes Modell (STT, spaeter Voxtral-STT-3B ~9GB) muss auf die 12GB-Karte: whisper->GPU1. TTS(F5)+LLM auf die 8GB-Karte: ->GPU0. Co-Authored-By: Claude Opus 4.8 --- xtts/docker-compose.yml | 6 +++--- 1 file changed, 3 insertions(+), 3 deletions(-) diff --git a/xtts/docker-compose.yml b/xtts/docker-compose.yml index 0605327..710ca14 100644 --- a/xtts/docker-compose.yml +++ b/xtts/docker-compose.yml @@ -30,7 +30,7 @@ services: reservations: devices: - driver: nvidia - device_ids: ["1"] # TTS-Rolle → GPU 1 (spaeter: Voxtral-TTS) + device_ids: ["0"] # TTS → GPU 0 (8 GB; F5 ist klein) capabilities: [gpu] volumes: - ./voices:/voices # WAV + TXT Referenz @@ -68,7 +68,7 @@ services: reservations: devices: - driver: nvidia - device_ids: ["0"] # STT-Rolle → GPU 0 (spaeter: Voxtral-STT-3B) + device_ids: ["1"] # STT/groesstes Modell → GPU 1 (12 GB; spaeter Voxtral-STT-3B ~9 GB) capabilities: [gpu] environment: - RVS_HOST=${RVS_HOST} @@ -108,7 +108,7 @@ services: reservations: devices: - driver: nvidia - device_ids: ["0"] # LLM → GPU 0 (teilt sich mit dem kleinen STT) + device_ids: ["0"] # LLM → GPU 0 (8 GB, teilt sich mit TTS) capabilities: [gpu] volumes: - ./models:/models # HF-Download-Cache (persistent)