# Voxtral-BRIDGE (nicht das Modell!) — leichte CPU-Glue zwischen RVS und dem # vLLM-Realtime-Server. Das eigentliche Voxtral-Modell laeuft im Container # `voxtral-vllm` (GPU, vllm/vllm-openai). Deshalb hier kein CUDA-Base noetig. FROM python:3.11-slim ENV PYTHONUNBUFFERED=1 WORKDIR /app COPY requirements.txt . RUN pip install --no-cache-dir -r requirements.txt COPY bridge.py ./ CMD ["python3", "bridge.py"]