Qwen3 kann natives OpenAI-Tool-Calling; llama.cpp (--jinja) unterstuetzt es. Lokales Tier bekommt einen kleinen, risikoarmen Start-Satz (Wetter, memory_search, trigger_timer, Spotify, Licht); volles Arsenal bleibt bei Claude, Escalation-Netz bleibt. Klein halten = Speed. Plan-Entscheidungen + Phasen entsprechend gezogen. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>