Nur zur internen und eigenen Verwendung:
1. In der Ollama-App das Modell qwen3-27b-16k auswählen statt des Originals - qwen3.8-27b..
2. Das Denken zügeln. Wenn es in der GUI weiter durchdreht, geht es im Terminal zuverlässig:
ollama run qwen3-27b-16k --think=false # gar kein Denken
ollama run qwen3-27b-16k --think=low # kurzes Denken.
Das Modell unterstützt vier Denkstufen (low/medium/high/xhigh); der Default war xhigh. Das Modelfile liegt zum Nachjustieren unter C:\Users\??\.ollama\Modelfile.qwen3-27b-16k; nach Änderungen einfach ollama create qwen3-27b-16k -f
erneut ausführen. Rückgängig machen: ollama rm qwen3-27b-16k.