Ollama

Ollama lokal


Qwen3.8
Nur zur internen und eigenen Verwendung: 1. In der Ollama-App das Modell qwen3-27b-16k auswählen statt des Originals - qwen3.8-27b.. 2. Das Denken zügeln. Wenn es in der GUI weiter durchdreht, geht es im Terminal zuverlässig: ollama run qwen3-27b-16k --think=false # gar kein Denken ollama run qwen3-27b-16k --think=low # kurzes Denken. Das Modell unterstützt vier Denkstufen (low/medium/high/xhigh); der Default war xhigh. Das Modelfile liegt zum Nachjustieren unter C:\Users\??\.ollama\Modelfile.qwen3-27b-16k; nach Änderungen einfach ollama create qwen3-27b-16k -f erneut ausführen. Rückgängig machen: ollama rm qwen3-27b-16k.