v1.1.0 — local model lineup overhaul

CPU:
- Add gemma4:e2b (multimodal), phi4-mini (reasoning), gemma3:4b (vision)
- Add qwen3-embedding:0.6b
- Drop phi3.5, nomic-embed-text

CUDA:
- Add gemma4:e4b + e2b, deepseek-coder-v2:16b, deepseek-r1:8b
- Add qwen3-abliterated:16b, gemma4-abliterated:e4b (uncensored)
- Drop dolphin-mistral:7b, dolphin3

Fallback chains rewritten for all new models. Tests and docs updated.