Да, попробовал v0.1.2 на Windows 11, RTX 3070 Laptop 8 GB, Qwen3.5-9B UD-Q3_K_XL. Приложение RTX 3070 определило и запустило llama-server с `--n-gpu-layers 999`, но фактически установился `win-cpu-x64`: во время генерации VRAM оставалась 0 MiB, GPU 0%, нагрузка шла на CPU (~6.3 tok/s). При этом в UI был выбран GPU 0 и предупреждения о fallback на CPU я не увидел. Точную причину fallback дальше пока не разбирал. Если полезно, могу прислать `server-debug.log`, `.variant` и детали окружения.