Да, попробовал v0.1.2 на Windows 11, RTX 3070 Laptop 8 GB, Qwen3.5-9B UD-Q3_K_XL. Приложение RTX 3070 определило и запустило llama-server с `--n-gpu-layers 999`, но фактически установился `win-cpu-x64`: во время генерации VRAM оставалась 0 MiB, GPU 0%, нагрузка шла на CPU (~6.3 tok/s). При этом в UI был выбран GPU 0 и предупреждения о fallback на CPU я не увидел. Точную причину fallback дальше пока не разбирал. Если полезно, могу прислать `server-debug.log`, `.variant` и детали окружения.
Да, попробовал v0.1.2 на Windows 11, RTX 3070 Laptop 8 GB, Qwen3.5-9B UD-Q3KXL.…
0 viewsОткрыть в Telegram →
Из этого канала
- #6781Reversal Q-Learning https://arxiv.org/abs/2606.17551…
Reversal Q-Learning https://arxiv.org/abs/2606.17551 https://www.alphaxiv.org/ru/overview/2606.17551
- #6780On-Policy Self-Distillation without Any Supervision…
On-Policy Self-Distillation without Any Supervision https://arxiv.org/abs/2608.06296 https://www.alphaxiv.org/ru/overview/2608.06296
- #6779https://t.me/einytech/131
https://t.me/einytech/131