Number of model layers to offload to GPU in Aspose.LLM for .NET — 0 for CPU-Only, 999 for full offload, partial for memory-tight GPUs....native default) Range 0 = CPU only; 999 = full offload; partial...each step. Value Behavior 0 CPU only. No VRAM allocated for weights...