Configure how a model loads into memory in Aspose.LLM for .NET — GPU layer offload, tensor split across GPUs, memory mapping, memory locking, tensor validation, and metadata overrides....transformer layer lives either in system RAM (CPU inference) or GPU...rare scenarios — network file systems that do not support mmap ,...