FBLayout: Optimizing Memory Layout for Efficient LLM Finetuning on Mobile GPUs
DGX agentarXiv:2607.21624v1 Announce Type: cross Abstract: Transformer-based models have enabled unprecedented capabilities across language, vision, and multimodal tasks. On-device fine-tuning of transformer m