MISA: Memory-Efficient LLM Optimization

MISA is a memory-efficient optimization method for large language models. It uses module-wise importance sampling to reduce the memory demands of pre-training and fine-tuning while retaining the optimization signal from selected modules.

The work was accepted by NeurIPS 2025.




Enjoy Reading This Article?

Here are some more articles you might like to read next:

  • SparkDiffusion: Mitigating the High-Sparsity Trap
  • CrossDistill: Balancing Quality and Diversity
  • RoLA: Rotary-Positioned Low-Rank Linear Attention
  • RoPeSLR: Sparse-Low-Rank Attention for Diffusion Transformers
  • CR-Net: Cross-Layer Low-Rank Structure