Story

arxiv_cs_lg ยท May 19, 2026 ยท paper

Source brief

Fine-Tuning Without Forgetting via Loss-Adaptive Learning Rates

arxiv.orgMay 19, 2026
original source linked

In brief

Fine-tuning large language models on new data improves task performance but degrades capabilities learned during pretraining, a phenomenon known as catastrophic forgetting. Existing methods mitigate this by modifying...

Continue reading

Read the original at arxiv.org โ†’Open in live feed

Earlier in this thread 4 items