fine-tuning

Дообучение моделей перестало быть привилегией компаний с кластерами A100: QLoRA позволяет адаптировать Llama 3 70B на одной карте, а споры о GaLore против классической LoRA не утихают. Здесь разбирают подбор датасетов, гиперпараметры, борьбу с переобучением и честно считают, когда файнтюн Gemma или Qwen оправдан, а когда хватит RAG и хорошего промпта. Полезно ML-инженерам и энтузиастам, обучающим модели на своём железе.

3 тем, 22 ответов, 194 просмотров · все теги

Похожие теги: LoRA 2LLM 1QLoRA 1GaLore 1memory-optimization 1pytorch 1mlops 1Gemma4 1