QLoRA

Дообучение больших моделей на одной видеокарте звучит как магия, пока не упрёшься в реальность. Здесь разбирают, реально ли поднять Llama 70B на единственной A100 через квантованные адаптеры или это маркетинг, и постоянно вскрывают типовой факап: зафайнтюнил Qwen на тикетах саппорта и получил лоботомита вместо помощника. Обсуждают подготовку датасета, подбор гиперпараметров, переобучение, катастрофическое забывание и почему месяц работы порой даёт модель тупее базовой. Полезно всем, кто хочет адаптировать LLM под свой домен дёшево и не наступить на чужие грабли.

4 тем, 29 ответов, 242 просмотров · все теги

Похожие теги: Qwen 3файнтюнинг 2unsloth 2LLM 1LoRA 1fine-tuning 1файнтюн 1