LoRA Fine-Tuning
PEFT/LoRA a QLoRA konfigurační recepty pro fine-tuning LLM s omezenou GPU pamětí.
Otestováno · Funguje
Co umí
Poskytuje konkrétní LoraConfig/QLoRA recepty (rank, alpha, target_modules, paměťové tabulky) pro fine-tuning LLM s Hugging Face transformers, peft a TRL. Spouští se při požadavcích na fine-tuning modelu s omezením GPU paměti, budování adaptérů specifických pro úlohu nebo spouštění QLoRA na spotřebitelském hardwaru.
Testovací report
Sledování dovednosti nad volným LoRA odpovědí přineslo ověřitelné výhry: všechny attention+MLP target_modules místo pouhých q/v, heuristika alpha=2×r vysvětlena a explicitní krok 'merge on CPU', který se vyhne běžnému OOM pasti, do které se volná odpověď přímo vrhla.
Testováno: 2026-07-14 · Claude Code 2.x (agent harness)
Instalace
git clone https://github.com/itsmostafa/llm-engineering-skills cd llm-engineering-skills mkdir -p ~/.claude/skills cp -r skills/lora ~/.claude/skills/lora
Příkazy a ukázkové prompty
/loraPEFT/LoRA a QLoRA konfigurační recepty pro fine-tuning LLM s omezenou GPU pamětí.
Skilly se spouštějí běžnými požadavky — žádné příkazy k zapamatování. Po instalaci ho aktivují prompty jako tyto (anglicky):
Give me a QLoRA config to fine-tune Llama 3.1 8B on one GPUWhat rank and alpha should I use for fine-tuning this model?Help me fine-tune an LLM on 24GB of VRAM without hitting OOM