Zum Inhalt springen
ai101.tools
navigierenöffnenescschließen
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
LLM Finetuning logo
Skill

LLM Finetuning

Fine-Tuning mit Prüfstufen und Evaluation vor dem Training

0
SpeichernWebsite besuchen ↗

Installation

Claude Code: /plugin marketplace add wshobson/agents → /plugin install llm-finetuning@claude-code-workflows
Wird ausgelöst bei

Açık ağırlıklı bir model uçtan uca ince ayarlanırken, değerlendirme takımı kurulurken ya da bir checkpoint'in yayına çıkıp çıkmayacağına karar verilirken

Autor
Seth Hobson
Lizenz
MIT

Elf Skills strukturieren den Ablauf: zuerst prüfen, ob Fine-Tuning überhaupt sinnvoll ist, dann die Evaluation aufbauen, Daten kuratieren, trainieren und den Checkpoint freigeben. Veränderliche Fakten werden an RAG und noch nicht gefestigtes Verhalten an den Prompt verwiesen; gelabelte Traces erzeugen sowohl den Golden-Datensatz als auch Trainingsdaten, wobei Golden-Beispiele per ID ausgeschlossen werden, um Datenlecks zu verhindern. Die vierstufige Freigabe verlangt auch einen Sieg gegen das Basismodell in einer paarweisen Arena und unterstützt Methoden von LoRA und QLoRA über DPO bis GRPO sowie den Export als GGUF oder FP8.

Kommentare(0)

Zum Kommentieren anmelden

Noch keine Kommentare — schreibe den ersten.

Ähnliche Skills

Diesen Kommentar melden

Warum meldest du das?