LLM Finetuning
Ajuste fino por etapas, con evaluación antes de entrenar
Instalación
Claude Code: /plugin marketplace add wshobson/agents → /plugin install llm-finetuning@claude-code-workflows
Açık ağırlıklı bir model uçtan uca ince ayarlanırken, değerlendirme takımı kurulurken ya da bir checkpoint'in yayına çıkıp çıkmayacağına karar verilirken
- Autor
- Seth Hobson
- Licencia
- MIT
Once skills ordenan el proceso: decidir si realmente hace falta el ajuste fino, crear el sistema de evaluación, seleccionar los datos, entrenar y someter el checkpoint a controles antes de promoverlo. La ruta contempla alternativas desde el principio —RAG para datos cambiantes y prompts para comportamientos aún no definidos— y excluye por ID los ejemplos dorados de los datos de entrenamiento para evitar fugas que inflen la puntuación. La promoción pasa por cuatro etapas y compara el checkpoint con el modelo base; admite desde LoRA y QLoRA hasta DPO y GRPO con recompensas verificables, y termina con exportación a GGUF o FP8.
Habilidades similares
Protect MCP
HabilidadAplica políticas Cedar y firma recibos encadenados
Agent Teams
HabilidadEquipos de agentes paralelos con propiedad estricta de archivos
Skill Forge Essentials
HabilidadTres habilidades para corregir errores propios de los agentes
Comentarios(0)
Inicia sesión para comentar