Ir al contenido
ai101.tools
navegarabriresccerrar
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
LLM Finetuning logo
Habilidad

LLM Finetuning

Ajuste fino por etapas, con evaluación antes de entrenar

0
GuardarVisitar sitio web ↗

Instalación

Claude Code: /plugin marketplace add wshobson/agents → /plugin install llm-finetuning@claude-code-workflows
Se activa con

Açık ağırlıklı bir model uçtan uca ince ayarlanırken, değerlendirme takımı kurulurken ya da bir checkpoint'in yayına çıkıp çıkmayacağına karar verilirken

Autor
Seth Hobson
Licencia
MIT

Once skills ordenan el proceso: decidir si realmente hace falta el ajuste fino, crear el sistema de evaluación, seleccionar los datos, entrenar y someter el checkpoint a controles antes de promoverlo. La ruta contempla alternativas desde el principio —RAG para datos cambiantes y prompts para comportamientos aún no definidos— y excluye por ID los ejemplos dorados de los datos de entrenamiento para evitar fugas que inflen la puntuación. La promoción pasa por cuatro etapas y compara el checkpoint con el modelo base; admite desde LoRA y QLoRA hasta DPO y GRPO con recompensas verificables, y termina con exportación a GGUF o FP8.

Comentarios(0)

Inicia sesión para comentar

Aún no hay comentarios. Sé el primero.

Habilidades similares

Denunciar este comentario

¿Por qué quieres denunciarlo?