MLflow Skills
Ajan geliştirmede döngüyü kapatıyor: kur, izle, değerlendir, değiştir, değişikliğin işe yaradığını doğrula.
Kurulum
ResmiScript içeriyorClaude Code: /plugin marketplace add anthropics/claude-plugins-official → /plugin install mlflow@claude-plugins-official
Bir LLM uygulamasına izleme eklenirken, iz üzerinden arıza aranırken ya da değerlendirme puanlayıcısı kurulurken
- Geliştirici
- MLflow
- Lisans
- Apache-2.0
Parçalar olağan MLflow bileşenleri: Python ve TypeScript için izleme, izleri geri çekme, metrik sorgulama, arıza çözümlemesi. Asıl mesele bunların diziliş biçimi, çünkü puanlayıcı olmadan bir ajan iyileştirmesi kanaatten öteye geçmiyor. Puanlayıcı becerisi işe hazır listeden seçmekle başlamayı reddediyor: önce uygulamanın ne yaptığını anlıyor, oradan az sayıda ve bölünemez kalite ölçütü çıkarıyor, ancak ondan sonra her ölçütü yargılayabilecek en ucuz puanlayıcıyı seçiyor. Neyin yanlış sayıldığı konusunda son sözü kullanıcıya bırakıyor. İlk denemede kusursuzluk yerine çalıştırılabilir ve incelenebilir bir prototip hedeflemesi, döngünün dönmeye devam etmesini sağlıyor.
Benzer skill'ler
API Testing & Observability
SkillOpenAPI 3.1 dokümantasyonu ve durum tutan mock sunucu; istemci API'den önce yazılabiliyor.
Shell Scripting
Skillİki kabuk ajanı; bash deyimlerinin POSIX sh betiklerine sızmasını ShellCheck ve Bats ile önlüyor.
Accessibility Compliance
SkillWCAG 2.2 denetimi; doğrulayıcı ajan ekran görüntüsü kanıtlamadan düzeltmeyi başarısız sayıyor.
Yorumlar(0)
Yorum yapmak için giriş yap