DeepEval Skills
LLM uygulamaları için değerlendirme, izleme ve OpenTelemetry; üç ayrı ve örtüşmeyen skill.
Kurulum
ResmiClaude Code: /plugin marketplace add anthropics/claude-plugins-official → /plugin install deepeval@claude-plugins-official
Bir LLM uygulamasına değerlendirme, izleme ya da OpenTelemetry dışa aktarımı eklenirken
- Geliştirici
- Confident AI
- Lisans
- Apache-2.0
Üç skill var ve ilginç olan aralarındaki sınır. Biri değerlendirme takımları kuruyor: golden'lar, veri kümeleri, pytest koşuları, metrikler ve başarısızlıkların istemi ile getirimi değiştirdiği döngü. Biri uygulamayı DeepEval'in kendi izleme katmanıyla ve beraberinde gelen çerçeve entegrasyonlarıyla donatıyor. Biri de SDK istemeyen ekipler için düz OpenTelemetry dışa aktarımını anlatıyor. Her birinin frontmatter'ı neyi ele almaması gerektiğini yazıyor ve o işi hangi kardeşin üstlendiğini söylüyor; yan yana duran üç skill'in de "eval" kelimesinde birden tetiklenmesine karşı ucuz bir çözüm.
Benzer skill'ler
API Testing & Observability
SkillOpenAPI 3.1 dokümantasyonu ve durum tutan mock sunucu; istemci API'den önce yazılabiliyor.
Shell Scripting
Skillİki kabuk ajanı; bash deyimlerinin POSIX sh betiklerine sızmasını ShellCheck ve Bats ile önlüyor.
Accessibility Compliance
SkillWCAG 2.2 denetimi; doğrulayıcı ajan ekran görüntüsü kanıtlamadan düzeltmeyi başarısız sayıyor.
Yorumlar(0)
Yorum yapmak için giriş yap