Zum Inhalt springen
ai101.tools
navigierenöffnenescschließen
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
PluginEval logo
Skill

PluginEval

Bewertet Claude Code Skills mit Checks, LLM und Monte Carlo

0
SpeichernWebsite besuchen ↗

Installation

Enthält Skripte
Claude Code: /plugin marketplace add wshobson/agents → /plugin install plugin-eval@claude-code-workflows
Wird ausgelöst bei

Yazılan bir skill ya da eklentinin kalitesi ölçülürken, iki skill karşılaştırılırken ya da bir pazar yeri için puan eşiği belirlenirken

Autor
Seth Hobson
Lizenz
MIT

PluginEval prüft Skills in drei zunehmend aufwendigen Stufen: eine statische Analyse von SKILL.md in weniger als zwei Sekunden, eine etwa dreißigsekündige LLM-Bewertung von Auslösung, Orchestrierung, Ausgabe und Umfang sowie fünfzig bis hundert Monte-Carlo-Durchläufe zur Schätzung der Zuverlässigkeit. Die statischen Regeln bevorzugen 200 bis 600 Zeilen für schrittweise offengelegte Inhalte; jedes erkannte Antimuster senkt die Stufenwertung um weitere fünf Prozent, höchstens jedoch bis zur Hälfte. Die Ergebnisse fließen in ein Elo-Ranking relativ zu einem Vergleichskorpus ein, und das Werkzeug wird als echtes Python-Paket mit Testsuite ausgeliefert.

Kommentare(0)

Zum Kommentieren anmelden

Noch keine Kommentare — schreibe den ersten.

Ähnliche Skills

Diesen Kommentar melden

Warum meldest du das?