Packages SKILL.md qui étendent Claude Code, Cursor, Copilot et autres agents IA.
Étiquettes

auto-improve
Une boucle autonome avec juge qui améliore itérativement les artefacts textuels à l'aide d'une rubrique et d'un modèle d'évaluation distinct pour garantir des gains vérifiés.

alchaincyf
Optimiseur de compétences autonome utilisant une grille d'évaluation en 9 dimensions pour améliorer les fichiers SKILL.md via une boucle itérative et validée.

entityprocess
Exécute les évaluations AgentV et optimise les agents via une itération basée sur les évaluations.

aeon-bench-pod
Exécutez des benchmarks LLM de bout en bout via AEON Bench Pod. De la vérification du modèle à la soumission au classement.

pjt222
Évalue les modèles de diffusion pré-entraînés à l'aide de métriques de qualité, de l'analyse du calendrier du bruit et du sondage de l'espace latent.

claude-skill-registry
Guide complet pour intégrer LangSmith afin de tracer, évaluer et surveiller les applications LLM et les agents IA en production.

de-anthropocentric-research-engine
Pipeline d'évaluation multi-étapes qui score les idées selon leur nouveauté, évalue la faisabilité, les classe et sélectionne les meilleurs candidats pour un développement approfondi.

nemotron
Base de connaissances faisant autorité pour Nemotron 3 Nano : architecture, données d'entraînement, recettes SFT/RL, conseils d'évaluation et de déploiement.