
de tools10
Standardise la création, l'audit et la promotion des runtimes de moteurs d'inférence locaux (vLLM, llama.cpp, etc.) pour éviter la prolifération des chaînes d'outils.
Ce skill implémente une norme opérationnelle stricte pour la gestion des runtimes d'inférence locaux. Il impose une structure de répertoire canonique, exige un suivi de la provenance via des manifestes et impose des tests de fumée avant qu'un runtime ne soit promu au statut 'actuel'.
Utilisez ce skill lors de l'installation de nouveaux moteurs d'inférence LLM, de la mise à jour de chaînes d'outils existantes ou de la préparation d'un environnement reproductible pour le benchmarking des performances des modèles.
manifest.json (suivi des versions, du matériel et de la source) et profiles (flags de service spécifiques au modèle).Adapté aux agents techniques gérant des stations de travail HPC ou de recherche en IA, particulièrement ceux s'intégrant à des chaînes d'outils de benchmark.
Cette compétence n'a pas encore été examinée par notre pipeline d'audit automatisé.