
de tao-skill-bank80
Déployez et gérez des microservices d'inférence TAO spécifiques au réseau sur diverses plateformes de calcul, notamment Docker, Kubernetes et Slurm.
Cette compétence permet à un agent d'orchestrer l'ensemble du cycle de vie des microservices d'inférence TAO (Torch-Audio-Omniverse). Elle gère la complexité de la correspondance entre les architectures réseau et les images de conteneurs spécifiques, la construction des charges utiles des jobs et la gestion du registre de services pour garantir des points de terminaison prévisibles pour les requêtes d'inférence.
Utilisez cette compétence lorsqu'un utilisateur souhaite déployer un checkpoint de modèle TAO pour l'inférence, démarrer un nouveau point de terminaison d'inférence ou arrêter un conteneur de microservice existant. Elle est spécifiquement conçue pour les flux de travail nécessitant une inférence IA haute performance via des microservices.
Conçu pour les agents avancés capables d'exécuter des commandes shell et de gérer des environnements conteneurisés (par exemple, Claude Code, Codex ou des agents OpenClaw personnalisés).
Cette compétence n'a pas encore été examinée par notre pipeline d'audit automatisé.