
de repo-task-proof-loop715
Une compétence de flux de travail locale au dépôt qui crée des dossiers de tâches auditables et exécute une boucle gel de spécifications → construction → preuve → vérification → correction avec vérification par session fraîche.
Fournit un flux de travail répétable et auditable pour implémenter et vérifier des tâches de codage non triviales à l'intérieur d'un dépôt. La compétence initialise .agent/tasks/<TASK_ID>/, installe des modèles de sous-agents limités au projet, et impose une boucle de gel de spécifications, de construction, de preuve, de vérification fraîche et de correction minimale qui produit des verdicts lisibles par machine et des fichiers de problèmes.
À utiliser pour les implémentations de fonctionnalités, les refactorisations, les migrations ou les corrections de bugs où vous avez besoin d'artefacts de preuve locaux au dépôt, d'une vérification reproductible et de modifications minimales et fiables. Déclencheurs : demandes d'implémentation de tâches significatives, exécution de vérificateurs ou production de verdicts PASS/FAIL basés sur des preuves.
scripts/task_loop.py et d'autres outils (le fetch rapporte has_scripts=false mais le SKILL.md documente scripts/ et references/)references/ décrit)init, freeze, build, evidence, verify, fix, status) et exigences strictes d'artefacts pour spec.md, evidence.md/json, verdict.json et problems.md. Des conseils sur les rôles des sous-agents et les exigences de fraîcheur sont inclus.Conçu pour les agents de codage de type Codex/Copilot et Claude Code où des sous-agents locaux au dépôt ou des sessions enfants peuvent être utilisés. Également utile pour les vérificateurs intégrés à la CI et l'automatisation pouvant exécuter des scripts Python dans le dépôt.
Une compétence de flux de travail locale au dépôt pour des tâches de codage auditables avec des boucles spec-freeze → build → evidence → verify → fix. Bien structurée avec un SKILL.md complet, des références et des modèles pour les sous-agents Codex et Claude Code. Les scripts ont échoué dans le sandbox : task_loop.py nécessite une sous-commande (init/validate/status), et verify_package.py s'attend à être exécuté depuis le répertoire racine de la compétence (il résout SKILL.md relativement à l'emplacement du script, ce qui échoue dans le répertoire d'exécution temporaire). La qualité du code est solide avec une bonne validation, une gestion des erreurs et des protections de sécurité des chemins.
Compétence impressionnante avec une documentation complète, des garde-fous pour les identifiants de tâche (pas de traversée de chemin), des blocs gérés pour AGENTS.md/CLAUDE.md qui préservent le contenu existant, un sentinelle d'initialisation pour la protection contre les conditions de concurrence, et des tests de fumée complets. Le fichier verify_package.py est un auto-test qui valide toute la structure du package de compétence — très bien conçu. L'échec de l'exécution du script est un artefact de résolution de chemin du sandbox, pas un défaut de code.