Extension Agent Task Audit
Rendre le travail multi-agents vérifiable
Quand le modèle le plus puissant coordonne et que des modèles exécutants plus légers réalisent les modules, utilisez des hooks et des autodéclarations pour consigner qui a fait quoi, quels outils ont servi et quels décomptes de jetons sont exacts ou estimés.
6
Événements de démo
3
Rapports d'exécutants
1 238
Jetons exacts
Anglais + chinois
Rapport au responsable
Ce que vous apprendrez
- Expliquer pourquoi le travail multi-agents avec Codex/Claude doit être auditable
- Distinguer les journaux automatiques des hooks, les autodéclarations des sous-agents et les limites de visibilité de l'environnement d'exécution
- Utiliser Agent Task Audit pour consigner l'utilisation des outils, la responsabilité des modules et la visibilité des jetons
- Transformer des journaux bruts en rapports en anglais et en chinois, lisibles par le responsable
- Concevoir un protocole d'autodéclaration des sous-agents : rôle, module, modèle, outils, fichiers, blocages et jetons
- Lancer la visionneuse de démo locale et importer des journaux d'audit NDJSON
Matériel du cours
Soumettez vos informations pour téléchargerRemplissez un court formulaire pour télécharger le PDF, les notes de cours, les notes de recherche et la capture d'écran de la démo.
Pour envoyer ces ressources aux personnes réellement intéressées, laissez vos coordonnées de base et vos sujets d’intérêt avant de télécharger. Le fichier s’ouvre automatiquement après l’envoi.
Déroulement du cours
D'une délégation opaque à une extension d'audit fonctionnelle et à un rapport au responsable.
Pourquoi auditer les agents IA
Délégation d'objectifs, modèles coordonnateurs, exécutants et opacité pour le responsable
Limites de la généralité
Schéma commun vs intégration propre à Codex/Claude
Architecture de l'extension
Hooks, autodéclarations, rapports au responsable et visionneuse
Protocole d'autodéclaration
Rôle, module, modèle, outils, fichiers, travail accompli, blocages, jetons
Démo
Importer du NDJSON et examiner le résumé pour le responsable et la visibilité des coûts
Mise en produit
Hooks Claude, installation sur plusieurs machines, rapports HTML/PDF
Consigner les faits automatiquement et les responsabilités explicitement
Agent Task Audit n'est pas un décodeur du routage caché des modèles. C'est un registre et une fiche de passation pour le travail multi-agents.
Boucle d'audit standard
- L'agent principal reçoit un objectif et déclare les exigences d'audit
- Les hooks consignent les requêtes (prompts), l'utilisation des outils, les autorisations et les événements d'arrêt
- Les sous-agents exécutent le travail de leur module et rédigent des autodéclarations
- Les rapports distinguent les champs exacts, estimés et inconnus
- Les responsables examinent le résumé, la répartition du travail, la visibilité des coûts et les risques
- Les équipes techniques n'examinent la chronologie brute qu'en cas de besoin
Système en 3 couches
Événements de hooks
Faits automatiques
Capture des événements du cycle de vie, des appels d'outils, des demandes d'approbation et des champs d'utilisation visibles.
Autodéclaration
Responsabilisation des exécutants
Chaque exécutant déclare son rôle, son module, ses outils, ses fichiers, le travail accompli, les blocages et les jetons.
Rapport au responsable
Responsabilités lisibles
Explique en anglais et en chinois qui a fait quoi, où les coûts sont visibles et ce qui reste opaque.
Liste de vérification du rapport au responsable
Chaque rapport doit répondre à ces questions : 1. Qui était responsable de quels modules? 2. Quelles informations sur les modèles étaient visibles? 3. Quels décomptes de jetons étaient exacts? 4. Quels décomptes de jetons étaient estimés ou autodéclarés? 5. Quels outils, commandes et fichiers ont été utilisés? 6. Y a-t-il eu des échecs, des blocages ou des inconnues?
Déroulement pédagogique suggéré
| Heure | Durée | Module | Mode |
|---|---|---|---|
| 00:00–10:00 | 10 min | Le problème de l'opacité du travail multi-agents | Explication |
| 10:00–20:00 | 10 min | Généralité et limites de visibilité | Clarification |
| 20:00–35:00 | 15 min | Architecture de l'extension et protocole d'autodéclaration | Analyse |
| 35:00–50:00 | 15 min | Visionneuse de démo | Exercice |
| 50:00–60:00 | 10 min | Feuille de route de la mise en produit | Discussion |
À qui s'adresse ce cours
Pour les personnes qui utilisent Codex/Claude dans de vrais flux de travail de livraison, de développement, de recherche et d'exploitation.
Bon profil ✓
- Consultants en automatisation IA
- Chefs techniques et responsables de projet
- Utilisateurs intensifs de Codex / Claude
- Équipes qui ont besoin de responsabilisation dans le travail multi-agents
Pas le bon profil ✗
- Vous vous attendez à ce que le routage caché des modèles soit décodé par magie
- Vous ne voulez pas que les exécutants fassent leur autodéclaration
- Vous voulez seulement du JSON brut et n'avez pas besoin de rapports au responsable
Questions fréquentes
Cette extension est-elle générique?
Le schéma, le protocole d'autodéclaration et le rapport au responsable sont génériques. L'installation de l'extension Codex et les chemins des hooks dépendent de la plateforme et de la machine. Pour Claude, il faut des hooks Claude Code ou une couche d'encapsulation (wrapper) qui écrit le même format de journal.
Peut-elle voir le vrai décompte de tous les jetons?
Seuls les décomptes de jetons exposés par l'environnement d'exécution sont exacts. Tout le reste est étiqueté comme estimé ou inconnu.
Pourquoi exiger des autodéclarations des sous-agents?
L'agent principal ne voit pas forcément tous les détails internes. Les autodéclarations font remonter au responsable la responsabilité des modules, les livrables, les risques et les coûts estimés.
Vous voulez des flux de travail de livraison IA auditables?
Nous pouvons vous aider à transformer vos flux de travail multi-agents Codex/Claude en boucles d'audit consignées, vérifiables et lisibles par le responsable.