Observabilité des agents IA · démo vérifiée

Extension Agent Task Audit
Rendre le travail multi-agents vérifiable

Quand le modèle le plus puissant coordonne et que des modèles exécutants plus légers réalisent les modules, utilisez des hooks et des autodéclarations pour consigner qui a fait quoi, quels outils ont servi et quels décomptes de jetons sont exacts ou estimés.

Télécharger le matériel

6

Événements de démo

3

Rapports d'exécutants

1 238

Jetons exacts

Anglais + chinois

Rapport au responsable

Ce que vous apprendrez

  • Expliquer pourquoi le travail multi-agents avec Codex/Claude doit être auditable
  • Distinguer les journaux automatiques des hooks, les autodéclarations des sous-agents et les limites de visibilité de l'environnement d'exécution
  • Utiliser Agent Task Audit pour consigner l'utilisation des outils, la responsabilité des modules et la visibilité des jetons
  • Transformer des journaux bruts en rapports en anglais et en chinois, lisibles par le responsable
  • Concevoir un protocole d'autodéclaration des sous-agents : rôle, module, modèle, outils, fichiers, blocages et jetons
  • Lancer la visionneuse de démo locale et importer des journaux d'audit NDJSON

Matériel du cours

Soumettez vos informations pour télécharger

Remplissez un court formulaire pour télécharger le PDF, les notes de cours, les notes de recherche et la capture d'écran de la démo.

Pour envoyer ces ressources aux personnes réellement intéressées, laissez vos coordonnées de base et vos sujets d’intérêt avant de télécharger. Le fichier s’ouvre automatiquement après l’envoi.

Déroulement du cours

D'une délégation opaque à une extension d'audit fonctionnelle et à un rapport au responsable.

Maintenant
Semaine 01

Pourquoi auditer les agents IA

Délégation d'objectifs, modèles coordonnateurs, exécutants et opacité pour le responsable

Semaine 02

Limites de la généralité

Schéma commun vs intégration propre à Codex/Claude

Semaine 03

Architecture de l'extension

Hooks, autodéclarations, rapports au responsable et visionneuse

Semaine 04

Protocole d'autodéclaration

Rôle, module, modèle, outils, fichiers, travail accompli, blocages, jetons

Semaine 05

Démo

Importer du NDJSON et examiner le résumé pour le responsable et la visibilité des coûts

Semaine 06

Mise en produit

Hooks Claude, installation sur plusieurs machines, rapports HTML/PDF

Méthode centrale

Consigner les faits automatiquement et les responsabilités explicitement

Agent Task Audit n'est pas un décodeur du routage caché des modèles. C'est un registre et une fiche de passation pour le travail multi-agents.

Utile comme formation sur l'outillage et les processus opérationnels
Durée recommandée : 45–60 minutes
PDF + démo
Rapport + Markdown + capture d'écran

Boucle d'audit standard

  • L'agent principal reçoit un objectif et déclare les exigences d'audit
  • Les hooks consignent les requêtes (prompts), l'utilisation des outils, les autorisations et les événements d'arrêt
  • Les sous-agents exécutent le travail de leur module et rédigent des autodéclarations
  • Les rapports distinguent les champs exacts, estimés et inconnus
  • Les responsables examinent le résumé, la répartition du travail, la visibilité des coûts et les risques
  • Les équipes techniques n'examinent la chronologie brute qu'en cas de besoin

Système en 3 couches

Événements de hooks

Faits automatiques

Capture des événements du cycle de vie, des appels d'outils, des demandes d'approbation et des champs d'utilisation visibles.

Autodéclaration

Responsabilisation des exécutants

Chaque exécutant déclare son rôle, son module, ses outils, ses fichiers, le travail accompli, les blocages et les jetons.

Rapport au responsable

Responsabilités lisibles

Explique en anglais et en chinois qui a fait quoi, où les coûts sont visibles et ce qui reste opaque.

Liste de vérification du rapport au responsable

Chaque rapport doit répondre à ces questions :

1. Qui était responsable de quels modules?
2. Quelles informations sur les modèles étaient visibles?
3. Quels décomptes de jetons étaient exacts?
4. Quels décomptes de jetons étaient estimés ou autodéclarés?
5. Quels outils, commandes et fichiers ont été utilisés?
6. Y a-t-il eu des échecs, des blocages ou des inconnues?

Déroulement pédagogique suggéré

HeureDuréeModuleMode
00:00–10:0010 minLe problème de l'opacité du travail multi-agentsExplication
10:00–20:0010 minGénéralité et limites de visibilitéClarification
20:00–35:0015 minArchitecture de l'extension et protocole d'autodéclarationAnalyse
35:00–50:0015 minVisionneuse de démoExercice
50:00–60:0010 minFeuille de route de la mise en produitDiscussion

À qui s'adresse ce cours

Pour les personnes qui utilisent Codex/Claude dans de vrais flux de travail de livraison, de développement, de recherche et d'exploitation.

Bon profil ✓

  • Consultants en automatisation IA
  • Chefs techniques et responsables de projet
  • Utilisateurs intensifs de Codex / Claude
  • Équipes qui ont besoin de responsabilisation dans le travail multi-agents

Pas le bon profil ✗

  • Vous vous attendez à ce que le routage caché des modèles soit décodé par magie
  • Vous ne voulez pas que les exécutants fassent leur autodéclaration
  • Vous voulez seulement du JSON brut et n'avez pas besoin de rapports au responsable

Questions fréquentes

Cette extension est-elle générique?

Le schéma, le protocole d'autodéclaration et le rapport au responsable sont génériques. L'installation de l'extension Codex et les chemins des hooks dépendent de la plateforme et de la machine. Pour Claude, il faut des hooks Claude Code ou une couche d'encapsulation (wrapper) qui écrit le même format de journal.

Peut-elle voir le vrai décompte de tous les jetons?

Seuls les décomptes de jetons exposés par l'environnement d'exécution sont exacts. Tout le reste est étiqueté comme estimé ou inconnu.

Pourquoi exiger des autodéclarations des sous-agents?

L'agent principal ne voit pas forcément tous les détails internes. Les autodéclarations font remonter au responsable la responsabilité des modules, les livrables, les risques et les coûts estimés.

Vous voulez des flux de travail de livraison IA auditables?

Nous pouvons vous aider à transformer vos flux de travail multi-agents Codex/Claude en boucles d'audit consignées, vérifiables et lisibles par le responsable.

Télécharger le matériel