Aller au contenu

Exécutions

Afficher en Markdown

Une exécution est un tour de travail effectif d’un agent : il lit son contexte, décide, appelle un outil, lit le résultat, et recommence jusqu’à obtenir une réponse ou avoir besoin de vous.

Vous ne lancez pas une exécution directement : c’est l’envoi d’un message qui en démarre une. Cette page sert à en lire une, c’est-à-dire à savoir ce que l’agent a fait, pourquoi il s’est arrêté, et quoi faire ensuite.

Chaque étape apparaît dans la conversation au moment où elle se produit :

  • Un appel d’outil, avec les arguments choisis par l’agent. C’est l’élément le plus instructif à l’écran. Un agent qui a cherché la mauvaise chose vous en apprend plus qu’une mauvaise réponse finale.
  • Le résultat renvoyé, erreurs comprises. Un appel qui échoue ne met pas fin à l’exécution : l’agent voit l’erreur et peut essayer autre chose.
  • Le texte de l’agent, diffusé au fur et à mesure qu’il est produit.

Si la réponse finale est fausse, remontez les appels d’outils. L’erreur est presque toujours visible dans l’un d’eux, et ce qu’il faut changer dépend de celui qui est en cause.

Raison de l’arrêtCe que vous voyezQue faire
Le travail est terminéUne réponse finaleRien
L’agent a besoin d’une information qu’il ne peut obtenir que de vousUne question : options, champ de texte ou ensemble de préférencesRépondez ; l’exécution reprend
L’agent veut faire quelque chose d’irréversibleUne demande d’approbation montrant l’action exacteApprouvez ou refusez
L’agent veut une compétence qu’il n’a pasUne demande d’accès à la compétenceAccordez-la ou refusez
L’exécution a atteint la limite d’étapesL’exécution se termine sans réponse finaleDemandez-lui de continuer, ou resserrez la tâche
L’exécution a échouéUne erreurRéessayez, ou corrigez ce qui la bloquait

Une exécution en pause garde sa place, elle ne repart pas de zéro. Votre réponse la relance avec tout ce qu’elle avait déjà établi.

Les exécutions tournent sur les serveurs d’endue, pas dans l’onglet de votre navigateur. Fermer l’application n’arrête pas le travail.

Lancez une longue tâche, fermez l’onglet, revenez plus tard : l’exécution a continué et le résultat est dans le fil. La liste des conversations signale les fils qui se sont terminés pendant votre absence, pour que vous n’ayez pas à retenir lesquels vérifier. C’est aussi ce qui rend les routines possibles : une exécution planifiée n’a besoin de personne pour la surveiller.

  • Une exécution a une limite d’étapes. Une tâche qui demande plus d’étapes que la limite ne le permet se termine sans réponse finale : découpez-la ou resserrez-la.
  • Une exécution garde la configuration avec laquelle elle a démarré : révision du prompt, modèle et outils associés. Les modifications faites en cours de route s’appliquent à la suivante.
  • Vous ne pouvez pas modifier un appel d’outil que l’agent a déjà effectué. Vous pouvez guider ce qu’il fait ensuite, ou refuser une action au moment de l’approbation.
  • Il n’y a pas de rejeu. Relancer une tâche démarre une nouvelle exécution, et les agents ne sont pas déterministes : la même demande peut emprunter un autre chemin.