Pourquoi certaines réponses sont-elles rapides alors que d'autres prennent du temps ?
Distinguer la génération de modèles, l'exécution d'outils, l'approbation et l'organisation du contexte.
Le temps de consommation n'est pas seulement dû à la génération du modèle
Les questions-réponses courtes peuvent se terminer rapidement, mais les tâches Agent impliquent également le démarrage d'outils, l'exécution de commandes, les requêtes web, le traitement de fichiers ou l'attente d'approbation. Les longs contextes peuvent être organisés d'abord avant de continuer, il n'est donc pas exact d'expliquer tous les temps d'attente simplement comme « le modèle est lent ».
Observer si l'affichage actuel montre une réflexion, une exécution d'outil, une organisation de contenu ou une attente d'approbation aide à identifier le véritable goulot d'étranglement.
Gérer l'attente avec des objectifs d'étape
Pour les tâches de grande portée, obtenez d'abord une conclusion préliminaire ou une liste de contrôle, puis décidez quelle partie explorer en profondeur. De cette façon, des résultats utilisables peuvent être obtenus plus tôt, et il est plus facile de détecter si l'objectif est hors de portée.
Par exemple, faites en sorte que la tâche vérifie d'abord un échantillon représentatif et rapporte les conclusions préliminaires et les prochaines étapes attendues, plutôt que de traiter tous les matériaux en même temps. Après avoir confirmé que la direction est correcte, élargissez la portée. Cela réduit le travail de reprise causé par la découverte de malentendus seulement après de longues attentes.
- Confirmez la dernière mise à jour du statut et les invites de l'outil.
- Vérifiez les opérations rapidement lorsque l'approbation est nécessaire.
- Pour les commandes longues, privilégiez la poursuite de la visualisation de la conversation d'origine pour éviter de redémarrer à plusieurs reprises.
- Gérez les erreurs claires au fur et à mesure qu'elles se produisent, plutôt que de simplement continuer à attendre.
Comment réduire les coûts des tâches
Demandez de prioriser les causes les plus probables, de sauvegarder les résultats intermédiaires et de lister les éléments restants. Vous pouvez spécifier la sortie des preuves clés uniquement et des explications nécessaires, puis développer au besoin. Changer de modèle peut modifier l'expérience mais ne peut garantir des temps de réponse fixes ; le réseau, le site web cible et l'état de l'ordinateur local affectent également le temps d'achèvement global.