Hackcat

Agentにタスクを逸脱させずに大規模なタスクを割り当てるにはどうすればよいですか?

スコープ、成果物、およびマイルストーンのチェックポイントを定義します。

検証可能な目標を最初に書く

大規模なタスクの場合、ターゲット、許可されたスコープ、提供されるファイルまたは結論、およびどの操作が事前の確認を必要とするかを明確に指定するのが最善です。たとえば、「このレポートの証拠の完全性をチェックし、補完する必要がある項目のリストを出力してください。現時点では元のファイルは変更しないでください。」

計画のみを議論したい場合は、まず分析を指定してください。Agentに実行させる場合は、選択した環境と権限を確認してください。

証拠に基づいて計画を更新可能にする

AgentにまずToDoリストを作成させ、最も重要なステップから開始するように要求できます。計画は、すべての後続アクションに対する無条件の承認ではありません。スコープが変更された場合は、必要な決定を再述してください。

各フェーズの終わりに、簡単な引き継ぎを要求できます。検証されたこと、成果物がどこにあるか、まだ不足している条件は何かなどです。これにより、タスクが中断されたり、後で別のコンピューターで続行されたりした場合でも、未完了の部分を完了済みと誤解することなく、実際の進捗から再開しやすくなります。

  1. このラウンドで完了するフェーズを指定します。
  2. 主要なチェックと期待される成果物に関する説明を要求します。
  3. まず小さなサンプルをチェックし、結果に基づいて拡張します。
  4. 完了した項目、未完了の項目、およびその理由の最終リストを作成させます。

逸脱が見つかった場合の修正方法

逸脱した目標または実行された追加ステップを直接指摘し、既存の有効な結果を保持して残りの作業を調整するように要求します。最初からタスク全体を再述する必要はありません。長いコマンドの場合、まず実行中かどうかを確認して、計画を修正する際に再起動しないようにします。完了基準は、ToDoが完了としてマークされたかどうかだけでなく、証拠によって裏付けられるべきです。